斯坦福“草泥马”火了:100美元就能比肩GPT-3.5!手机都能运行的那种
gangqin @ 2023年03月15日 财经风云
斯坦福"草泥马"火了:100美元就能比肩GPT-3.5!手机都能运行的那种 量子位 GPT-3.5自己"教"出了个旗鼓相当的对手AI。 一夜之间,大模型界又炸出个big news! 斯坦福发布Alpaca(羊驼,网友口中的"草泥马"): 只花100美元,人人都可微调Meta家70亿参数的LLaMA大模型,效果竟可比肩1750亿参数的GPT-3.5(text-davinci-003)。 而且还是单卡就能运行的那种,甚至树莓派、手机都能hold住! 还有一个更绝的"骚操作"。 研究所涉及到的数据集,是斯坦福团队花了不到500美元用OpenAI的API来生成的。 所以整个过程下来,就等同于GPT-3.5自己教出了个旗鼓相当的对手AI。 然后团队还说,用大多数云计算平台去微调训练好的模型,成本也不到100美元: 复制一个GPT-3.5效果的AI,很便宜,很容易,还很小。 而且团队还把数据集(秒省500刀)、代码统统都给开源了,这下子人人都能去微调个效果炸裂的对话AI: 项目在GitHub发布才半天时间,便已经狂揽1800+星,火爆程度可见一斑。 Django联合开发者甚至对斯坦福的新研究用"惊天大事"来形容: 不仅如此,斯坦福团队还搞了个demo,在线可玩的那种。 话不多说,我们现在就来看看这个"草泥马"的效果。 比肩davinci-003的草泥马Aplaca 什么是羊驼?它和美洲驼的区别是什么? 草泥马Aplaca给出的答案较为干练: 羊驼是一种小型骆驼科动物,原产于秘鲁、玻利维亚、厄瓜多尔和智利;它比美洲驼小,羊毛更细,也没有驼峰。 而后又简单的介绍了二者群居生活的不同。 同样的问题若是交给ChatGPT(GPT3.5-turbo),则答案就不会像草泥马Aplaca那般简洁: 对此,团队给出的解释是: Alpaca的答案通常比ChatGPT短,反映出text-davinci-003的输出较短。 而后团队演示了让草泥马Alpaca写邮件: 写一封e-mail祝贺被斯坦福大学录取的新生,并提到你很高兴能亲自见到他们。 草泥马Alpaca对于这个任务也是信手拈来,直接给出了一个像模像样的邮件模板: 难度再次进阶,团队这次提出了让草泥马Alpaca写论文摘要的需求: 写一篇经过深思熟虑的机器学习论文摘要,证明42是训练神经网络的最优seed。 草泥马Alpaca给出的答案从内容上来看,非常符合大多数论文的摘要形式:试图回答什么问题、用了什么方法、结果如何,以及未来展望。 当然,也有迫不及待的网友亲自下场试验,发现草泥马Alpaca写代码也是不在话下。 不过即便草泥马Alpaca能够hold住大部分问题,但这并不意味着它没有缺陷。 例如团队便演示了一个例子,在回答"坦桑尼亚的首都是哪里"的问题时,草泥马Alpaca给出的答案是"达累斯萨拉姆"。 但实际上早在1975年便被"多多马"取代了。 除此之外,若是亲自体验过草泥马Alpaca就会发现,它……巨慢: 对此,有网友认为可能是使用的人太多的原因。 笔记本、手机、树莓派都能跑 Meta开源的LLaMA大模型,刚发布几周就被大家安排明白了,单卡就能运行。 所以理论上,基于LLaMA微调的Alpaca同样可以轻松在本地部署。 没有显卡也没关系,苹果笔记本甚至树莓派、手机都可以玩。 在苹果笔记本部署LLaMA的方法来自GitHub项目llama.cpp,使用纯C/C++做推理,还专门对ARM芯片做了优化。 作者实测,M1芯片的MacBook Pro上即可运行,另外也支持Windows和Linux系统。 还是这个C++移植版本,有人成功在4GB内存的树莓派4上成功运行了LLaMA的 70亿参数版本。 虽然速度非常慢,大约10秒生成一个token(也就是一分钟蹦出4.5个单词)。 更离谱的是仅仅2天之后,有人把LLaMA模型量化压缩(权重转换成更低精度的数据格式)后成功在Pixel 6安卓手机上运行(26秒一个token)。 Pixel 6使用谷歌自研处理器Google Tensor,跑分成绩在骁龙865+到888之间,也就是说新一点的手机理论上都能胜任。 微调数据集也开源 斯坦福团队微调LLaMA的方法,来自华盛顿大学Yizhong Wang等去年底提出的Self-Instruct。 以175个问题作为种子任务,让AI自己从中组合出新的问题以及生成配套答案实例,人工过滤掉低质量的,再把新任务添加到任务池里。 所有这些任务,之后可以采用InstructGPT的方法让AI学会如何遵循人类指令。 套娃几圈下来,相当于让AI自己指导自己。 斯坦福版Alpaca,就是花了不到500美元使用OpenAI API生成了5.2万个这样的示例搞出来的。 这些数据同样开源了出来,并且比原论文的数据多样性更高。 同时还给出了生成这些数据的代码,也就是说如果有人还嫌不够,可以再去自行扩充微调数据,继续提高模型的表现。 微调代码也会在HuggingFace官方支持LLaMA后放出。 不过Alpaca最终的模型权重需要Meta许可才能发布,并且继承了LLaMA的非商用开源协议,禁止任何商业用途。 并且由于微调数据使用了OpenAI的API,根据使用条款也禁止用来开发与OpenAI形成竞争的模型。 One More Thing 还记得AI绘画的发展历程吗? 2022年上半年还只是话题热度高,8月份Stable Diffusion的开源让成本下降到可用,并由此产生爆炸式的工具创新,让AI绘画真正进入各类工作流程。 语言模型的成本,如今也下降到了个人电子设备可用的程度。 最后还是由Django框架创始人Simon Willison喊出: 大语言模型的Stable Diffusion时刻到了。 本文作者:梦晨、金磊,来源:量子位,原文标题:《斯坦福"草泥马"火了:100美元就能比肩GPT-3.5!手机就能运行》 风险提示及免责条款 市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。
|
相关内容
-
暂无...
推荐内容
- 逆袭!600家小市值公司藏金,机构调研曝光三大爆..
- 特朗普“大重置”:债务化解、脱虚向实、美元贬值..
- 美股三大指数冲高回落,中概股重挫,纳斯达克中国..
- 深夜,重挫!近一个月最大跌幅;鸿蒙智行,连推爆..
- 活久见!美国商务部长上电视“推票”:买特斯拉股..
- 华尔街解读美联储决议:鸽派的亮点与迷你“鲍威尔..
- 深海经济利好持续加码,与商业航天、低空经济并列..
- 美联储的“关键一战”在5月,届时降不了息,那今..
- 李嘉诚押注创新药!和黄医药明星抗癌药海外大卖近..
- “三巫日”前美股反弹一日游,量子计算股暴跌,拼..
- 鲍威尔给经济焦虑“灭火”,标普创八个月来美联储..
- 腾讯要为AI砸千亿重金
- 政治危机升级,反对派领袖被捕引发土耳其股债汇三..
- 3月LPR报价出炉!1年期、5年期均维持不变..
- 五部门:依法稳步推进绿证强制消费,逐步提高绿色..
热点阅读
- 中国互联网巨头中增长最快!大摩:美团剑指300港..
- 逆袭!600家小市值公司藏金,机构调研曝光三大爆..
- Cliff Asness:这是一封写在2035年的十年资产配置..
- 500亿量化帝国“幕后推手”:龙头券商财富业务“..
- 超千家公司将被ST?真实数据来了,66股符合ST新规..
- 交行发放上海首笔数字人民币就业补贴,A股最大金..
- 过亿糖尿病患者迎新药,全球首个超长效胰岛素在华..
- A股进入“分红实施季”,高股息个股名单来了..
- 高盛:只要霍尔木兹海峡不关闭,“红海危机”对油..
- 中共中央、国务院印发意见 首次系统部署加快经济..
- 股市应该每年赚多少?
- IPO叫停四年后蚂蚁传上市“小作文”:A股再掀涨停..
- 中国主导身体,英伟达要做大脑,特斯拉“做整合”..
- 中国6月社会消费品零售总额同比增长2%,化妆品下..
- 全国住房城乡建设工作会议:2025年要全面深化建筑..