又一个媲美o1的“开源推理模型”来了!训练成本竟然不到450美元
taiyang @ 2025年01月13日 财经风云
| 又一个媲美o1的"开源推理模型"来了!训练成本竟然不到450美元 蒋紫涵 开发成本的大幅降低主要得益于合成训练数据的应用——NovaSky团队利用阿里巴巴的QwQ-32B-Preview模型生成了初始训练数据,随后"整理"数据混合,并利用OpenAI的GPT-4o-mini将数据重构为更易用的格式,最终形成了可用的训练集。 低成本训练人工智能推理模型的时代到来了? 近日,加州大学伯克利分校Sky Computing Lab的研究团队NovaSky发布了一个名为Sky-T1-32B-Preview的开源人工智能推理模型,这一模型在多项关键基准测试中表现出与OpenAI早期o1版本相当的水平,更令人瞩目的是,其开发成本仅为450美元! 相较于不久前动辄数百万美元的模型开发费用,Sky-T1-32B-Preview可谓是一个巨大的进步。NovaSky团队在博客文章中表示: "Sky-T1-32B-Preview的训练成本不到450美元,这证明了以低成本、高效率复制高级推理能力是可行的。" 那么,为什么NovaSky团队能大幅降低训练成本? 根据NovaSky团队的报告,开发成本的大幅降低主要得益于合成训练数据的应用——NovaSky团队利用阿里巴巴的QwQ-32B-Preview模型,生成了Sky-T1-32B-Preview的初始训练数据,随后"整理"数据混合,并利用OpenAI的GPT-4o-mini将数据重构为更易用的格式,最终形成了可用的训练集。使用8个Nvidia H100 GPU机架训练320亿参数的Sky-T1-32B-Preview模型,大约需要19个小时。 报告还提到,Sky-T1-32B-Preview在MATH500(一套竞赛级数学挑战题)和LiveCodeBench(一个编程评估集)的部分难题上,表现优于o1的早期预览版;在GPQA-Diamond(包含PhD级别的物理、生物和化学问题)测试中,Sky-T1-32B-Preview1的表现略逊于o1预览版。 不过需要注意的是,OpenAI正式发布的o1版本性能更强,且预计将在未来几周内推出更先进的o3模型。 风险提示及免责条款 市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。
|
相关内容
-
暂无...
推荐内容
- 逆袭!600家小市值公司藏金,机构调研曝光三大爆..
- 特朗普“大重置”:债务化解、脱虚向实、美元贬值..
- 美股三大指数冲高回落,中概股重挫,纳斯达克中国..
- 深夜,重挫!近一个月最大跌幅;鸿蒙智行,连推爆..
- 活久见!美国商务部长上电视“推票”:买特斯拉股..
- 华尔街解读美联储决议:鸽派的亮点与迷你“鲍威尔..
- 深海经济利好持续加码,与商业航天、低空经济并列..
- 美联储的“关键一战”在5月,届时降不了息,那今..
- 李嘉诚押注创新药!和黄医药明星抗癌药海外大卖近..
- “三巫日”前美股反弹一日游,量子计算股暴跌,拼..
- 鲍威尔给经济焦虑“灭火”,标普创八个月来美联储..
- 腾讯要为AI砸千亿重金
- 政治危机升级,反对派领袖被捕引发土耳其股债汇三..
- 3月LPR报价出炉!1年期、5年期均维持不变..
- 五部门:依法稳步推进绿证强制消费,逐步提高绿色..
热点阅读
- 央妈又出手了 一次性下调 各期限SLF利率10BP..
- 如果商品期货热度回落,资金将流向何方?..
- 赵长鹏“玩火会自焚”吗?币圈风暴刮到了币安..
- 美联储“最后的加息”是利空出尽?美银:历史告诉..
- 科创板一周年“成绩单”:111家企业斩获1.77万亿..
- FTX创始人公开亮相:身家曾达260亿美元现仅剩1张..
- 巴菲特已重仓押注!新一轮产品驱动来临,这个行业..
- 央媒头版:“十三五”去产能有望提前两年超额完成..
- 再来1万亿元专项债 财政刺激路线图逐步清晰..
- 26艘油轮堵在海上!土耳其成了全球原油运输的“新..
- 华尔街点评非农:不足以影响美联储本月降息 下周..
- 通俄门重大进展:前律师认罪!首次公开点明特朗普..
- 科技股财报前夕,对冲基金大幅减持..
- 国务院国资委:将出台新版授权放权清单..
- 惊呆!史上最惨内幕交易:两人联手狂买3.7亿,结..