Lex Fridman 播客节选:DeepSeek 到底用了多少张显卡训练?
gentle @ 2025年02月09日 世界观
在本期 Lex Fridman 播客中,嘉宾深入探讨了中国对冲基金幻方及其 AI 子公司 DeepSeek 的发展历程。幻方历史上专注于量化交易,拥有大量 GPU 资源。早在 2021 年,他们宣布拥有中国首个由 10,000 张 A100 GPU 组成的集群。这些资源不仅用于交易,还用于训练大型语言模型等 AI 项目。 DeepSeek 的 CEO 梁文锋被视为中国的 AI 先锋,致力于推动中国在 AI 生态系统中的领先地位。截至目前,DeepSeek 拥有约 50,000 张 GPU,分布于对冲基金运营、AI 研究和模型训练等多个领域。在最新的 V3 模型训练中,他们使用了 2,000 张 H800 GPU,展示了在资源优化和 AI 研发方面的卓越能力。 揭示了幻方和 DeepSeek 在 AI 领域的战略布局,以及他们如何利用现有资源推动技术创新。 bogolyx:总结:觉得这个采访很中肯。 1.他们放的梁的照片还是错误的吧? 2.他们猜测整个幻方有5万张卡。(感觉还是准的。但是比起其他的MEta等还是少了,而且人家真的还要用在对冲基金上的) 吃成胖子子:量化基金,不是对冲基金 (视频) |
热点阅读
- 刘烨 + 胡军《蓝宇》4K 数字修复片段..
- 大型话剧《九一三事件》
- 强大的彝族习惯法(奴隶制),这真是某些人的愿望..
- 日本首相石破茂发表战后80周年谈话:警惕民粹主义..
- 歌者:台湾大学合唱团:台湾传统念谣《收惊歌》..
- 《坏小子》,争议很大的韩国电影
- 歌者:滚石唱片今天官方发布了高清版本的「明天会..
- 查理柯克这两天一段比较火的视频,和一位自由派女..
- 用”尖叫鸡“演绎《波西米亚狂想曲》..
- RT独家纪录片《朝鲜:世界上最幸福的人》上集..
- #FDA对隆胸发出最强警告#:存在癌症、慢性疲劳、..
- “援交平台”登上社交APP榜首 “女硕士”明码标价..
- CNN 脱口秀历史 8 政治靠边(2017)
- 华司长斥CNN不合时宜
- 美剧大佬――一部有关美剧诞生的故事..