Lex Fridman 播客节选:DeepSeek 到底用了多少张显卡训练?
gentle @ 2025年02月09日 世界观
在本期 Lex Fridman 播客中,嘉宾深入探讨了中国对冲基金幻方及其 AI 子公司 DeepSeek 的发展历程。幻方历史上专注于量化交易,拥有大量 GPU 资源。早在 2021 年,他们宣布拥有中国首个由 10,000 张 A100 GPU 组成的集群。这些资源不仅用于交易,还用于训练大型语言模型等 AI 项目。 DeepSeek 的 CEO 梁文锋被视为中国的 AI 先锋,致力于推动中国在 AI 生态系统中的领先地位。截至目前,DeepSeek 拥有约 50,000 张 GPU,分布于对冲基金运营、AI 研究和模型训练等多个领域。在最新的 V3 模型训练中,他们使用了 2,000 张 H800 GPU,展示了在资源优化和 AI 研发方面的卓越能力。 揭示了幻方和 DeepSeek 在 AI 领域的战略布局,以及他们如何利用现有资源推动技术创新。 bogolyx:总结:觉得这个采访很中肯。 1.他们放的梁的照片还是错误的吧? 2.他们猜测整个幻方有5万张卡。(感觉还是准的。但是比起其他的MEta等还是少了,而且人家真的还要用在对冲基金上的) 吃成胖子子:量化基金,不是对冲基金 (视频) |
热点阅读
- 女性题材纪录片《女也》(Woman) 发布最新台版【中..
- 刘烨 + 胡军《蓝宇》4K 数字修复片段..
- 30年前计划生育严打有多严重,只有经历过的人才知..
- 鉴于美国加征关税,肥伦恶搞#特朗普#新段子..
- 美国传奇保守派经济学家托马斯·索维尔评特朗普关..
- 强大的彝族习惯法(奴隶制),这真是某些人的愿望..
- 在月球上引爆核弹,会导致它砸向地球吗?..
- 东北零下30度吹泡泡瞬间结冰花
- 鲁比奥这段话已经明确了:俄乌战争终究和美国无关..
- 1988年的中国发生了什么?【激荡四十年·1988】..
- 歌者:《一辈子的孤单》
- 拜登2024国情咨文中英文字幕精翻完整版..
- 前苏联纪录片《朝鲜战争》
- 被遗忘的春天
- 今年西雅图在太空针塔上的跨年灯光秀..