Lex Fridman 播客节选:DeepSeek 到底用了多少张显卡训练?
gentle @ 2025年02月09日 世界观
在本期 Lex Fridman 播客中,嘉宾深入探讨了中国对冲基金幻方及其 AI 子公司 DeepSeek 的发展历程。幻方历史上专注于量化交易,拥有大量 GPU 资源。早在 2021 年,他们宣布拥有中国首个由 10,000 张 A100 GPU 组成的集群。这些资源不仅用于交易,还用于训练大型语言模型等 AI 项目。 DeepSeek 的 CEO 梁文锋被视为中国的 AI 先锋,致力于推动中国在 AI 生态系统中的领先地位。截至目前,DeepSeek 拥有约 50,000 张 GPU,分布于对冲基金运营、AI 研究和模型训练等多个领域。在最新的 V3 模型训练中,他们使用了 2,000 张 H800 GPU,展示了在资源优化和 AI 研发方面的卓越能力。 揭示了幻方和 DeepSeek 在 AI 领域的战略布局,以及他们如何利用现有资源推动技术创新。 bogolyx:总结:觉得这个采访很中肯。 1.他们放的梁的照片还是错误的吧? 2.他们猜测整个幻方有5万张卡。(感觉还是准的。但是比起其他的MEta等还是少了,而且人家真的还要用在对冲基金上的) 吃成胖子子:量化基金,不是对冲基金 (视频) |
热点阅读
- 双语字幕:马克龙当众纠正川普说错了,川普全程臭..
- BBC纪录片Meet The Lords探秘英国上议院..
- 用AI生成世界名画《蒙娜丽莎》创作前后的画面..
- 坂本龙一演奏改编自埃尼奥·莫里康内的《1900》..
- 漫威和DC同框打工人…
- 音乐也有科学道理?哆唻咪到底是咋定的?李永乐老..
- #北京国际电影节#姜文电影大师班全程视频..
- 韩国总统解除紧急戒严令:这一晚韩国发生了什么?..
- 这个视频进到我的脑子里需要加关税!!!..
- 英国一列亮起圣诞灯光的蒸汽火车
- 什么是“肉桂”?为什么“锡兰肉桂”如此昂贵?..
- 美国社区图书馆什么样
- 1997年杨紫琼:成龙就是男权沙文主义猪..
- 椰树模特线下粉丝见面会
- 莫斯科街头出现大批军车