深度解析DeepSeek V4模型及其在模型效率、算力突破和AGI发展中的重要意义,探讨硅谷AI生态最新动态。
Ask about this video. Answers come from its transcript only — with the timestamp, so you can check them.
Generated from the transcript and can be wrong — check the timestamp.
Key Takeaways
- 开源模型DeepSeek V4在性能和效率上对闭源商业模式构成重大挑战。
- 模型效率(token efficiency)是智能发展的关键指标之一。
- 中国AI算力生态通过适配昇腾芯片实现重要突破。
- 硅谷AI生态正经历多方竞争与资本动态,未来发展充满变数。
- 技术创新与资本市场动态共同推动AGI和基础模型的发展。
What the video covers
- DeepSeek V4发布,展示了AGI模型的新形态,性能优于其他开源模型。
- 讨论了模型之战,包括DeepSeek、Kimi K2.6、OpenAI GPT-5.5、Google TPU和Anthropic融资等热点。
- 指出基础模型公司若被开源模型超越,商业价值将大幅下降,效率成为智能的重要组成部分。
- DeepSeek V4支持百万token上下文,面向智能体编程和复杂多步任务,提升token效率。
- DeepSeek已适配昇腾芯片,标志中国AI算力生态的进步。
- 邀请硅谷芯片架构师肖志斌和前OpenAI研究员、风险投资人Jenny Xiao深入探讨技术与市场影响。
- 分析非英伟达芯片的进化路径及硅谷主流模型路线的选择。
- 探讨OpenAI与Anthropic的竞争及其商业化和资本市场的动态。
- 介绍DeepSeek在混合注意力机制(CSA、HCA、mHC)和Muon优化器上的技术创新。
- 强调DeepSeek Moment对今年AI市场的深远影响和工程完成度的惊喜。
Full Transcript — Download SRT & Markdown
Speaker A
DeepSeek V4来了。最近模型之战又打起来了。我们讲的是DeepSeek DeepSeek V4。这就是AGI的样子吗?比其他开源模型好太多了。DeepSeek之外,Kimi K2.6、OpenAI GPT-5.5、Google新一代TPU以及Anthropic新融资消息几乎同时出现。
Speaker A
它为美国的基础模型公司 划定了一个“死亡地带”或“死亡线” 如果你是一家基础模型公司 而你被开源公司超越了 你的业务价值基本上就是零 我认为这里的教训是 效率也是智能的一部分 像DeepSeek这样的开源模型 是美国闭源商业模式面临的 最大结构性威胁之一 我认为Anthropic和OpenAI今年将上市 公开市场对于Anthropic的胃口比对OpenAI的大得多 很多机构在试图在IPO前抛售OpenAI DeepSeek V4的特殊之处不只是模型能力 而是它支持100万token上下文 面向agentic coding(智能体编程)和复杂多步任务 并且被媒体报道已经适配昇腾等芯片 这被外界视为中国AI和算力生态进一步追赶的重要信号 这一期视频播客我们与在硅谷的两名嘉宾聊了聊 对DeepSeek的创新、模型效率 非英伟达芯片进化的下一步 还有硅谷主流模型路线的发展选择 OpenAI与Antrhopic之战 商业化落地的思考 以及从资本市场等等视角都进行了深度探讨 首先是我与嘉宾肖志斌的对话 他是资深芯片架构师 也是ZFLOW AI创始人兼CEO 及前华美半导体协会主席 在技术角度之外 我们也想从整个硅谷的角度 看看DeepSeek带来的影响和启示 第二位嘉宾和我们对谈的是OpenAI的前研究员 如今从事风险投资行业 是硅谷Leonis Capital的合伙人Jenny Xiao
Speaker A
在如此多的声音中,今年的DeepSeek Moment对AI市场来说意味着什么呢?工程的完成度有非常大的惊喜。在提高token efficiency(词元效率)上,继续一骑绝尘。混合注意力机制CSA(压缩稀疏注意力),加HCA(重度压缩注意力),mHC(流形约束超连接),还有就是那个Muon的优化器。
Topics:DeepSeek V4AGI模型效率token效率算力突破开源模型硅谷AIOpenAIAnthropic芯片适配











