scripod.com

E246|何谓蒸馏?聊聊硅谷如何看中国开放模型逼近前沿

硅谷101

15 HOURS AGO
硅谷101

硅谷101

15 HOURS AGO

Shownote

7 月 27 日,月之暗面正式发布 Kimi K3 的完整模型权重。自 7 月 16 日 API 上线以来,K3 就在在多项测试中展现出接近前沿模型的能力。因此,它成为了硅谷最近讨论开源时的重要案例之一。从 2025 年初的 DeepSeek 时刻,到当下的 Kimi K3,中国开源模型正在从成本更低、能力稍弱的替代品,逐渐逼近甚至超过最强的闭源前沿模型。 随之而来的,是一场越来越激烈的蒸馏争论。什么是蒸馏?通过闭源模型的输出进行训练,和未经授权的大规模能力提取,有什么区别?即使中国实验室使用过美国模型生成的数据,它又究竟能解释多少最终能力...

Highlights

本期播客聚焦中国开放权重模型(如 Kimi K3)对硅谷及全球 AI 生态的冲击,探讨其能力提升、蒸馏争议、商业模式影响及安全议题。嘉宾王铁震和 Keith Zhai 从开源生态与企业视角,分析了开放模型如何逼近闭源前沿,并引发行业格局调整。
00:00
开放模型正逼近前沿,挑战闭源商业模式。
01:49
K3 开放权重模型能力达到新高度
03:33
开源模型再次与闭源模型持平
09:11
开放模型成为更务实的选择
10:23
开源模型推理仅包含硬件和服务成本,无需支付模型授权费
13:40
闭源模型禁止他人使用其输出,却用人类数据训练,存在矛盾。
19:11
闭源厂商以蒸馏为名,实为监控用户数据
19:49
蒸馏可快速达到及格线,但无法实现超越
24:01
能赚钱的开源模型才可持续
41:44
过度限制用户反而促使更多人转向开源模型
43:41
开源决策受地缘政治博弈影响,商业逻辑退居其次。
45:05
开源界需要持续创新
48:49
市场混乱催生中间商
53:40
AI 应作为服务而非抽血机
1:02:42
没有开源反而是最不安全的
1:05:42
开源模型安全担忧为时过早

Chapters

开放模型挑战闭源 AI
00:00
中国开放模型,硅谷怎么看?
Kimi K3 为什么突然成为硅谷关注的焦点?
01:45
从 DeepSeek、GLM 到 K3:硅谷对中国模型的判断如何变化
03:33
企业为什么开始转向中国模型
06:51
中国开放模型推理成本
10:23
蒸馏争端始末
蒸馏争议:到底什么是蒸馏?
13:24
K3 是否可能在短时间内蒸馏最强闭源模型?
17:22
蒸馏能解释模型的核心能力吗?
19:48
开放模型对闭源商业模式的影响
K3 License 与开放模型商业化
23:54
开放模型会怎样冲击 OpenAI 和 Anthropic 的收入与估值?
34:27
中国公司为什么选择开放
43:41
强大的开放能力下,Agent 生态如何变化?
Thinking Machines 为什么开放权重?
45:04
OpenRouter 等多模型平台为什么开始受益?
48:43
对 Agent 产品和基础设施的影响
49:56
开放模型的安全之争
接近前沿的模型,到底应不应该开放权重?
55:40
开源和闭源模型,谁更容易被滥用?
1:04:01

Transcript

Yiwen: 大家好,欢迎回到硅谷 101, 我是 Yiwen。硅谷前沿 AI 实验室的商业模式,大家应该都不陌生,把智能封装成 API 再按 Token 出售给用户。但现在,几家中国实验室正在用开放权重模型挑战这套模式。7 月 27 日,月之暗面正式发布了 Kimi K3 的完整模型权重。在此之前,K3 的横空出世以及它在多项测试上展现出的竞争力都已经说明了一件事。开源模型正在逼近甚至超过最强的闭源模型。这意味着企业未来可能都不再需要完全依赖 OpenAI 或者 Anthropic, 也可以部署定制和掌控...