E246|何谓蒸馏?聊聊硅谷如何看中国开放模型逼近前沿

播放真实单集
Episode Summary真实 show notes
7月27日,月之暗面正式发布Kimi K3的完整模型权重。自7月16日API上线以来,K3就在在多项测试中展现出接近前沿模型的能力。因此,它成为了硅谷最近讨论开源时的重要案例之一。从2025年初的DeepSeek时刻,到当下的Kimi K3,中国开源模型正在从成本更低、能力稍弱的替代品,逐渐逼近甚至超过最强的闭源前沿模型。 随之而来的,是一场越来越激烈的蒸馏争论。什么是蒸馏?通过闭源模型的输出进行训练,和未经授权的大规模能力提取,有什么区别?即使中国实验室使用过美国模型生成的数据,它又究竟能解释多少最终能力? 本期播客,我们邀请到两位嘉宾来分别从开源生态和企业的视角,讨论这一波中国开源模型的影响:前Hugging Face亚太开源生态负责人王铁震,和TinyFish联合创始人Keith Zhai。 我们从K3带给硅谷的挑战聊起,讨论了为什么把中国模型的进步全部归因于蒸馏,实际上忽略了架构、强化学习、数据工程和推理基础设施上的创新。而当蒸馏从一种中性的训练技术,变成商业竞争和政策讨论中的指控时,争议的核心又变成了什么? 在此之外,我们也讨论了K3针对大型推理服务商设计的商业授权:当开源权重模型持续压低成本,它会如何冲击OpenAI、Anthropic等闭源实验室的商业模式?当模型能力逐渐商品化,未来AI行业的价值会流向模型本身、推理基础设施,还是Agent与企业工作流? 注:本期播客中提到的“开源”,更准确地说是开放权重(open weights)。K3官方称自己为开放模型,它使用的是Kimi K3 License,不是标准 MIT/Apache 这类完全开放的OSI licen
Business Vocabulary规则派生 · 可核对
ai
Marketing Insight规则派生 · 可核对
商业启示与英文表达将由此基于真实内容萃取。当前为结构占位,不生成虚构事实。