网界
网络资讯 网界财经 科技人物 数据洞察 行业动态 智能出行 智能手机 数码极客 商业资讯

张一鸣“拒绝蒸馏”引热议:字节跳动能否以长期主义破局AI竞争?

2026-08-07来源:快讯编辑:瑞雪

在AI大模型领域竞争愈发激烈的背景下,字节跳动创始人张一鸣近期在内部会议上的表态引发行业热议。他明确表示,字节跳动不会采用AI蒸馏技术改进模型,认为这种做法会阻碍真正意义上的长期技术突破。这一观点与当前部分企业通过技术捷径提升模型性能的做法形成鲜明对比。

模型蒸馏技术作为知识迁移的重要手段,其原理类似于教育场景中的师生互动。清华大学刘嘉教授在《通用人工智能》中解释,该技术通过已训练好的大型模型指导小型模型训练,使后者在保持高效的同时接近前者的性能。这种"教师-学生"模式的核心在于,小型模型不仅学习正确答案,更模仿大型模型的推理逻辑。

尽管技术本身具有中立性,但实际应用中引发的争议持续升级。今年初,Anthropic指控多家中国公司通过虚假账户与其模型交互实施"蒸馏攻击",引发行业对技术伦理的讨论。月之暗面副总裁黄震昕则强调,K3模型的性能提升源于底层架构创新,而非对现有模型的简单复刻。这种技术路线的分歧,反映出行业对创新本质的不同理解。

支持者认为,蒸馏技术显著降低了模型训练成本。一个小型模型通过学习大型模型的推理过程,可在算力消耗大幅降低的情况下达到相似效果。Anthropic等公司采用的"自蒸馏"策略,即用自身大模型训练小模型,已成为行业通行做法。英伟达创始人黄仁勋更公开表示,蒸馏是智能发展的基础,AI需要通过这种学习方式实现进步。

然而技术优势背后隐藏着深层风险。过度依赖蒸馏可能导致模型同质化,削弱行业创新能力。当所有模型都基于同一基础模型优化时,真正的原创性突破将难以实现。更值得关注的是文化自主性问题,刘嘉教授指出,蒸馏模型可能在无形中继承原始模型的价值体系,这对需要保持文化独立性的应用场景构成潜在威胁。

字节跳动的选择在业内引发两极评价。部分观点认为,技术路线选择本无对错,关键在于企业战略定位。但也有批评指出,其豆包模型在复杂推理和代码生成能力上与头部产品存在明显差距,"不蒸馏"策略可能是导致落后的主要原因。在海外模型持续领先的现状下,市场是否愿意为"长期主义"买单存在疑问。

国内开源模型的发展态势加剧了这种压力。OpenRouter数据显示,开源模型处理的token占比在半年内从34%跃升至65%。仅6-7月间,就有智谱GLM-5.2、Kimi K3等多个新模型发布,这些产品在代码生成、多模态处理等领域已接近国际顶尖水平。这种快速迭代的环境,对坚持自研路线的企业构成巨大挑战。

字节跳动管理层多次强调技术自主的重要性。CEO梁汝波在全员会上表示,接受短期落后是坚持自研的必要代价,公司将继续优化基础能力。火山引擎总裁谭待以视频模型为例说明,只有达到SOTA水平的模型才能创造商业价值,这需要长期的技术积累而非短期技巧。

REDMI Note 17印度亮相:8000mAh大电池+120Hz屏,续航影像双升级
【CNMO科技消息】8月6日,据外媒报道,REDMI在印度发布了REDMI Note 17,该机搭载8000mAh大容量电池。 REDMINote 17搭载高通骁龙4 Gen 4移动平台,基于4nm工艺制程…

2026-08-07

Meta自曝AI模型测试出意外:合作方失误致其入侵他司 调查正进行
观点网讯:8月5日,美国“元”公司(Meta)表示,该公司一款人工智能模型在网络安全测试期间入侵了另一家公司。此前测试合作伙伴因操作失误导致该模型意外获得互联网访问权限,从而引发此次入侵事件。 Meta称…

2026-08-06

阿里达摩院15项前沿课题开放,面向2027届启动招募计划
阿里巴巴旗下科研机构达摩院近日宣布,面向2027届高校毕业生启动“阿里星”顶尖人才招募计划,同步开放15项前沿研究课题。此次招募聚焦人工智能与芯片技术交叉领域,涵盖AI芯片架构、医疗智能体开发及工业决策系统等关键方向,旨在通过产学研协同创新推动技术突破。

2026-08-06

竹知了舆情风波:互联网时代品牌维权与公众沟通的平衡之道
依法维护自身商誉、抵制恶意诋毁,是企业的合法权益,但过度将公众调侃、良性讨论定义为侵权行为,会压缩网络良性表达空间,也不利于品牌口碑建设。对于众多科创品牌而言,此次舆情事件提供了重要启示:唯有平衡维权边界与公…

2026-08-06

AI广告浪潮下:消费者态度大揭秘,品牌如何抓住机遇破局?
就广告风格来看,小红书上与“AI广告”相关的商业笔记中,点赞量TOP15的AI广告主要为3种风格,产品展示类与传统广告的相似度最高,它们多是产品在不同场景下的多角度展示和细节展示,而创意趣味类和科幻未来类则…

2026-08-06

DeepSeek开源双向流水线与负载均衡技术:为AI训练降本增效注入新动能
但现在回头看,那分明是技术突破在说话,是真把模型训练和推理的成本压下来了,而不是靠补贴硬撑。可当你看见这些开源代码每一行都是干货,每一个逻辑都经得起推敲,你真的会相信:原来有一群人是真的在践行OpenAI本来…

2026-08-06