当前国内人工智能大模型领域竞争持续加剧,技术迭代速度显著提升,开源模型不断涌现。
在此趋势下,字节跳动创始人张一鸣在公司全员会议上强调,即便在模型性能上暂时处于追赶阶段,公司亦不会采用AI蒸馏技术作为提升路径。他指出,大模型研发必须坚持长期主义理念,秉持延迟满足的发展观,拒绝通过采集和利用其他模型的输出结果进行蒸馏训练,以换取短期内在评测榜单上的排名优势。
为贯彻这一原则,字节跳动已建立严格的内部管控机制,全面禁止各团队对任何外部开源模型实施蒸馏操作,并通过API行为监测等技术手段,在研发流程关键节点设置拦截措施,切实阻断相关操作的可能性。张一鸣认为,过度依赖蒸馏不仅难以支撑真正意义上的底层技术突破,反而可能削弱自主创新的内生动力。
与此同时,行业其他主要参与者也在产品策略与商业安排上作出调整。有消息显示,头部大模型企业DeepSeek计划对API接口服务价格进行上调,调幅相对较大。用户可据此提前优化资源使用方案。具体执行细则将通过其官方渠道正式发布。
业内人士分析,此次价格调整的预告,与其即将推出的V4-Pro正式版本密切相关。该版本投入商用后,预计将显著提升平台整体算力消耗水平与调用频次,进而对整个大模型算力服务市场的供需格局与成本结构产生相应影响。

评论
更多评论