全球最大开源模型问世
作者:李丹,华尔街见闻
7月16日,中国人工智能公司月之暗面正式发布新一代开源基础模型Kimi K3,参数规模高达2.8万亿,成为目前全球参数最大的开源模型。新华社报道称,Kimi K3综合智能水平已接近全球前沿闭源模型,标志着我国AI模型发展迈出关键一步。
核心技术突破:高效处理长序列与深层网络
Kimi K3是月之暗面迄今最强旗舰模型,专为长程智能体编程与自我演进工作流设计。其引入自研的Kimi Delta Attention(KDA)混合线性注意力机制和Attention Residuals(AttnRes)结构,显著提升长序列信息处理能力与深层网络信息传递效率。官方数据显示,KDA技术在百万Token上下文下实现高达6.3倍的解码加速,而AttnRes机制仅增加不到2%的计算成本,却带来约25%的训练效率提升。
支持百万Token上下文与多模态能力
Kimi K3原生支持100万Token上下文窗口,并具备视觉理解能力,主要面向软件工程、知识工作及复杂推理等高难度场景。模型采用更高稀疏度的MoE架构,拥有896个专家模块,每次推理仅激活16个,在扩大模型容量的同时有效控制计算开销。
从“回答问题”到“完成任务”的范式升级
相比上一代模型,Kimi K3更强调任务导向能力。在长周期软件工程任务中,模型可综合代码、运行日志、测试结果及视觉信息进行判断,适用于游戏开发、前端工程、CAD设计和基础设施优化等复杂场景。其智能体编程(Agentic Coding)能力支持理解大型代码库、调用工具、执行测试并根据反馈动态调整方案。
多项评测逼近顶级闭源模型
根据月之暗面公布及社区整理的评测数据,Kimi K3在代码生成、知识工作、长文本检索和Agent任务等多个维度进入全球第一梯队。在GDPval-AA v2知识工作测试中,Kimi K3得分1687,超过Claude Opus 4.8 Max的1600分,仅次于Claude Fable 5 Max和GPT-5.6 Sol Max。在AA-Briefcase智能体测试中得分为1527,排名第二。BrowseComp长上下文测试中取得91.2分,展现出在高难度信息检索中的优势。
“Fable级体感”引发开发者热议
部分提前体验用户表示,Kimi K3在复杂智能体任务、连续编程和多工具调用中展现出接近顶级闭源模型的自主规划与执行能力,被称具有“Fable级体感”。有海外对冲基金经理和内资行团队测评认为,其性能已超过Claude Opus 4.8,接近Fable 5和GPT-5.6 Sol。尽管尚未全面超越Anthropic的Fable系列,但差距已显著缩小。
开源路线挑战美国闭源商业模式
与OpenAI、Anthropic坚持API订阅和闭源策略不同,月之暗面选择开放模型权重,允许全球开发者免费下载、私有部署和二次开发。此举有望快速构建开发者生态,形成对美国头部AI公司的持续竞争压力。此前DeepSeek的R1系列已验证该路径的有效性。
中美AI竞争进入新阶段:生态与成本成关键
随着美国AI模型价格持续上涨(如Claude Opus 4.8计划提价50%),中国开源模型凭借低成本优势吸引海外企业关注。K2.6模型调用成本仅为Opus 4.8的三分之一。越来越多企业开始采用中国模型替代部分美国服务以控制推理支出。风投人士指出,智谱GLM-5.2等中国模型已在多项测试中与美国旗舰模型匹敌甚至领先。
中国AI公司集体转向开源,资本市场重估价值
2024年以来,DeepSeek、智谱、MiniMax及月之暗面等中国AI公司纷纷推出开放权重模型,而美国头部企业仍坚持闭源。金融时报指出,中美AI性能差距正快速收窄,未来竞争焦点将转向谁更能建立全球开发者生态。资本市场亦作出反应:月之暗面估值约315亿美元,DeepSeek约710亿美元,虽远低于Anthropic(9650亿)和OpenAI(8520亿),但增长潜力获高度关注。
