7月17日凌晨,在2026世界人工智能大会揭幕前夕,大模型创业公司月之暗面正式推出其新一代 模型 Kimi K3。这是该公司声称迄今能力最强的模型,也是全球首个开源的3万亿级别模型。
模型规模与架构细节
根据官方介绍,Kimi K3参数规模达到2.8万亿,基于KDA混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建。
“KDA混合线性注意力机制”是月之暗面自主研发的注意力计算架构,旨在平衡模型处理长文本时的效率与精度。而“注意力残差”技术则通过保留前序计算中的注意力权重,提升模型对复杂任务中长距离依赖关系的捕捉能力。
该模型原生支持视觉理解,并拥有100万token上下文窗口。这一上下文窗口长度意味着Kimi K3能够在单次推理中处理约数十万汉字的文本内容。
应用场景与市场定位
月之暗面表示,Kimi K3面向长程编程、知识工作和推理等前沿智能场景而设计。这一技术路线的选择,反映出当前大模型行业对复杂、多步骤任务的关注度持续提升。
在全球开源模型竞争加剧的背景下,月之暗面选择将这一参数级别较高的模型开源。业内人士指出,此举有助于加速模型在开发者社区中的验证与迭代,但也意味着公司在商业变现上可能面临更漫长的回报周期。

Kimi K3在编程与Agent能力评测中展现前沿水平 综合评分仍落后于最强闭源模型
在涵盖编程与Agent能力的整套评测中,Kimi K3展现出前沿水平的能力,但其整体性能评分仍低于当前最强的闭源模型 Claude Fable 5和GPT-5.6 Sol。
评测聚焦编程与自主任务执行
该评测包含编程任务与Agent能力测试两大板块。Agent能力测评主要用于评估模型在复杂任务链中的自主执行水平,是衡量AI实用性的关键维度。
与顶级闭源模型的差距
Claude Fable 5和 GPT -5.6 Sol被认定为当前最强的闭源模型。Kimi K3在综合评分上落后于它们,表明其在全面性能上仍有提升空间。
“Kimi K3的整体表现仍落后于最强的闭源模型Claude Fable 5和GPT-5.6 Sol,但在整套评测中展现出前沿水平的能力。”这一核心结论体现出该模型在特定领域的技术积累。
尽管Kimi K3尚未超越顶尖闭源模型,但其在编程与Agent等前沿课题评测中已显示出较强的竞争力。


月之暗面Kimi K3模型长程编码能力提升,覆盖游戏开发与芯片设计等工程任务
月之暗面近期披露其Kimi K3模型的训练方向与能力进展。该模型重点优化了长程、高难任务,已具备较强的长程编码能力。公司表示,在极少人工监督的前提下,Kimi K3能够持续完成长时间工程任务,包括理解与处理大型代码库,并协调使用终端工具。
训练重心:提升复杂任务的连续处理能力
Kimi K3的训练聚焦于长程与高难度任务,旨在增强模型在延续性工程场景中的表现。这一优化使其得以在缺乏人工干预的情况下,自主分析代码结构并调用终端工具执行操作,从而完成系列工程目标。
应用展示:从零构建GPU编程系统与芯片设计
月之暗面通过多个实例展示了Kimi K3的应用潜力。其中包括利用该模型制作3D开放世界游戏,以及从零构建一套GPU编程系统。此外,Kimi K3还展现了对芯片设计和视频剪辑等任务的处理能力。
“在极少人工监督的情况下,它可以持续完成长时间工程任务,理解和处理大型代码库,并协调使用终端工具。”——月之暗面
能力流程拆解
从任务执行逻辑看,Kimi K3首先对大型代码库进行分析,掌握整体结构与模块关系;随后自主调度终端工具,进行代码编写、编译及调试等一系列工程步骤。整个流程在极低的人工介入下闭环完成,体现出模型在长程工程场景中的自主执行能力。

Kimi K3发布:融合3D推理与编程能力,可生成可交互数字作品
Kimi K3作为一款数字作品生成系统,其核心能力在于整合3D推理、编程与视觉处理技术,能够将输入的概念、图像或视频素材转化为具备完整交互功能的体验内容。该系统并非简单的格式转换工具,而是通过多层技术融合实现数字内容的再创作。
技术路径: 多模态 输入到交互输出的完整链路
从用户提供的素材来看,Kimi K3的工作流程覆盖从接收到输出的全链条:用户可以直接输入文字描述的概念,也可以上传现有的图像或视频文件。系统会基于这些原始素材,通过内部的3D推理模块解析空间结构,再结合编程能力构建逻辑规则,最终生成一个用户可操作的交互环境。这一过程中,视觉系统负责素材识别与风格适配,而编程环节则赋予作品动态响应能力。
Kimi K3的交互体验生成并非预设模板的套用,而是针对每次输入素材的定制化输出。其生成的数字作品中,用户的操作(如点击、拖拽、触发)会触发预设的反馈机制,形成“输入-响应”的闭环。
能力解析:3D推理与编程的协同机制
根据素材说明,Kimi K3的3D推理能力体现在对空间关系的理解上——当输入一张二维图像时,系统需要重建其中物体的深度、体积与相对位置;而编程能力则用于定义交互逻辑,例如物体移动的路径、碰撞检测的边界或状态切换的触发条件。这两项能力通过视觉模块衔接:视觉处理先识别素材中的关键元素,再交由3D推理构建立体框架,最后由编程逻辑填充交互行为。三者缺一不可,共同构成从静态素材到动态体验的转化基础。
应用方向:概念可视化与内容体验升级
该技术路径意味着,用户可将抽象概念(如“引力场模拟”)直接转化为可交互的三维演示,或把一段视频中的场景拆解为可操作的虚拟空间。业内分析指出,Kimi K3的这类能力主要适用于需要将创意快速转化为原型验证的环节,例如产品设计的概念展示、教育内容的互动教学模块等。其核心价值在于缩短了从想法到实现之间的技术门槛,让非专业编程用户也能生成具有逻辑响应的数字作品。

Kimi K3芯片展现自主设计能力:48小时内独立完成构建、优化与验证
在连续48小时的自主Agent运行中,Kimi K3芯片基于开源EDA工具和Nangate 45nm工艺库,独立完成了芯片的构建、优化与验证。该过程全面展示了K3芯片在设计自动化与工程效率方面的能力。
自主Agent驱动设计
K3芯片的设计由自主Agent全程调度,无需人工介入。Agent在48小时内持续运行,负责协调开源EDA工具链完成各项设计任务,确保流程不间断推进。
开源工具与工艺库
设计基于开源EDA工具和Nangate 45nm工艺库。开源EDA工具提供公开可用的电子设计自动化功能,覆盖逻辑综合、布局布线等环节;45nm工艺库则定义了晶体管的尺寸、性能及功耗参数,为芯片实现提供标准化的物理参考。
全流程自主完成
设计流程覆盖构建、优化与验证三个阶段:构建阶段完成电路逻辑的实现与综合,优化阶段对性能、功耗、面积进行多目标调优,验证阶段确保设计符合预定功能与时序要求。三个环节均由Agent自动执行,体现高度集成化的自主设计能力。
在连续48小时的自主Agent运行中,K3基于开源EDA工具和Nangate 45nm工艺库,独立完成了芯片的构建、优化与验证。
这一成果表明,借助开源工具与自主Agent技术,芯片设计流程的自动化程度得到进一步提升,为业界利用开放生态实现快速设计迭代提供了实践参考。

Kimi K3多智能体并联分析391个引力波事件 产出7张科学可视化图
在最新的知识梳理与行业研究能力展示中,K3系统对391个引力波事件完成了一次深度分析。该分析过程调用了20多个并发子智能体(subagents),最终生成7张科学可视化图与2张表格,并综合了10篇论文的文献内容。
多智能体并行处理与文献综合
通过同时运行20多个subagents,K3在数据解析与推理层面实现了并行计算。每个子智能体负责特定子任务,包括事件特征提取、波形分类与噪声抑制。最终产出的2张表格,分别呈现了391个引力波事件的核心参数分布与文献中提及的模型对比结果。
本次分析共使用了20多个并发subagents,综合了10篇论文的相关内容。
知识梳理的输出形式:可视化与表格
K3系统输出的7张科学可视化图覆盖了波形频率、质量、信噪比等关键指标。这些图表直接基于391个事件的原数据生成,未引入外部历史对比数据。2张表格则对10篇论文中的结论进行了逻辑拆解,包括对不同引力波源类型的分类口径。
-
7张科学可视化图:展示了391个引力波事件的信号特征与分布规律。
-
2张表格:整理并对比了10篇论文中的模型参数与观测数据口径。
价格信息
在定价方面,Kimi K3的输入Token价格设定为每百万3美元,输出Token价格设定为每百万15美元。该价格信息基于公开的官方公告,未涉及额外折扣或历史定价对比。

Kimi K3完整权重将于7月27日前发布 国产大模型密集迭代
国产AI大模型领域近期迎来新一轮更新热潮。Kimi K3的完整模型权重计划于7月27日前发布,其架构、训练及评测细节将随技术报告一同公布。同一时期,MiniMax、美团、 智谱 、腾讯等多家厂商相继推出新版本或开源模型,国产大模型竞争态势持续升温。
多家厂商密集发布新版本
2026世界人工智能大会将于7月17日至20日举行,MiniMax计划携M3、H3等全模态模型及产品亮相。其中,MiniMax M3为首发首秀,新增的多模态能力使其能在智能体工具流中识别图片和视频,并可操作电脑,以拓宽感知边界。
6月30日,美团开源万亿参数大模型LongCat-2.0,总参数达1.6万亿。据称,该模型是业界首个完全依靠国产算力完成训练与推理全流程的万亿参数模型。
智谱GLM 5.3于7月2日迭代上线,补齐原生多模态视觉短板。其超长文档、科研推理、企业Agent能力得到大幅优化。腾讯混元第三代大语言模型Hy3于7月6日正式发布。
中信建投证券表示,当下大模型能力提升与商业化成为两条并行的主线,预计三季度海内外模型厂商将密集发布大版本。
国产替代逻辑清晰 头部厂商优势显现
华创证券分析指出,在确立 Agentic Coding 新共识后,全球头部大模型厂商维持激烈竞争。同时,Claude等海外头部模型的可靠性受到考验,AI模型及应用的国产替代逻辑清晰。
该机构认为,Coding/Working在国内的市场空间同样广阔。其中,大厂具备用户数据与生态入口优势,有望助推模型能力加速提升。华创证券看好头部模型企业MaaS收入提升,以及C端基于微信等大DAU平台的Agent应用生态落地。
-
Kimi K3完整模型权重将于7月27日前发布。
-
MiniMax M3为首发首秀,具备多模态能力。
-
美团开源万亿参数模型LongCat-2.0,总参数1.6万亿。
-
智谱GLM 5.3、腾讯Hy3分别于7月2日、7月6日发布。