Kimi K3 favicon

Kimi K3

Kimi K3:全球首款开源3T级大模型,定义前沿智能与长周期工程能力新高度

介绍:

Kimi K3是由月之暗面推出的2.8万亿参数开源大模型,采用创新的KDA与AttnRes架构,具备原生视觉能力与100万字超长上下文。它在编程、内核优化、芯片设计及深度科研等长周期复杂任务中表现卓越,性能直追顶级私有模型,是开发者与科研人员的强大智能助手。

记录:

2026-07-19

每月访客数:

39500.0K

Kimi K3 - AI Tool Screenshot and Interface Preview

Kimi K3 产品信息

Kimi K3:重塑前沿智能的开源 3T 级大模型全面深度解析

在人工智能领域快速更迭的浪潮中,Kimi K3 的发布标志着开源大模型正式进入了 3T(三万亿参数)量级的新纪元。作为一款拥有 2.8 万亿(2.8T)参数的巨型模型,Kimi K3 不仅是目前世界上首个开源的 3T 级模型,更在编程、知识工程及复杂推理等前沿领域展现了卓越的智能水平。本文将深度解析 Kimi K3 的技术特性、应用场景及使用指南,帮助您全面了解这一前沿生产力工具。


什么是 Kimi K3?

Kimi K3 是月之暗面(Moonshot AI)推出的目前最强大的模型。它拥有 2.8T 的参数规模,是基于创新的 Kimi Delta Attention (KDA) 和 Attention Residuals (AttnRes) 架构构建而成。Kimi K3 具备原生多模态视觉能力,并支持高达 100 万 token 的上下文窗口。

作为开源界的新标杆,Kimi K3 在过去一年的模型演进中多次推高了开源模型的大小上限。虽然在整体表现上与 Claude Fable 5 和 GPT 5.6 Sol 等顶级私有模型仍有细微差距,但在各项评估测试中,Kimi K3 展现出了极强的前沿竞争力,尤其在长周期代码开发和深度科研领域,其表现甚至超越了众多主流模型。


Kimi K3 的核心特性

1. 革命性的架构升级:KDA 与 AttnRes

Kimi K3 的强大源于其底层的架构创新。通过 Kimi Delta Attention (KDA) 和 Attention Residuals (AttnRes),模型能够更高效地在长序列和模型深度之间传递信息。相比前代 Kimi K2,这些改进将整体缩放效率(Scaling Efficiency)提升了约 2.5 倍,使得 Kimi K3 能更有效地将算力转化为智能。

2. 超大规模 MoE 稀疏性

Kimi K3 采用了 Stable LatentMoE 架构,从 896 个专家中通过路由机制有效激活 16 个专家。配合分位数平衡(Quantile Balancing)和 Per-Head Muon 优化技术,Kimi K3 在保持巨大参数量的同时,依然能够实现稳定且高效的训练与推理。

3. 原生视觉与超长上下文

Kimi K3 拥有原生多模态能力,能够直接理解文本、图像和视频内容。其 100 万 token 的上下文窗口 配合高效的 KDA 预填充缓存(Prefill Cache),使其在处理大规模文档库或超长代码仓库时具备极高的响应速度和极具竞争力的 token 价格。

4. 硬件兼容与推理优化

为了确保广泛的硬件兼容性,Kimi K3 在 SFT 阶段即应用了量化感知训练,使用 MXFP4 权重和 MXFP8 激活。这使得 Kimi K3 能够在配备 64 个或更多加速器的超级节点配置上实现最优部署。


Kimi K3 的典型应用场景 (Use Case)

长周期编程与代码工程

Kimi K3 在长周期代码任务中表现惊人。它可以自主管理长达数小时的工程 Session,导航大型代码仓库,并熟练调用终端工具。

  • 内核优化: 在 GPU 内核优化测试中,Kimi K3 能够独立剖析、重写并基准测试任务,性能优于 GPT 5.5 和 GPT 5.6 Sol。
  • 编译器开发: Kimi K3 曾从零开始构建了一个名为 MiniTriton 的 GPU 编译器,其性能在特定工作负载下甚至超越了经过长期优化的官方 Triton。
  • 芯片设计: 在一次 48 小时的自主运行中,Kimi K3 利用开源 EDA 工具成功设计并验证了一款芯片,体现了极强的代理(Agentic)能力。

深度科研与知识工程

Kimi K3 极大地缩短了从科学文献到可执行代码的路径。在天体物理学的研究案例中,Kimi K3 仅用 2 小时就完成了研究人员通常需要 1-2 周才能完成的工作,包括查阅 20 多篇论文、编写 3000 行 Python 代码并生成交互式仪表盘。

创意内容生产与视频剪辑

得益于其原生多模态架构,Kimi K3 在运动设计和视频编辑方面极具优势。它可以将复杂的架构理念转化为 3Blue1Brown 风格的动态演示动画,甚至能自主完成视频素材剪辑、节奏同步及音频处理。


如何使用 Kimi K3 (How to Use)

Kimi K3 已经通过多个平台面向公众和开发者开放:

  1. Kimi App/官网: 访问 kimi.com 或通过 iOS、Android、HarmonyOS 应用商店更新至最新版 Kimi App 即可体验 Kimi K3 模型。
  2. Kimi Work (桌面端): 下载版本 3.1.0 或更高版本的 Kimi Work 桌面应用(支持 Windows 和 Apple Silicon Mac),体验全新的 Widgets(组件)和 Dashboard(仪表盘)功能。
  3. Kimi Code (终端): 在终端运行 Kimi Code,并使用 /model 命令选择 Kimi K3 进行编程辅助。
  4. Kimi API: 开发者可访问 Kimi API 平台选择 kimi-k3 接入。其定价为:
    • 缓存命中输入:$0.30/MTok
    • 缓存未命中输入:$3.00/MTok
    • 输出:$15.00/MTok
    • 注:在编程任务中,缓存命中率通常可达 90% 以上。
  5. Kimi Enterprise: 企业用户可以通过订阅企业版获得独立的数据隐私保障和成员管理功能。

常见问题解答 (FAQ)

Q: Kimi K3 的完整模型权重何时发布?
A: Kimi K3 的全量模型权重计划于 2026 年 7 月 27 日 正式发布。届时将同步发布技术报告,详述其架构与训练细节。

Q: 使用 Kimi K3 时需要注意什么?
A: Kimi K3 在“保留思维链历史”模式下训练。如果切换模型或丢失历史思维过程,生成质量可能会变得不稳定。建议使用经过验证的客户端(如 Kimi Code)并避免在中途切换模型。此外,由于 Kimi K3 具有较强的“主观能动性”,在简单任务中可能出现过度预判,建议在 Prompt 中加入明确的行为约束。

Q: Kimi K3 在处理多模态任务时表现如何?
A: Kimi K3 在 PerceptionBench 和 MMMU-Pro 等多模态基准测试中表现卓越。它支持“视觉在环”操作,能够实时观察屏幕截图并根据视觉反馈优化代码产出(如前端开发和 3D 建模)。

Q: 部署 Kimi K3 的推荐配置是什么?
A: 鉴于其 2.8T 的超大规模和 MoE 架构,官方建议在配备 64 个或更多加速器的超级节点(Supernode)上进行部署,以充分利用高带宽通信域的优势。

Loading related products...