返回列表
Thinking Machines发布Inkling开源权重模型:975B参数与百万级上下文支持
开源项目大语言模型开源AI多模态

Thinking Machines发布Inkling开源权重模型:975B参数与百万级上下文支持

Thinking Machines正式发布其首款开源权重模型Inkling。该模型采用混合专家(MoE)架构,拥有975B总参数(41B激活参数),支持高达100万token的上下文窗口。Inkling在45万亿token的多模态数据上完成预训练,具备原生处理文本、图像和音频的能力。同步推出的还有轻量化版本Inkling-Small。该模型旨在通过Tinker平台提供高度的可定制性,助力开发者构建个性化AI应用。

Hacker News

核心要点

  • 超大规模架构:Inkling是一个拥有975B总参数、41B激活参数的混合专家(MoE)模型。
  • 长文本支持:支持最高100万token的上下文窗口,能够处理超长文档与复杂任务。
  • 原生多模态:在45万亿token的多模态数据(文本、图像、音频、视频)上预训练,具备跨模态推理能力。
  • 开源与定制:提供完整权重下载,并集成于Tinker平台,支持开发者进行微调与个性化定制。
  • 系列化布局:同步推出轻量版Inkling-Small(12B激活参数),在降低成本与延迟的同时保持强劲性能。

详细分析

混合专家架构与高效推理性能

Inkling采用了先进的混合专家(Mixture-of-Experts, MoE)转换器架构。尽管其总参数量达到了惊人的975B,但在实际推理过程中仅有41B参数处于激活状态。这种设计使得模型在保持大规模知识容量的同时,能够显著降低计算成本和响应延迟。此外,Inkling支持高达100万token的上下文窗口,这使其在处理长篇法律文件、复杂代码库或多模态长视频分析时具有显著的竞争优势,能够理解并关联极长跨度内的信息。

45万亿Token驱动的原生多模态能力

该模型在包含文本、图像、音频和视频的45万亿token海量数据集上进行了从头预训练。与传统的插件式多模态模型不同,Inkling具备原生的跨模态推理能力,能够平衡成本与性能,并通过“高效且可控的思考努力”来优化任务处理。Thinking Machines强调,Inkling被设计为一个广泛且平衡的基础模型,旨在成为一个灵活的定制底座,而非单纯追求在所有基准测试中超越现有的闭源模型。

赋能开发者:Tinker平台与定制化生态

Thinking Machines的使命是构建扩展人类意志与判断力的AI。为此,Inkling不仅开源了模型权重,还深度集成了Tinker平台。开发者可以通过新推出的Inkling Playground进行交互式测试,并利用Tinker的微调功能根据特定需求定制模型。这种“开源权重+定制工具”的组合,降低了企业和个人开发者构建私有化、专业化AI系统的门槛,让AI的“思考方式”能够更贴合具体的使用场景。

行业影响

Inkling的发布标志着开源AI模型进入了近万亿参数的新阶段。通过提供超长上下文和原生多模态支持,它为开源社区提供了足以挑战顶级闭源模型的工具。其强调“可定制性”而非单纯的“榜单排名”,反映了行业从通用大模型向垂直化、个性化应用转型的趋势。此外,MoE架构的进一步大规模实践将推动高效能AI计算的普及,为开发者在性能与成本之间提供了更优的平衡点。

常见问题

问题:Inkling模型的参数规模是多少?

Inkling总计拥有975B参数,采用MoE架构,实际运行时的激活参数为41B。此外还有Inkling-Small版本,其激活参数为12B。

问题:Inkling支持哪些模态的数据处理?

Inkling在预训练阶段使用了文本、图像、音频和视频数据,能够原生推理文本、图像和音频信息,具备多模态处理能力。

问题:如何对Inkling进行微调和测试?

用户可以通过Thinking Machines提供的Tinker平台对Inkling进行微调。同时,官方在Tinker控制台中提供了Inkling Playground,方便开发者进行交互式对话测试。

相关新闻

Mistral推出Shieldstral:3B参数开源多模态安全模型,支持自定义审核策略
开源项目

Mistral推出Shieldstral:3B参数开源多模态安全模型,支持自定义审核策略

Mistral AI正式发布Shieldstral,这是一款拥有3B参数的开源多模态安全分类器。该模型采用Apache 2.0协议,通过将内容审核转化为策略自适应的问答任务,允许用户在推理时使用自然语言定义安全规则。Shieldstral在性能上可媲美体量大7倍的模型,且能高效运行于单块16GB NVIDIA GPU,为文本和图像安全评估提供了统一且灵活的解决方案。

Orchard:微软研究院发布可扩展智能体AI开源框架
开源项目

Orchard:微软研究院发布可扩展智能体AI开源框架

微软研究院(Microsoft Research)正式发布了名为 Orchard 的开源框架,旨在解决可扩展智能体 AI(Agentic AI)的构建与部署挑战。该框架由 Baolin Peng、Wenlin Yao、Qianhui Wu、Hao Cheng 和 Jianfeng Gao 等研究员共同开发。Orchard 的核心目标是提供一个开放且具备高度扩展性的架构,支持开发者更高效地创建和管理复杂的 AI 智能体系统,推动 AI 从单一任务模型向具备自主协作能力的智能体集群演进。

NixOS-DGX-Spark:在 NVIDIA DGX Spark 上实现 Nix 与 NixOS 的深度集成
开源项目

NixOS-DGX-Spark:在 NVIDIA DGX Spark 上实现 Nix 与 NixOS 的深度集成

开发者 graham33 正式发布了 NixOS-DGX-Spark 项目,旨在为 NVIDIA DGX Spark 系统提供完整的 Nix 和 NixOS 支持。该项目允许用户在原厂 DGX OS (Ubuntu) 上通过 Nix 运行开发环境,或直接安装完整的 NixOS 系统。通过提供专用的内核支持和 USB 启动镜像,该项目解决了高性能计算设备在声明式配置和硬件驱动适配方面的难题,为 AI 基础设施管理提供了新方案。