马斯克xAI发布Grok 4.1:幻觉率显著降低,暂无API访问
埃隆·马斯克的AI初创公司xAI近日推出了其最新大型语言模型Grok 4.1。该模型已在Grok.com、社交网络X以及iOS和Android移动应用上线,面向消费者开放。Grok 4.1在架构和可用性方面进行了重大增强,包括更快的推理速度、更高的情商和显著降低的幻觉率。根据公开基准测试,Grok 4.1表现优于Anthropic、OpenAI和谷歌(Gemini 2.5 Pro之前版本)的竞争模型。然而,值得注意的是,Grok 4.1目前尚未通过xAI的公共API提供给企业开发者,限制了其在需要后端集成的企业工作流中的应用。
埃隆·马斯克的AI初创公司xAI近日发布了其最新大型语言模型Grok 4.1。此举似乎旨在谷歌推出其新的旗舰AI模型Gemini 3(目前已被多个独立评估机构认定为全球最强大的LLM)之前,吸引部分关注。Grok 4.1现已在Grok.com、社交网络X(前身为Twitter)以及xAI的iOS和Android移动应用上线,供消费者使用。该模型带来了重大的架构和可用性增强,其中包括更快的推理速度、改进的情商以及显著降低的幻觉率。xAI还发布了一份关于其评估的白皮书,其中包含少量关于训练过程的信息。在公开基准测试中,Grok 4.1已跃居榜首,超越了Anthropic、OpenAI和谷歌(至少是谷歌的Gemini 3之前版本,即Gemini 2.5 Pro)的竞争模型。它建立在xAI的Grok-4 Fast成功之上,VentureBeat曾在2025年9月Grok-4 Fast发布后不久对其进行了积极报道。然而,对于希望将新改进的Grok 4.1模型集成到生产环境中的企业开发者来说,存在一个主要限制:它尚未通过xAI的公共API提供。尽管其基准测试表现出色,Grok 4.1目前仍仅限于xAI面向消费者的界面,尚未公布API开放的时间表。目前,只有较旧的模型——包括Grok 4 Fast(推理和非推理变体)、Grok 4 0709以及Grok 3、Grok 3 Mini和Grok 2 Vision等旧版模型——可通过xAI开发者API进行编程使用。这些模型支持高达200万个上下文令牌,令牌定价根据配置从每百万0.20美元到3.00美元不等。目前,这限制了Grok 4.1在依赖后端集成、精细化代理管道或可扩展内部工具的企业工作流中的实用性。尽管面向消费者的推出定位了其市场。