返回列表
行业新闻AI创新科技

马斯克xAI发布Grok 4.1:幻觉率显著降低,暂无API访问

埃隆·马斯克的AI初创公司xAI近日推出了其最新大型语言模型Grok 4.1。该模型已在Grok.com、社交网络X以及iOS和Android移动应用上线,面向消费者开放。Grok 4.1在架构和可用性方面进行了重大增强,包括更快的推理速度、更高的情商和显著降低的幻觉率。根据公开基准测试,Grok 4.1表现优于Anthropic、OpenAI和谷歌(Gemini 2.5 Pro之前版本)的竞争模型。然而,值得注意的是,Grok 4.1目前尚未通过xAI的公共API提供给企业开发者,限制了其在需要后端集成的企业工作流中的应用。

VentureBeat

埃隆·马斯克的AI初创公司xAI近日发布了其最新大型语言模型Grok 4.1。此举似乎旨在谷歌推出其新的旗舰AI模型Gemini 3(目前已被多个独立评估机构认定为全球最强大的LLM)之前,吸引部分关注。Grok 4.1现已在Grok.com、社交网络X(前身为Twitter)以及xAI的iOS和Android移动应用上线,供消费者使用。该模型带来了重大的架构和可用性增强,其中包括更快的推理速度、改进的情商以及显著降低的幻觉率。xAI还发布了一份关于其评估的白皮书,其中包含少量关于训练过程的信息。在公开基准测试中,Grok 4.1已跃居榜首,超越了Anthropic、OpenAI和谷歌(至少是谷歌的Gemini 3之前版本,即Gemini 2.5 Pro)的竞争模型。它建立在xAI的Grok-4 Fast成功之上,VentureBeat曾在2025年9月Grok-4 Fast发布后不久对其进行了积极报道。然而,对于希望将新改进的Grok 4.1模型集成到生产环境中的企业开发者来说,存在一个主要限制:它尚未通过xAI的公共API提供。尽管其基准测试表现出色,Grok 4.1目前仍仅限于xAI面向消费者的界面,尚未公布API开放的时间表。目前,只有较旧的模型——包括Grok 4 Fast(推理和非推理变体)、Grok 4 0709以及Grok 3、Grok 3 Mini和Grok 2 Vision等旧版模型——可通过xAI开发者API进行编程使用。这些模型支持高达200万个上下文令牌,令牌定价根据配置从每百万0.20美元到3.00美元不等。目前,这限制了Grok 4.1在依赖后端集成、精细化代理管道或可扩展内部工具的企业工作流中的实用性。尽管面向消费者的推出定位了其市场。

相关新闻

行业新闻

Hacker News热议:创新平台“Hired.wtf”颠覆传统招聘,主打“自我雇佣”模式

Hacker News上出现一个名为“Hired.wtf”的新网站,其核心理念是让用户“雇佣自己”而非传统地申请工作。该平台旨在提供一种全新的就业模式,挑战现有的招聘流程。目前,该新闻内容主要围绕用户评论展开,具体功能和运作细节尚待进一步披露。

行业新闻

OpenAI获亚马逊500亿美元投资,并将在AWS上推出“有状态运行时环境”以支持企业级AI代理

OpenAI今日宣布获得科技巨头总计1100亿美元的新一轮融资,其中包括软银300亿美元、英伟达300亿美元以及亚马逊500亿美元。值得注意的是,除了资金支持,OpenAI还将与亚马逊合作,在亚马逊网络服务(AWS)上建立一个全新的“有状态运行时环境”。这一举措预示着AI经济将从聊天机器人转向自主“AI同事”(即AI代理),并表明这种演变需要与GPT-4不同的架构基础。对于企业决策者而言,这不仅是巨额资本的新闻,更是下一代代理智能技术路线图的指引,尤其对现有AWS用户而言,将带来更多选择。

行业新闻

美国战争部指示将Anthropic列为供应链风险企业

根据最新消息,美国战争部已指示将人工智能公司Anthropic指定为供应链风险企业。此举可能对Anthropic的运营及其与政府的合作产生影响,但目前没有更多细节说明此决定的具体原因或潜在后果。原始新闻内容仅包含“Comments”,表明这是一条简短的指令性信息。