返回列表
行业新闻AI创新科技

马斯克xAI发布Grok 4.1:幻觉率显著降低,暂无API访问

埃隆·马斯克的AI初创公司xAI近日推出了其最新大型语言模型Grok 4.1。该模型已在Grok.com、社交网络X以及iOS和Android移动应用上线,面向消费者开放。Grok 4.1在架构和可用性方面进行了重大增强,包括更快的推理速度、更高的情商和显著降低的幻觉率。根据公开基准测试,Grok 4.1表现优于Anthropic、OpenAI和谷歌(Gemini 2.5 Pro之前版本)的竞争模型。然而,值得注意的是,Grok 4.1目前尚未通过xAI的公共API提供给企业开发者,限制了其在需要后端集成的企业工作流中的应用。

VentureBeat

埃隆·马斯克的AI初创公司xAI近日发布了其最新大型语言模型Grok 4.1。此举似乎旨在谷歌推出其新的旗舰AI模型Gemini 3(目前已被多个独立评估机构认定为全球最强大的LLM)之前,吸引部分关注。Grok 4.1现已在Grok.com、社交网络X(前身为Twitter)以及xAI的iOS和Android移动应用上线,供消费者使用。该模型带来了重大的架构和可用性增强,其中包括更快的推理速度、改进的情商以及显著降低的幻觉率。xAI还发布了一份关于其评估的白皮书,其中包含少量关于训练过程的信息。在公开基准测试中,Grok 4.1已跃居榜首,超越了Anthropic、OpenAI和谷歌(至少是谷歌的Gemini 3之前版本,即Gemini 2.5 Pro)的竞争模型。它建立在xAI的Grok-4 Fast成功之上,VentureBeat曾在2025年9月Grok-4 Fast发布后不久对其进行了积极报道。然而,对于希望将新改进的Grok 4.1模型集成到生产环境中的企业开发者来说,存在一个主要限制:它尚未通过xAI的公共API提供。尽管其基准测试表现出色,Grok 4.1目前仍仅限于xAI面向消费者的界面,尚未公布API开放的时间表。目前,只有较旧的模型——包括Grok 4 Fast(推理和非推理变体)、Grok 4 0709以及Grok 3、Grok 3 Mini和Grok 2 Vision等旧版模型——可通过xAI开发者API进行编程使用。这些模型支持高达200万个上下文令牌,令牌定价根据配置从每百万0.20美元到3.00美元不等。目前,这限制了Grok 4.1在依赖后端集成、精细化代理管道或可扩展内部工具的企业工作流中的实用性。尽管面向消费者的推出定位了其市场。

相关新闻

行业新闻

警惕“重新发明轮子”:从加密原则看现代网页设计的误区

本文基于Susam Pal的深度评论,探讨了软件开发中“不要自研加密算法(Don't roll your own crypto)”这一经典原则,并将其延伸至现代网页设计领域。作者指出,正如开发者应使用经过验证的加密库而非自创方案一样,网页设计也应遵循浏览器原生标准。文章批评了开发者在网页设计中过度自定义原生功能的倾向,强调了使用成熟、经过社区审查的工具对于保障用户体验和系统安全的重要性。

AI技术通过频谱图还原遇难飞行员声音,NTSB紧急封锁案卷系统
行业新闻

AI技术通过频谱图还原遇难飞行员声音,NTSB紧急封锁案卷系统

近日,有人员利用AI技术处理驾驶舱通话记录的频谱图图像,成功还原了已故飞行员的声音。这一行为引发了严重的安全与隐私担忧,迫使美国国家运输安全委员会(NTSB)暂时封锁了其案卷系统(docket system)的公开访问权限,以防止敏感数据被进一步滥用。

跨越国界的教育支持:向乌干达难民营运送笔记本电脑的挑战与希望
行业新闻

跨越国界的教育支持:向乌干达难民营运送笔记本电脑的挑战与希望

本文讲述了居住在乌干达西部难民营的刚果难民Django,在极端艰苦条件下坚持攻读伦敦大学远程计算机科学学位的励志故事。面对电力匮乏、网络受限以及唯一的笔记本电脑主板烧毁的困境,Django的遭遇引发了对远程教育普惠性及资源匮乏地区技术支持的深思。文章详细分析了数字鸿沟对弱势群体受教育权的实际影响。