top of page

Grok 4.1 最新消息:更智能、更快速、更可靠

已更新:6月17日

Latest News on Grok 4.1: Smarter, Faster, More Reliable

你现在可以尝试 Grok 4.1 了。它于 2025年11月18日 正式发布。此版本已在全球范围内推出,无论你身在何处都可以使用。通过 Grok 4.1,你将获得更智能的对话、更快速的回复以及更准确的答案。你会在情商、创意写作和事实准确性方面看到显著提升。

以下是 Grok 4.1 优于上一版本的地方:

指标

Grok 4.1

Grok 4

情商评分

1,586

1,206

幻觉率

4.22%

12.09%

事实准确性错误率

<3%

9.89%

创意写作 Elo 评分

1,708.6

不适用

用户偏好率

65%

N/A

核心要点

  • Grok 4.1 在理解情感方面表现更好。它让对话感觉更亲切、更有帮助。

  • 新版本响应速度更快,事实准确率更高。它在回答中的错误更少。

  • Grok 4.1 非常擅长创意写作。它能为用户提供更智能、更有趣的内容。

  • 你可以在任何地方使用 Grok 4.1 在全球范围内。它没有任何限制,因此每个人都可以立即使用其功能。

  • 尝试将 Grok 4.1 用于编程、研究和创意工作等任务。你会看到它更出色的能力。

Grok 4.1 Launched: What’s New

Grok 4.1 发布:新功能概览

情商升级

Grok 4.1 现在展现出更好的情商。它比以前更深刻地理解情感。当你聊天时,它会察觉你的情绪并改变说话方式。这让对话感觉更加友好且有帮助。

Grok 4.1 能够很好地处理复杂情感。根据 EQ-Bench3 的测试,它是情感理解能力最强的模型之一。该测试检查 AI 在不同情境下模拟情感的表现。

以下是情商对比表:

指标

描述

结果

EQ-Bench3

检查模型在角色扮演中对情感的理解能力。

1586 Elo (思维模式)



1585 Elo (标准模式)

Gemini 2.5 Pro

另一个模型的评分

1460

GPT-5 Chat

另一个模型的评分

1364

Claude Opus 4

另一个模型的评分

1304

旧版本的评分

1206 Elo

在与其交流时,你可以感受到这种变化。Grok 4.1 提供的回答比 Grok 4.0 更具关怀感和觉察力。与之交谈感觉更轻松、更有趣。

创意写作方面的改进

Grok 4.1 现在更擅长创意写作了。它能提供更聪明、更有情感且更具创意的回答。该模型表现得幽默且有趣,尤其是在你需要笑话或深刻见解时。它还擅长网页搜索和快速思考,能帮助你创作出酷炫的内容。

以下是一些创意写作升级

增强类型

描述

更智能的回答

提供更具创意和智能的回答。

情感与协作能力

Grok 4.1 在与你协作以及在写作中表达情感方面表现更出色。

评估方法

这些变化通过真实用户的问题和 FActScore 测试进行验证。

  • Grok 4.1 非常擅长创作有趣或机智的内容

  • 它在处理笑话和创意时反应非常迅速。

  • 对于严肃写作,它可能并不总是像 Claude Opus 4.1 或 Gemini 2.5 Pro 那样强,但它仍然非常有创意,且能与你很好地协作。

事实准确性与可靠性

你可以信赖 Grok 4.1 提供的事实。新版本给出错误答案的频率比 Grok 4.0 低得多。当你提问时,你会得到更准确的事实和更少的错误。这意味着你可以将 Grok 4.1 用于学习、工作或研究。

以下是 Grok 4.1 的核心新特性:

功能

描述

性能排名

即时响应模式

立即给出答案,且思考能力优于其他模型。

远超 Grok 4。

创意写作

在 Creative Writing v3 测试中获得高分。

极具创意的 AI。

情感智能

在 EQ-Bench3 上表现非常出色,是理解情感能力最强的模型之一。

更擅长与人交流。

即时响应模式能更快地为您提供答案并进行详尽解释。这使得 Grok 4.1 在其他 AI 中脱颖而出。

Grok 4.1 现已全面推出,所有人都可以使用这些新功能。此次更新使 Grok 4.1 变得更智能、更快速,在满足日常需求方面更值得信赖。这有助于 Grok 4.1 在 AI 技术领域保持领先地位。

Grok 4.1 Performance

Grok 4.1 性能

速度与效率

Grok 4.1 现在回答问题的速度快得多。新更新使其运行更迅速、更高效。当您提问时,几乎可以立即得到答复。它还减少了错误,因此您不必频繁核实事实。

下表展示了 Grok 4.1 与上一版本的对比情况:

指标

Grok 4.0

Grok 4.1

提升

幻觉率

不适用

不适用

Arena 专家排行榜

1437

1510

提升 40+ 分

你可以看到 Grok 4.1 的错误更少。它在 Arena Expert Leaderboard 上也获得了更高的评分。这意味着你得到的答案更加准确、可靠。

更强大的推理能力

Grok 4.1 更擅长思考难题。你可以提出棘手的问题并获得更睿智的回答。它在解决数学、编程和逻辑问题方面更具技巧。即使面对复杂的问题,它的错误也更少。

下表展示了 Grok 4.1 在重大测试中的表现:

基准测试

Grok 4.1 评分

此前最高评分

AIME 2025

95% (reasoning)

88% (Gemini 2.5 Pro)

Humanity’s Last Exam (HLE)

45% (reasoning)

21% (previous best)

GPQA Diamond

88% (reasoning)

与领先模型具有竞争力

你现在可以在数学和逻辑方面获得更好的结果。例如,Grok 4.1 在 AIME 2025 测试中获得了 95%。这比任何其他模型都要高。此次更新有助于解决难题,但有时它仍然会犯小错误. 例如,它可能会混淆砖块和羽毛的重量。尽管存在这些罕见的错误,你仍会发现新的推理技能非常有用。

基准测试结果

你可以信任 Grok 4.1,因为它在多项测试中表现出色。在最近的双盲测试中,Grok 4.1 并列第一。它在数学、编程、创意写作和遵循指令方面并列第二。它的综合排名也位居第三,与 ChatGPT 和 Gemini 2.5 Pro 等顶级模型并驾齐驱。

类别

Grok 4.1 排名

其他模型排名

数学

并列第一

不适用

编程

并列第二

不适用

创意写作

并列第二

不适用

指令遵循

并列第二

不适用

困难提示词

并列第三

不适用

长查询

并列第二

不适用

多轮对话

并列第四

不适用

总排名

并列第三

与 ChatGPT 模型并列第二,Gemini 2.5 Pro 位居榜首

你还会看到 Grok 4.1 处于 Text Arena 排行榜的顶端。它在思考模式下的得分为 1510 分。在国际信息学奥林匹克竞赛 (IOI) 中,Grok 4 在 2024 年和 2025 年均获得第一名。这些结果表明 Grok 4.1 目前在 AI 性能方面处于领先地位。

提示:为了获得最佳效果,请在数学、编程和创意写作中使用 Grok 4.1。你将立即感受到差异。

用户体验与访问

全球推广

你现在可以在世界任何地方访问 Grok 4.1。没有地区限制。无论你使用 grok.com、X 或移动应用,您都能获得相同的功能和性能。这次全球发布意味着您加入了一个不断壮大的用户社区,所有人都能同时受益于最新的更新。

注意:您无需等待本地发布。每个人都在第一天即可获得访问权限。

入门指南

只需几个步骤即可开始使用 Grok 4.1。对于大多数用户来说,过程非常简单,但某些功能可能需要订阅或技术技能。

  1. 访问 Grok 并登录您的 Super Grok 账户。

  2. 在聊天框中,打开模型下拉菜单并选择 'Grok 4'。

  3. 立即开启您的 AI 聊天机器人体验。

对于开发者,您可以通过登录 x.ai/api 使用 API,创建 API 密钥并遵循文档说明。某些高级功能可能需要付费计划或技术知识。

提示:在提示词中保持具体和清晰。为您的提问提供上下文以获得更好的回答。尝试使用 Grok 4.1 处理 UX/UI 评审、将博客文章转化为课程或将研究成果翻译成通俗易懂的语言等任务。

用户反馈

您可以看到 Grok 4.1 拥有极高的采用率。发布后,每日下载量从 52,000 次跃升至 197,000 次。每日总收入也增长了 300% 以上。用户称赞全新的 DeepSearch 功能可提供实时网络结果以及更智能的内容创作工具。许多人喜欢使用 Grok 4.1 进行投资研究 以及数据感知响应。

指标

Grok 4 发布前

Grok 4 发布后

变化 (%)

每日下载量

52,000

197,000

279

每日收入

$99,000

$419,000

325

您可以通过探索支持 20 多种编程语言以及更智能、更快速的响应等功能来最大化您的体验。早期反馈显示,用户在使用 Grok 4.1 进行创意和专业任务时感到更有信心。

您将从 2025 年的 Grok 4.1 中获益匪浅。它在数学和视觉任务中得分很高。语音聊天非常适合研究和分析。

  • Grok 4.1 在 AIME 2025 中获得 100% 分数,超越 GPT-5

  • 您可以使用实时交互

  • 它适合实时分析

专家表示 Grok 4.1有助于编码 并且运行良好。它的两种价格选项和低能耗 对公司和个人都有好处。但有时响应较慢,界面存在一些问题:

批评类型

描述

安全透明度

未清晰展示安全细节

响应时间较慢

界面可靠性

有时会出现技术问题

您很快就会看到更多新功能和更新。立即尝试 Grok 4.1 并提供反馈,帮助改进它。

FAQ

是什么让 Grok 4.1 与早期版本不同?

您将获得更智能、更快速的回答。Grok 4.1 比之前更可靠。它具有更出色的思维和创意写作能力。您还能在对话中体验到更强的情感智能。

如何访问 Grok 4.1?

您可以登录 grok.com 或 X,也可以使用移动应用。在聊天框中选择 Grok 4 即可。开发者可以使用 x.ai/api 的 API。

Grok 4.1 能帮助完成专业任务吗?

是的,您可以使用 Grok 4.1 进行编码和研究。它有助于内容创作和数据检查。许多人将其用于投资研究和技术审查。

Grok 4.1 如何确保答案准确?

您将获得更可靠的事实。Grok 4.1 使用实时运行的反馈系统。该系统会检查答案并减少错误,确保您获得可信的信息。

如果发现错误,您应该怎么做?

您可以在聊天中报告错误。您的反馈有助于改进 Grok 4.1,并对未来的更新有所帮助。

 
 

免费开始

一款本地优先的AI助手,具备个人知识管理功能

为了获得更好的人工智能体验,

remio 目前仅支持Windows 10+ (x64)M-Chip Mac

在你的大脑里添加一个搜索栏

Ask remio

记住一切

​无需整理

bottom of page