我们刚刚提高了 Cursor 中 Grok 模型的包含用量! 随着 Grok 4.6 的发布,需求一直在增长。上个月我们已经通过增加算力将限额翻倍。现在我们将再次永久上调限额。 尽情享用!
#xAI
#xAI
今日 18 条
Lee Robinson@leerobAI 评分4444
SpaceXAI@SpaceXAIAI 评分3737
Michael Truell@mntruellAI 评分2828本周末我们将向一小部分企业开放 Grok Bot 访问权限。 如果你想让我们明天或周一去你旧金山的办公室为你的团队做上手培训,请回复。
Karina@karinanguyenAI 评分3737Grok 4.6 在 DiligenceBench 金融测试中以约 52–53% 位列第 2,与 Claude Opus 5 基本持平,Sonnet 5 以 46.2% 落后。
Pragmatic Engineer(RSS)AI 评分3333 Meta 自食其果的“离职潮”
Meta 的裁员与强制调岗引发未被波及的工程师也开始求职,形成“离职潮”,公司如今以大额股权留人却收效甚微。Cursor 团队发布通用 AI harness Grok Bot,被形容为“面向知识工作的 Codex 体验”,作者用它自动化了大量日常工作流。
Michael Truell@mntruell精选AI 评分7979引用Cursor@cursor_aiCursor is now part of @SpaceX. Today, we have officially closed our acquisition. We will join the @SpaceXAI team to help make Grok the world's most useful AI and improve Grok Build, Grok Bot, Grok API, Cursor, and more. SpaceX has built some of the most inspiring and impressive technology in the world, and we’re grateful for the opportunity to become part of such a special company. Onwards.
推荐理由:Cursor CEO 亲自宣布收购交割完成,是当事人的一手信息,可用作该交易状态的直接依据。
Michael Truell@mntruell精选AI 评分6161引用SpaceXAI@SpaceXAIIntroducing Grok 4.6. It delivers frontier intelligence and is a significant improvement over Grok 4.5 at the same price.
推荐理由:转发并补充了 Grok 4.6 在难度任务和知识工作上更强、兼顾低成本低速度的定位,可作了解该版本能力方向的参考。
Michael Truell@mntruellAI 评分4848Grok Bot 现已上线!迈向能干又讨喜的数字同事的早期一步。
引用Grok Bot@botIntroducing Grok Bot, now in early beta. Bots are AI teammates that do real work for you. They sign in to your tools, use them just like you do, and come back with finished work.
browser-use:GitHub 新仓库AI 评分2222 browser-use 推出官方 xAI 插件市场 plugin-marketplace
browser-use 上线官方插件市场 plugin-marketplace,首个上架的是 xAI 官方插件。该仓库定位为浏览器智能体的插件分发入口,目前仅披露 xAI 这一官方插件来源,具体插件数量与功能未公布。
Import AIAI 评分6666 Import AI 462:AI说服力超越人类专家、自我维持AI时间线与DeepMind探讨通向ASI的路径
Import AI 第462期报道多项研究:牛津、UK AISI、斯坦福与LSE的实验(4项研究、18,978段对话、6,923人)显示AI文本说服力稳定超越专家人类,Opus 4.1和Opus 4.6最强,AI为Save the Children募集真实捐款的效果约为专业募捐员的3倍;限制AI写作速度和长度可抹平差距。
Sierra:Blog(RSS)精选AI 评分6767 Sierra 发布 𝜏-voice 基准:在真实音频条件下评测实时语音智能体
Sierra 联合普林斯顿发布 𝜏-voice 基准,将 𝜏-bench 的 278 个客服任务与全双工语音、环境噪声、电话压缩等真实音频条件结合,统一评测任务完成与对话动态。
推荐理由:Sierra 把任务完成与真实音频对话合并进同一评测,语音智能体八个月内从 30% 提升到 67%,可与文本基准直接对比。
Sierra:Blog(RSS)AI 评分6262 Sierra 发布 𝜏³-Bench,将智能体评测扩展到知识库与实时语音
Sierra 发布 𝜏³-Bench,在 𝜏-Bench 基础上新增 𝜏-Knowledge 和 𝜏-Voice 两个评测域,并合并社区对原有领域的修正。
Johann Rehberger / Embrace The Red(RSS)AI 评分5959 Embrace The Red 演示 Agent Skills 中的隐形 Unicode 指令后门及检测方法
安全研究员 Johann Rehberger 演示了如何用不可见的 Unicode Tag 码点在 Agent Skill 的 SKILL.md 中植入人类审查看不见的提示词注入后门,并在 OpenAI 官方安全最佳实践 Skill 中加入隐藏指令,Claude Code 执行后打印了 Trust No AI 并运行了 curl 管道 bash 命令。