#xAI
#xAI
今日 1 条
Artificial Analysis@ArtificialAnlysAI 评分3131
xAI:News(网页)精选AI 评分6464 xAI 发布 grok-voice-think-fast-1.0 旗舰语音模型并开放 API
xAI 发布旗舰语音模型 grok-voice-think-fast-1.0,可通过 API 使用。该模型面向客服、销售等复杂多步骤语音工作流,原生支持 25+ 种语言,在 τ-voice Bench 排行榜上排名第一。后台推理不影响响应延迟。该模型已为 Starlink 提供电话客服与销售:销售转化率 20%,客服自主解决率 70%,单个智能体使用 28 个工具。
推荐理由:官方给出了基准成绩、多语言支持和 Starlink 实际运营数据,可帮助读者评估这款语音模型在真实客服场景的可用性。
xAI:News(网页)精选AI 评分6262 xAI 发布编码模型 grok-build-0.1,API 公测上线
xAI 将编码模型 grok-build-0.1 以公开测试形式上线 xAI API,该模型专为智能体编码任务训练,支持 Web 开发、调试和 MCP,也是驱动 Grok Build 的同一模型。
推荐理由:xAI 官方公告给出了 grok-build-0.1 的定位、速度、定价和适配工具,读者可据此评估是否接入自己的编码工作流。
xAI:News(网页)AI 评分3030 Composer 2.5 上线 Grok Build,可通过 /models 菜单选用
Composer 2.5 已在 Grok Build 中上线,用户输入 /model 后可在菜单中选择该模型。xAI 称其为一款快速、SOTA 的模型,擅长长时间运行任务与遵循复杂指令。
xAI:News(网页)AI 评分4949 xAI 发布 Grok Imagine 1.5 Preview 图生视频模型,上线 xAI API
xAI 最新图生视频模型 grok-imagine-video-1.5-preview 已通过 xAI API 开放预览。该模型可将单张静态图像转为流畅的电影感视频,支持最高 720p 分辨率,用户用自然语言提示词即可控制镜头运动、节奏与声音设计,并能保持原图的细节与光照。模型还支持逐帧生成并串联成更长场景,可用几行 Python 代码调用。
xAI:News(网页)精选AI 评分7878 xAI 发布 Grok 4.5,主打编码、智能体任务与知识工作
xAI 于 7 月 16 日发布 Grok 4.5,定位为其最强模型,面向编码、智能体任务和知识工作,与 Cursor 联合训练。
推荐理由:官方发布页给出了基准分数、定价、token 效率和免费入口等具体数据,读者可据此与其他模型比较并选择使用场景。
xAI:News(网页)精选AI 评分6464 xAI 将 Grok 4.5 推向 iOS、Android、网页和 X 平台
xAI 宣布其最强模型 Grok 4.5 当日起在 grok.com、X 以及 iOS 和 Android 应用上可用。官方称该模型更准确理解提问、能跟踪更长对话并更快给出答案,可完成制作电子表格、把大纲转为幻灯片和图表、撰写文稿、提炼长 PDF 要点等任务,并通过 Microsoft 365 插件在 Word、Excel、PowerPoint 和 Outlook 中直接使用。
推荐理由:xAI 官方说明 Grok 4.5 的能力改进和全平台可用范围,读者可据此评估在日常问答和知识工作中的使用方式。
xAI:News(网页)精选AI 评分6868 xAI 发布 Grok Voice Think Fast 2.0 语音模型
xAI 发布 Grok Voice Think Fast 2.0,称其在 Artificial Analysis 语音到语音质量指数达 82.9%,高于上代 75.7% 及对比模型;出声延迟 0.70s,转录准确率较 Deepgram Nova 3 和 ElevenLabs Scribe v2 提升 1.5–2.0×,推理 token 效率为上代 0.4×。
推荐理由:原文给出 Artificial Analysis 对比数据和价格迁移细节,读者可据此评估它在语音智能体场景的替换成本。
xAI:News(网页)精选AI 评分7878 xAI 发布 Grok 4.6,聚焦长程智能体与视觉交互任务
xAI 发布 Grok 4.6,在 Grok 4.5 基础上重点提升长程智能体和交互视觉类任务能力,在 Artificial Analysis Intelligence Index 上与 GPT-5.6 Sol 持平(61 分)。
推荐理由:官方公告给出了各基准对比数字、API 定价和开放入口,读者可据此评估 Grok 4.6 在智能体编码上的位置。
xAI:News(网页)AI 评分4343 LatchBio 独立评测:Grok 4.6 生物安全监测与对抗性生物任务表现超越所有前沿模型
LatchBio 对 Grok 4.6 的独立评测显示,其在 BioSecBench-Refusal 上拒绝伪装危险任务的表现优于所有受测前沿模型,是唯一在红队拒绝率(59.2%)与常规任务完成率(64.8%)两项指标上均超过 50% 的系统,跨不同 agent harness 平均得分 62.1%。
Cursor Blog精选AI 评分6969 Cursor 与 SpaceXAI 联合发布 Grok 4.6,聚焦长时程智能体任务
Cursor 团队与 SpaceXAI 今日联合发布 Grok 4.6,基于 Grok 4.5 打造,专注于长时间运行的智能体、更复杂的交互与视觉工作。在 Artificial Analysis Intelligence Index 上它与 GPT-5.6 Sol 持平(61 分),训练上进行了更长时间的补充训练、重新生成的 SFT 轨迹和广泛的智能体 RL。
推荐理由:原文给出训练方法、基准分数和定价细节,读者可以据此评估它在智能体编程场景中的定位。
xAI:News(网页)AI 评分5858 xAI 发布 Grok Voice Transcribe 2.0 语音转文本模型
xAI 发布 Grok Voice Transcribe 2.0,官方称其为当前最准确的转录模型之一,准确率是 1.0 的两倍且价格不变,在 Artificial Analysis 排行榜 32 个流式模型中准确率第一。
Cursor Blog精选AI 评分7373 xAI 发布 Grok 4.7,编码与知识工作能力提升且价格不变
xAI 发布 Grok 4.7,定位为面向编码和知识工作的最强模型,价格和速度与 Grok 4.6 相同,输入每百万 token $2、输出 $6。
推荐理由:官方给出了 Grok 4.7 的基准成绩、价格和防护数据,读者可以据此与 Grok 4.6 等模型比较编码和安全表现。
Artificial Analysis 完整文章(网页)精选AI 评分6868 Artificial Analysis 评测 Grok 4.7:智能指数升至 46,编码 Agent 指数超越 GPT-5.6 Sol
Artificial Analysis 评测 Grok 4.7(xhigh),在 Intelligence Index 得 46 分(较 Grok 4.6 +2),使 SpaceXAI 进入前四。
推荐理由:独立评测给出了 Grok 4.7 在智能指数与编码 Agent 指数的具体得分、排名变化和 token 用量,可用于对比选型。
Elon Musk@elonmuskAI 评分2626引用X Freeze@XFreezeGrok 4.7 xHigh ranks #1 in Artificial Analysis Cyber Index It's a powerful frontier model performing at the highest level in enterprise cyber defense Outperforming Fable 5.1 Max, Opus 5.5, Astra 6, GPT-6 and other leading AI systems
Latent Space(RSS)AI 评分7575 AINews:Opus 5.5 擅长生成讲解视频
Latent Space 的 AINews 汇总 9/24-9/25 动态,指出本周发布的 Claude Opus 5.5 在讲解视频生成上表现突出,并以 88.4% 领跑 SimpleBench,在 Terminal-Bench-Science 上从低推理强度的 24% 升至 xhigh 的 62%。
Artificial Analysis@ArtificialAnlysAI 评分4747
eric zakariasson@ericzakariassonAI 评分7575
Michael Truell@mntruellAI 评分4040引用SpaceXAI@SpaceXAIGrok 4.7 is here. It's a notable improvement over Grok 4.6 at the same price and speed.
SpaceXAI@SpaceXAIAI 评分4444
Karina@karinanguyenAI 评分3737Grok 4.6 在 DiligenceBench 金融测试中以约 52–53% 位列第 2,与 Claude Opus 5 基本持平,Sonnet 5 以 46.2% 落后。
Michael Truell@mntruell精选AI 评分6161引用SpaceXAI@SpaceXAIIntroducing Grok 4.6. It delivers frontier intelligence and is a significant improvement over Grok 4.5 at the same price.
推荐理由:转发并补充了 Grok 4.6 在难度任务和知识工作上更强、兼顾低成本低速度的定位,可作了解该版本能力方向的参考。