跳到正文

全部动态

今日 606 条
9月30日周三
  1. xAI:News(网页)67

    xAI 推出 Grok for Outlook 插件

    xAI 将 Grok 引入 Microsoft Outlook,作为 Microsoft 365 插件在收件箱旁提供智能体能力:总结长邮件串并给出决策、负责人和待办事项,按用户语气起草回复,批量整理积压邮件(归档已完成会话、过滤垃圾邮件、标出需回复的邮件),还能读取附件并搜索网页和 X。

    推荐理由:官方介绍了 Grok Outlook 插件的整理邮件、代拟回复等具体能力与获取方式,读者可据此评估它对邮箱工作流的影响。

  2. xAI:News(网页)64

    xAI 将 Grok 4.5 推向 iOS、Android、网页和 X 平台

    xAI 宣布其最强模型 Grok 4.5 当日起在 grok.com、X 以及 iOS 和 Android 应用上可用。官方称该模型更准确理解提问、能跟踪更长对话并更快给出答案,可完成制作电子表格、把大纲转为幻灯片和图表、撰写文稿、提炼长 PDF 要点等任务,并通过 Microsoft 365 插件在 Word、Excel、PowerPoint 和 Outlook 中直接使用。

    推荐理由:xAI 官方说明 Grok 4.5 的能力改进和全平台可用范围,读者可据此评估在日常问答和知识工作中的使用方式。

  3. xAI:News(网页)56

    Grok 4.5 现已在 GitHub Copilot 中可用

    xAI 宣布 Grok 4.5 上线 GitHub Copilot,覆盖云 Agent、Copilot CLI 和 VSCode IDE,用户可在模型选择器中直接选用,部分企业和商业用户需在 Copilot 设置中启用。该模型也可通过 SpaceXAI console 直接使用,定价为每百万输入 token $2、每百万输出 token $6。

  4. xAI:News(网页)68

    xAI 发布 Grok Voice Think Fast 2.0 语音模型

    xAI 发布 Grok Voice Think Fast 2.0,称其在 Artificial Analysis 语音到语音质量指数达 82.9%,高于上代 75.7% 及对比模型;出声延迟 0.70s,转录准确率较 Deepgram Nova 3 和 ElevenLabs Scribe v2 提升 1.5–2.0×,推理 token 效率为上代 0.4×。

    推荐理由:原文给出 Artificial Analysis 对比数据和价格迁移细节,读者可据此评估它在语音智能体场景的替换成本。

  5. xAI:News(网页)73

    xAI 发布 Grok Bot:可长期自主工作的云端 Agent 队

    xAI 发布 Grok Bot,一组可全天候工作的 AI 智能体,拥有自己的云端计算机,能登录用户已有工具和应用中端到端完成任务,仅在需要审批时回报。产品处于 beta 阶段,面向 SuperGrok 和 Cursor 多档订阅用户开放桌面与 iOS 端,使用量与现有 Grok 和 Cursor 套餐分开计算;企业用户可加入等待名单。

    推荐理由:xAI 官方发布,读者可以据此了解 Grok Bot 的运行方式、订阅范围和与现有 Agent 产品的差异。

  6. xAI:News(网页)54

    Grok 4.6 上线 GitHub Copilot

    xAI 宣布最新编程模型 Grok 4.6 在 GitHub Copilot 上线,覆盖云 agent、Copilot CLI 和 VS Code IDE,用户在模型选择器中选 "Grok 4.6" 即可使用,部分企业和商业用户需在 Copilot 设置中启用。该模型也可通过 SpaceXAI 控制台使用,价格为每百万输入 token $2、每百万输出 token $6。

  7. xAI:News(网页)70

    Grok Build 全量开放:网页与移动端所有套餐可用

    xAI 宣布 Grok Build 在网页、iOS 和 Android 上向所有套餐开放,用户在 Grok 对话中描述应用、游戏、网站或仪表盘即可生成可运行版本。

    推荐理由:原文列出了从 Early Beta 到全量开放的发布与分享、Remix、自定义域名等具体变化,读者可据此判断是否纳入自己的应用搭建流程。

  8. xAI:News(网页)44

    Grok 4.6 上线 Amazon Bedrock

    xAI 的旗舰模型 Grok 4.6 现已在 Amazon Bedrock 正式可用,面向长时间运行的智能体及交互与视觉任务,支持 500k 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度。定价为输入 $2 / 百万 tokens、缓存输入 $0.50 / 百万 tokens、输出 $6 / 百万 tokens,已在支持的 AWS 区域向所有开发者开放。

  9. xAI:News(网页)43

    Grok 4.6 上线 Gemini Enterprise Agent Platform

    xAI 的旗舰模型 Grok 4.6 现已在 Gemini Enterprise Agent Platform 的 Model Garden 中开放给开发者使用。该模型面向长时间运行的智能体及交互与视觉任务,提供 500k 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度。定价为输入 $2、缓存输入 $0.50、输出 $6 每 100 万 tokens。

  10. xAI:News(网页)43

    Grok 4.6 上线 Microsoft Foundry

    xAI 的旗舰模型 Grok 4.6 现已在 Microsoft Foundry 上线,支持 500k 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,面向长时间运行的智能体及交互与视觉任务。Foundry 提供与其他前沿模型的对比评估、工作负载测试、托管端点部署及企业级安全与治理控制,可用于构建编程智能体、工程 Copilot、研究助手和企业自动化。

  11. xAI:News(网页)44

    Grok Bot 与 X 深度集成,可搜索帖子、读取时间线

    Grok Bot 现已与 X 实现更紧密的集成,用户连接 X 账号后即可让 Bot 搜索帖子、读取时间线、查看提及或汇总 X 上的动态。付费 Grok Bot 用户可获得免费的 X API 额度,没有开发者账号的用户会被自动创建。这是该集成的首个版本,同时提供 X 插件用于搜索帖子、读取时间线、获取趋势和管理书签。

  12. Cloudflare Developers54

    Cloudflare Developers 转发官方公告,宣布 Cloudflare Containers 面向 Agent 沙箱的重大升级。容器启动速度提升 6 倍,支持 Agent 在运行时为每个沙箱选择镜像和实例类型,文件系统快照进入公测,全部通过 Durable Object 控制。

    引用Cloudflare@Cloudflare

    Cloudflare Containers now start 6x faster, let your agent choose each sandbox's image and instance type at runtime, and support filesystem snapshots in public beta, all controlled from a Durable Object. https://cfl.re/4hVasac #BirthdayWeek

  13. Arena.ai62

    Arena 宣布 Claude Sonnet 5.5 (High) 可在 Direct Mode 中测试,限时 48 小时,至 10 月 2 日早 8 点(PT)结束,之后将继续在 Battle 和 Agent Mode 提供。引用的 @claudeai 内容称该模型是 Claude 5.5 家族第二款,比 Sonnet 5 快 30% 以上,多数工作成本降低最多 30%。

    引用Claude@claudeai

    Introducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.

  14. Anthropic:Transformer Circuits(可解释性研究)46

    Anthropic 详解可解释性工具 Garçon:面向大模型的基础设施

    Anthropic 公开其可解释性研究基础设施 Garçon,用于在超出单节点规模的大模型上做机制可解释性实验。用户可通过 `python -m garcon.launch` 启动服务器并连接模型,借助 probe points 与 probe 函数在任意层读取、修改或消融内部激活,并支持前向与反向传播。服务器按连接保存数据,空闲 1 小时后自动关闭。

  15. Anthropic:Transformer Circuits(可解释性研究)35

    Anthropic 发布 Transformer 逆向工程非正式讨论视频

    Anthropic 在 Transformer Circuits 项目中录制了若干非正式视频,讨论逆向工程神经网络(尤其是 Transformer)的早期思路,用于与其他机构同事交流。这些视频内容粗糙、可能存在错误,作者提醒观众谨慎对待,并称其已被更完善的论文《A Mathematical Framework for Transformer Circuits》取代。

  16. Anthropic:Transformer Circuits(可解释性研究)39

    Anthropic 可解释性研究:逆向工程 Transformer 的参数级练习

    Anthropic 的 Transformer Circuits 团队发布了一组练习,用于理解神经网络如何在参数层面实现算法,作为其逆向工程 Transformer 数学框架的补充材料。练习要求手动写出注意力头的 W_Q、W_K、W_V、W_out 权重矩阵,涵盖虚拟注意力头、归纳头(指针算术版与前一 token K-Composition 版)等实现,并附有解答。

  17. Anthropic:Transformer Circuits(可解释性研究)39

    Anthropic 可解释性研究:机制可解释性、变量与可解释基的重要性

    Anthropic 的 Transformer Circuits 可解释性研究笔记提出,机制可解释性可类比为对编译后二进制程序的逆向工程,网络参数对应程序二进制、网络架构对应虚拟机、神经元激活对应变量或内存。作者认为,找到并理解可解释神经元——类似理解程序中的变量——可能是机制可解释性的核心任务,而逆向工程常规程序的经验表明,理解参数这一有限描述是绕开维度灾难的关键路径。

  18. Anthropic:Transformer Circuits(可解释性研究)34

    Anthropic 可解释性团队 Circuits Updates:2023 年 7 月研究进展

    Anthropic 可解释性团队发布 2023 年 7 月 Circuits Updates,汇总多项尚在萌芽阶段的研究想法。团队重新审视了 Superposition、Memorization 与 Double Descent 中的中间数据区间,认为此前疑似反例的现象实为低维优化失败造成的假象,并发现模型在约 1k 至 500k 样本间会从记忆单点转向记忆相关数据簇。

  19. Anthropic:Transformer Circuits(可解释性研究)41

    Anthropic 可解释性团队 Circuits Updates(2024 年 1 月):注意力叠加、字典学习与 MNIST 模型稀疏特征

    Anthropic 可解释性团队发布 2024 年 1 月 Circuits Updates,汇总注意力叠加、字典学习等阶段性研究。团队未来数月将聚焦三个方向:字典学习的规模化与科学化、用字典学习攻击真实模型中的注意力叠加、以及在此基础上理解电路。