跳到正文
10月1日 · 周四

最新精选

今天10月1日周四
  1. Aravind Srinivas69

    Perplexity CEO Aravind Srinivas 宣布向所有人开放 Computer 的邮箱任务功能,无需 Perplexity 账号,限时免费执行所有通过邮箱委派的任务。用户将邮件发送、转发或抄送到 computer@perplexity.com,智能体会在后台完成任务并保留邮件上下文;每个任务以正常会话形式运行,可在网页和移动端查看,审计记录与应用内任务一致。

    引用Perplexity@perplexity_ai

    Computer now works in email. Send, forward, or cc computer@perplexity.com on any thread. Every email task runs as a normal session in Computer, viewable on web and mobile, with the same audit trail as any task in the app.

    推荐理由:Perplexity 开放无需账号的邮箱入口并限时免费,读者可以据此评估把任务转给 Computer 智能体执行的可行性。

  2. Google Blog:AI(RSS)66

    Gemini 全球上线 skills 功能,将逐步取代 Gems

    Google 将 skills 功能直接推向 Gemini 聊天的全球用户,并将在未来几周内面向 Google Workspace 商业、企业、非营利和教育客户开放。

    推荐理由:官方公告说明了 skills 的使用方式、可用范围和 Gems 退出时间表,用户可据此安排迁移。

9月30日周三
  1. xAI:News(网页)62

    xAI 发布 Grok Imagine API,主打高质量低延迟视频生成与编辑

    xAI 发布 Grok Imagine API,一套覆盖视频生成与视频编辑的统一 API 套件,称其为迄今最强的音视频生成模型。

    推荐理由:官方宣布 Grok Imagine API 上线,附 Artificial Analysis 文生视频排名第一及延迟对比,可据此评估其在视频生成工作流中的位置。

  2. xAI:News(网页)62

    xAI 推出 Custom Voices,可克隆声音用于 Grok TTS 和 Voice Agent API

    xAI 推出 Custom Voices,录制约一分钟自然语音即可在两分钟内克隆声音,并可在 Grok Text to Speech 和 Voice Agent API 中使用。自定义声音继承全部 TTS 能力(speech tags、多语言输出、REST 与 WebSocket 流式),不额外收费。声音需通过口令朗读和说话人嵌入比对的两阶段验证,无法从已有录音克隆,也无法克隆他人声音。

    推荐理由:xAI 官方说明克隆流程、验证机制和 API 覆盖范围,读者可据此评估在语音应用中的可用性。

  3. xAI:News(网页)70

    Grok 推出 Connectors 深度集成,并支持自定义 MCP 服务器

    xAI 发布 Connectors,把常用应用深度接入 Grok,现已在 Grok Web、iOS 和 Android 上线。

    推荐理由:官方公告列出了各连接器的具体读写能力和入口路径,读者可据此评估哪些工具接入 Grok 后能省去复制粘贴。

  4. xAI:News(网页)68

    xAI 为 Grok 推出 Skills 功能

    xAI 推出 Skills 功能,教 Grok 一次即可在所有对话中记住偏好和工作流,内置 Word、演示文稿、表格、PDF 和 Skill Creator 等技能,无需设置。用户可通过对话或上传文件自定义技能,自己的版本优先于内置版本。Skills 已在 Grok 4.3 上的 grok.com、iOS 和 Android 上线。

    推荐理由:官方公告写明了 Skills 的内置能力、自定义方式和可用平台,读者可据此判断是否纳入自己的工作流。

  5. xAI:News(网页)70

    Grok Build 全量开放:网页与移动端所有套餐可用

    xAI 宣布 Grok Build 在网页、iOS 和 Android 上向所有套餐开放,用户在 Grok 对话中描述应用、游戏、网站或仪表盘即可生成可运行版本。

    最新进展9月30日 23:42xAI推出Grok Build编程代理早期测试版

    推荐理由:原文列出了从 Early Beta 到全量开放的发布与分享、Remix、自定义域名等具体变化,读者可据此判断是否纳入自己的应用搭建流程。

  6. xAI:News(网页)68

    xAI 为 Imagine Video 1.5 增加图像与语音参考,支持文本生成视频和原生 1080p

    xAI 为 Imagine Video 1.5 增加图像与语音参考、纯提示词生成视频和原生 1080p 输出。

    最新进展9月30日 23:42xAI发布Grok Imagine Video 1.5模型及功能

    推荐理由:原文列出图像与语音参考、文本生成视频和原生 1080p 的可用范围与 API 情况,读者可据此判断能否接入现有工作流。

  7. xAI:News(网页)60

    Grok 推出 Automations 定时与邮件触发自动化功能

    xAI 推出 Automations,用户用一段聊天式描述创建任务,Grok 可按计划(一次性、每天、工作日、每周、每月、每年)或邮件触发自动运行,每次运行都是完整对话并保存历史,可通过邮件、应用通知或不通知回报结果。Automations 已在 grok.com 和 iOS、Android 应用开放:定时自动化对所有用户可用,邮件触发需 SuperGrok。

    推荐理由:官方原文说明了定时与邮件触发两种运行方式和各档位可用范围,读者可以据此评估是否把它接入自己的日常流程。

  8. xAI:News(网页)67

    xAI 推出 Grok for Outlook 插件

    xAI 将 Grok 引入 Microsoft Outlook,作为 Microsoft 365 插件在收件箱旁提供智能体能力:总结长邮件串并给出决策、负责人和待办事项,按用户语气起草回复,批量整理积压邮件(归档已完成会话、过滤垃圾邮件、标出需回复的邮件),还能读取附件并搜索网页和 X。

    推荐理由:官方介绍了 Grok Outlook 插件的整理邮件、代拟回复等具体能力与获取方式,读者可据此评估它对邮箱工作流的影响。

  9. xAI:News(网页)73

    Grok Build 推出 Workflows 功能,可编排数百个并行 agent 后台完成任务

    xAI 宣布 Grok Build 支持 Workflows,用自然语言描述任务后由 Grok 规划并在后台分发给数百个并行 agent 执行,完成后汇报结果。

    推荐理由:官方说明了 workflows 的编排方式、agent 预算和复用机制,读者可据此判断它适合哪类多智能体任务。

  10. xAI:News(网页)69

    xAI 发布 Imagine Image 2.0,上线 grok.com 和移动端 Quality Mode

    xAI 宣布 Imagine Image 2.0 正式可用,作为新 Quality Mode 上线 grok.com/imagine 及 iOS 和 Android 应用,API 型号为 grok-imagine-image-2.0。

    推荐理由:原文列出精确编辑、多图合成、模板和 API 入口等具体能力,读者可以对照判断它是否适合实际设计工作流。

  11. xAI:News(网页)67

    xAI 扩大 Grok Bot 覆盖范围:纳入 SuperGrok、Cursor Pro 及 Cursor Teams 订阅计划

    xAI 宣布 Grok Bot 现已包含在所有 SuperGrok、Cursor Pro 及 Cursor Teams 订阅计划中,此前该产品于 8 月 11 日以 beta 形式上线。

    最新进展9月30日 23:42xAI 发布 Grok Bot 自主代理团队功能

    推荐理由:原文说明 Grok Bot 扩展到 SuperGrok 和 Cursor 多档订阅计划,并给出独立用量与具体应用场景,读者可据此判断是否用得上。

  12. Suno:Blog(网页)76

    Suno 发布 v3 音乐模型

    Suno 发布 v3 模型,称其为首个能生成广播级音乐的模型,可在数秒内生成完整的两分钟歌曲,现已向所有用户开放(https://app.suno.ai)。改进包括更好的音质、更多风格和流派、更高的提示词遵循度(更少模型幻觉、更自然的结尾)。模型不识别对其他艺术家的引用,并采用专有的不可听水印技术检测 Suno 生成的歌曲;v4 已在开发中。

    推荐理由:官方说明 v3 在音质、风格和提示词遵循上的具体改进,并介绍了水印防滥用机制,可帮助读者了解其能力边界。

  13. Suno:Blog(网页)61

    Suno 推出 Audio Input 功能,任意声音都能生成歌曲

    Suno 发布 Audio Input 功能,Pro 与 Premier 用户可上传或录制音频,从任意声音生成歌曲。片段需在 6 至 60 秒之间,上传后可选择 Extend、设置时间戳、提供曲风并自备歌词。平台表示将屏蔽版权作品上传,含人声的输入将保持私密且不可搜索。

    推荐理由:官方说明了音频上传的使用方式与隐私限制,用户可据此判断如何把自己的声音素材变成 Suno 歌曲。

  14. Suno:Blog(网页)64

    Suno 发布 v4 音乐生成模型,面向 Pro 和 Premier 用户开放测试

    Suno 发布 v4 音乐生成模型,带来更干净的音频、更精准的歌词和更多样化的歌曲结构。新增 Remaster 可将旧模型曲目升级为 v4 音质,新增歌词助手 ReMi,改进封面生成,且 Covers 和 Personas 功能已由 v4 驱动。v4 目前以 beta 形式面向 Pro 和 Premier 用户开放,可在 suno.com 和 iOS 上使用。

    推荐理由:原文来自 Suno 官方,列出了 v4 的具体新功能和可用范围,读者可以据此判断是否升级使用。

  15. Suno:Blog(网页)64

    Suno 发布 v4.5 音乐模型,曲风更准、人声更丰富、歌曲最长 8 分钟

    Suno 发布最新音乐模型 v4.5,带来更动态的音乐、更准的曲风与曲风混搭、更丰富的人声表现。新功能包括提示词增强助手、Covers 与 Personas 组合使用,歌曲长度可达 8 分钟,生成速度和音频质量均有提升。

    推荐理由:官方列出了 v4.5 在曲风、人声、提示词理解和生成速度上的具体改进,适合关注 AI 音乐生成的读者了解能力变化。

  16. Suno:Blog(网页)61

    Suno 发布升级版 Song Editor 与 stem 拆分等创作控制功能

    Suno 推出升级版 Song Editor,可在波形上逐段重排、重写和重制曲目,并可将曲目拆分为 12 个干净 stem 供预览和下载。同时支持最长 8 分钟的整曲上传,新增三个创意滑块控制生成风格,可继续在 DAW 中编辑或在 Suno 内完成曲目。

    推荐理由:官方介绍升级版 Song Editor、12 轨 stem 拆分和 8 分钟上传等新能力,可帮助创作者评估其在音乐工作流中的用法。

  17. Prime Intellect(网页)70

    Prime Intellect 发布 Lab 全栈后训练平台

    Prime Intellect 发布 Lab,一个面向智能体后训练的全栈平台,将 Environments Hub 与 Hosted Training、Hosted Evaluations 整合,覆盖从大规模智能体 RL 到推理评估的完整流程。

    推荐理由:原文给出了平台组成、已完成的训练规模和定价部署细节,读者可以据此判断它能否替代自建训练基础设施。