Suno 发布 Scenes 功能,可用照片和视频生成歌曲
Suno 发布新功能 Suno Scenes,从相机拍摄的照片或视频生成独特歌曲,官方称其为视觉叙事的创作模式。该功能首先面向 iOS 移动端用户开放,在歌曲创作体验的 Camera 模式下使用。
Suno 发布新功能 Suno Scenes,从相机拍摄的照片或视频生成独特歌曲,官方称其为视觉叙事的创作模式。该功能首先面向 iOS 移动端用户开放,在歌曲创作体验的 Camera 模式下使用。
Sarvam AI 推出 AI 配音模型 Sarvam Dub,支持零样本声音克隆与语音生成阶段的原生时长控制,可将原本耗时数周的配音流程压缩到几分钟。其评测覆盖 10 种印度语言和英语、64 位说话人,每套系统测试超 700 条音频,跨语言场景下的说话人相似度领先同类方案。
Suno 推出 Personas 功能,可将歌曲的 vocals、风格和氛围保存为可复用的创作素材,并应用到新作品中。功能目前处于 Beta 早期访问,面向所有 Pro 和 Premier 订阅用户开放,每位用户可免费生成 200 首 Persona 歌曲,之后每首消耗 10 credits;用户可将 Persona 设为公开供他人使用,并通过 Discord 或邮箱反馈意见。
Suno 发布 v4 音乐生成模型,带来更干净的音频、更精准的歌词和更多样化的歌曲结构。新增 Remaster 可将旧模型曲目升级为 v4 音质,新增歌词助手 ReMi,改进封面生成,且 Covers 和 Personas 功能已由 v4 驱动。v4 目前以 beta 形式面向 Pro 和 Premier 用户开放,可在 suno.com 和 iOS 上使用。
推荐理由:原文来自 Suno 官方,列出了 v4 的具体新功能和可用范围,读者可以据此判断是否升级使用。
Suno 正式登陆 Android,这是其首个 Android 版本,用户可通过文字提示词创作音乐、发现社区新曲目并分享作品。该版本已包含核心功能,官方表示后续还将持续更新。
Sarvam AI 发布智能体编排栈 Arya,用 LLM、Agent、MCP、Node、Ledger、Task Graph、Code Interpreter、Artefact 八个可组合原语构建生产级 Agent。Arya 提供可组合原语、崩溃可恢复状态、受控动态性与声明式编写四项保证,并支持将任务图封装为 MCP 供其他 Agent 以工具调用方式复用。
Suno 推出升级版 Song Editor,可在波形上逐段重排、重写和重制曲目,并可将曲目拆分为 12 个干净 stem 供预览和下载。同时支持最长 8 分钟的整曲上传,新增三个创意滑块控制生成风格,可继续在 DAW 中编辑或在 Suno 内完成曲目。
推荐理由:官方介绍升级版 Song Editor、12 轨 stem 拆分和 8 分钟上传等新能力,可帮助创作者评估其在音乐工作流中的用法。
Sarvam AI 推出 Sarvam Studio,一个将语音、文本和文档工作流整合到同一工作空间的多语言内容转换平台,支持 AI 视频配音与智能体文档翻译。其配音在约 280 次与 ElevenLabs、YouTube Dub、Rask AI 的盲测对比中获得最高整体偏好,说话人相似度平均得分 0.88。该平台目前通过受控早期 beta 向政府、教育、媒体和出版领域的少量生产合作伙伴开放。
Sarvam AI 发布文档智能工作台 Akshar,构建在 3B 视觉语言模型 Sarvam Vision 之上,支持视觉定位、版面感知抽取与自动校对。
Suno 发布 Suno Studio,称其为首个生成式音频工作站,把 AI 生成置于音乐创作核心。功能包括即时生成人声、鼓、合成器等无限 stem 变体,支持上传采样、调用 Suno 库或从单个 stem 起步,并提供多轨时间线编辑、BPM、音量和音高控制;可导出音频与 MIDI 文件回接任意 DAW。产品已在桌面端面向 Premier 用户开放。
Suno 为 Premier 订阅者的生成式音频工作站 Suno Studio 推出 1.2 版本,新增 Remove FX、Warp Markers(含 Quantize)、Alternates 和拍号支持。
Suno 发布 v5.5 模型,同时推出 Voices、Custom models 和 My Taste 三项个性化功能。
推荐理由:原文给出 Voices 的验证与隐私细节和两项新个性化功能,读者可以判断这些能力如何改变自己的创作流程。
Suno 宣布改进 Stem Separation 并重做了分轨功能,新增三种拆分方式。Auto Split 可自动拆成最多 12 个 stems,Split from Mix 从下拉菜单选定乐器或人声单独提取,Advanced Split(仅 Premier)支持从近 100 种乐器列表中精确提取;部分最细粒度选项仍在开发中。
UC Berkeley 等机构团队发布 OpenSage,一个让 AI 自动生成 Agent 拓扑、合成管理工具并控制分层记忆的 Agent Development Kit。
Prime Intellect 宣布其全球 GPU 资源聚合与调度平台 Prime Intellect Compute 全面公开,目标是打造算力交易所。
Ramp 借助 Prime Intellect Lab 以 RL 训练出面向电子表格财务检索的专用子智能体 FastAsk,基于 Qwen3.5-35B-A3B,准确率 66.25%,超过 Claude Opus 4.6 的 61.88%,耗时为 Haiku 4.5 的 1.05 倍,比基座模型高 10 个百分点,比 Opus 4.6 快 27%、准确率高 4%。
Zapier 基于 Prime Intellect 的 Verifiers 框架构建 AutomationBench,在覆盖 9,000+ 应用的生态中评测多步自动化工作流,并通过 Prime Intellect Lab 将其转为 RL 训练环境。
Prime Intellect 发布 Environments Hub,一个开放的社区平台,用于创建、分享和复用强化学习环境与评测,上周 private beta 已有超过 30 名研究者和公司贡献环境,现向所有人开放。
Prime Intellect 发布 Lab,一个面向智能体后训练的全栈平台,将 Environments Hub 与 Hosted Training、Hosted Evaluations 整合,覆盖从大规模智能体 RL 到推理评估的完整流程。
推荐理由:原文给出了平台组成、已完成的训练规模和定价部署细节,读者可以据此判断它能否替代自建训练基础设施。
Prime Intellect 与 Browserbase 合作推出 BrowserEnv,用 Browserbase 的可扩展浏览器基础设施训练浏览器和计算机使用 Agent,该基础设施曾支持 Microsoft Fara-7B 和 Google Gemini 2.5 CUA 的工作。
Prime Intellect 宣布其自我改进智能体训练平台 Lab 结束 beta,正式全面开放。平台以环境为核心抽象,提供托管训练、托管评估、Environments Hub、adapter 部署和 Prime Inference 等组件,覆盖评估、训练、检查、部署的完整循环;beta 期间数百名用户已运行超 10,000 个训练任务。
Prime Intellect 推出 Hosted Evaluations,为所有人提供可扩展基础设施,在自有评测上测试模型。该服务支持在 Environments Hub 上数百个社区环境中运行评测,可通过平台或 CLI 加 --hosted 参数启动,评测结果可发布到对应 leaderboard,并配有评测查看器展示采样参数与样本轨迹。
Prime Intellect Lab 为 NVIDIA Nemotron 3 Ultra 提供 day-0 后训练支持,该模型为 550B 参数 MoE、55B 激活参数,在 RULER@1M 上达 95%、SWE-bench Verified 达 65–70.4%。
Prime Intellect 发布 prime-rl 0.6.0,可在 28 个 H200 节点上以最高 131k 序列长度、sub-5 分钟 step 时间和 256 rollouts 批大小训练 GLM-5 等万亿参数 MoE 模型执行 SWE 任务。
Prime Intellect 为 prime-rl 引入一等算法层,内置 GRPO、MaxRL、On-Policy Distillation、Self-Distillation、SFT distillation 和 ECHO 六种算法,可按环境分别选择,单次运行即可在不同环境训练不同算法。
Prime Intellect 发布 research-environments,为 23 个开源智能体任务集提供统一 taskset API,涵盖约 198,000 个软件工程任务、约 28,600 个终端任务和约 137,600 个搜索任务,总计约 365,000 个环境,配套约 135,000 个预构建任务镜像。
Prime Intellect 发布开源编码智能体 Prime Agent,围绕 Recursive Language Model(RLM)和 Continual Harness 两个抽象设计,通过持久 IPython 内核以程序化方式调用工具和子智能体,并支持对提示词、技能、记忆和子智能体进行 CRUD 式自改进。
推荐理由:官方介绍了 RLM 与 Continual Harness 两个抽象和公开的评测数据,读者可以据此评估这个开源智能体运行时的适用场景。
Visual Studio 现已支持最新版 .NET 与 C# 14,并原生集成 GitHub Copilot 与 Azure AI,覆盖 Web、云、桌面及 AI 工作负载。
Microsoft 为 Marketplace 推出 Frontier Accelerate,帮助开发者构建、变现并扩展 AI 应用与智能体。该计划提供个性化指导、精选推荐和交互式模块,在构建各阶段帮助开发者克服阻力、保持推进节奏。
Microsoft 发布 2026 年 9 月版 Copilot 更新汇总,涵盖支持调查参与者、简化管理以及跟进 Viva Glint 变更等实用功能。本期还介绍了新的 Copilot 体验与调查相关能力。
Microsoft Learn 支持创建自定义智能体,该智能体通过 Learn MCP 服务器,依据受信任的 Microsoft 官方文档回答用户问题。平台同时提供 AI、Azure 和 Copilot 基础知识的热门技术资源与培训,以及开发人员社区问答和技能认证。
GitHub 正在优化 VS Code 中 GitHub Copilot 的 token 效率,以应对其转向按用量计费后每个 token 都变得关键的变化。官方称让智能体框架更省 token 是持续进行的工作,将逐个小的改进持续投入。
Azure Container Apps Sandboxes 已正式可用,为 AI 智能体提供快速、隔离的沙箱基础设施。Azure 同时提供 Microsoft Foundry、Microsoft Fabric、Microsoft IQ 等产品,用于构建、评估和部署生成式 AI 方案与自定义智能体。Azure HorizonDB 处于预览阶段,是基于 PostgreSQL 的云数据库服务。
Microsoft Power Platform 支持专业开发者、IT 人员与业务用户从低代码工具起步,构建应用、自动化工作流并部署 AI 智能体,IT 可集中管理环境、数据访问、DLP 策略与审计。
Microsoft Dynamics 365 推出面向前沿的智能体业务应用,将智能体 CRM、CCaaS 与 ERP 结合,帮助团队更智能地销售、更快服务客户并提升运营利润。该产品被 Forbes Advisor 评为 2025 年最佳云 ERP 软件之一。
Microsoft 生成式 AI 通过深度学习按自然语言提示词生成文本、图像、音乐和代码,区别于仅做分析预测的传统 AI、预测式 AI 和对话式 AI。
Microsoft Edge 将 Copilot 集成进各标签页,可协助比较选项、解释重点,并结合浏览历史提供更个性化的帮助。新增的 Copilot Vision 能查看用户屏幕,即时扫描、分析并给出建议。Edge 还提供节能模式,平均延长 25 分钟电池续航,并内置面向 PC 游戏的 Edge for Game Bar。
Microsoft 发布 Surface 系列新品,包括面向创作者的性能笔记本 Surface Laptop Ultra,该产品目前为预发布状态,功能可能变动。Surface Laptop 13 英寸本地视频播放续航最高 22.5 小时,Surface Pro 12/13 英寸均为 15.5 小时。Copilot+ PC 功能仅在 16GB 及以上内存的部分配置上提供。
微软在 Windows 宣传页中主推 Windows Hello,用户可用人脸、指纹或 PIN 免密登录,无需记忆或输入密码。页面以灵活性、兼容性、本地 AI、游戏生态和内置 Microsoft 安全防护五个维度对比 Windows 与其他主流操作系统,并称 Windows 拥有最大的 PC 游戏生态。本地 AI 功能依赖硬件,且随设备而异。
Microsoft Copilot 现可在 Web、桌面和移动端使用,将工作与生活场景整合到同一体验中,并支持 Windows、Mac、Microsoft Edge 及移动设备间保持连接。Copilot 功能需符合条件的 Microsoft 365 订阅,可用性因地区而异。