Cohere and Aleph Alpha announce the signing of a definitive agreement, becoming the first foundational AI model developer anchored on both sides of the Atlantic 🇨🇦🇩🇪 Operating globally as Cohere, the unified company will grow to more than 1,000 employees across both continents.
全部AI 动态
全部动态
今日 47 条
Aidan Gomez@aidangomezAI 评分5555引用Cohere@cohereNVIDIA Blog(RSS)AI 评分5353 Emerald AI、Google 与 NVIDIA 发起 AI Energy Management Alliance 推动灵活用电数据中心
Emerald AI、Google 与 NVIDIA 宣布发起 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态调整用电。联盟主张技术中立、按性能衡量灵活性,制定并网前的响应义务、统一技术要求和更快并网通道,汇聚 AI 平台、数据中心、电力公司与电网运营商等价值链成员,以提升现有电网容量利用、缩短 AI 设施并网时间。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分3939 OpenAI 用 AI 重塑广告:Sponsored Agents 与 HubSpot、Shopify 集成
OpenAI 推出 AI 驱动的广告新体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分1818 OpenAI 如何将 AI 使用情况与业务价值挂钩
OpenAI 介绍如何通过 ChatGPT Work 和 Codex 的分析功能,帮助团队了解 AI 使用量与支出、识别培训需求,并将采用情况与业务成果关联。
Mistral AI:News(网页)AI 评分4242 Mistral 与 Mozilla 合作,为 Firefox 浏览器带来开放、私密的多语言 AI
Mistral 与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分2626 Hex 用 GPT-6 Astra 将复杂分析变成可视化报告
Hex 的数据智能体借助 GPT-6 Astra,把分析答案转化为可交互的可视化报告,让员工乐于分享。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分2828 OpenAI 经济研究:员工如何用 AI 解锁新工作方式
OpenAI 经济研究显示,员工使用 AI 的方式已超出传统岗位职责,部分新活动正成为其工作中的常规环节。该研究聚焦员工如何借助 AI 拓展工作边界,并识别出哪些新行为会被反复纳入日常工作。
蚂蚁 inclusionAI:HuggingFace 新模型精选AI 评分6262 蚂蚁 inclusionAI 开源 Realtime-Venus 9B 全双工音视频交互系统
蚂蚁 inclusionAI 发布 Realtime-Venus,一个支持主动音视频交互、异步委托和可打断全双工对话的开源系统,包含 Realtime-Venus-Omni 和 Realtime-Venus-Audio 两个 9B 检查点。
推荐理由:模型卡给出了 Realtime-Venus 的架构组成、全双工与异步委托能力及完整用法,读者可以据此评估它在实时音视频交互场景的可用性。
NVIDIA Blog(RSS)AI 评分4242 曼彻斯特大学用 NVIDIA Earth-2 预测全英空气污染
曼彻斯特大学团队基于 NVIDIA Earth-2 的 CorrDiff 生成式降尺度模型,用一年英国逐小时污染模拟数据训练出覆盖全英、分辨率 2-3 平方公里的空气污染模型,在 Isambard-AI 单节点 8 块 GPU 上仅用两天完成训练。
MIT News(RSS)AI 评分2323 MIT 政治学者 Naoki Egami 如何用统计方法研究社会测量与 AI 工具误差
MIT 政治学副教授 Naoki Egami 专注研究方法论,尤其研究社会科学的“外部有效性”,即特定研究结论能否推广到其他情境。他早在 ChatGPT 引发 AI 热潮之前就开始研究 AI 工具引入研究后产生的误差,以及如何系统识别并校正这些误差。Egami 2020 年获普林斯顿大学博士学位,2025 年加入 MIT 政治学系。
Together AI 研究与产品博客(RSS)AI 评分5353 Together AI 详解从闭源模型迁移到开源模型的策略
Together AI 发布从闭源模型迁移到开源模型的指南,称采用托管服务可将迁移周期从数月到数年缩短为数周到数月。方法分发现、评估、适配、决策、生产五步,核心是用真实流量回放而非通用基准做评估,并按系统提示词、推理参数、上下文工程、微调四个杠杆迭代适配;文中提到部分客户迁移后成本最多降低 70%,可用 10% 流量的金丝雀部署开始上线。
Apple Machine Learning Research(RSS)AI 评分4949 面向 Agentic LLM 系统的共享选择性持久记忆架构
研究者提出共享选择性持久记忆架构,为多轮工具调用的 Agentic LLM 系统保留任务规格、数据 schema、工具配置和输出约束四类可复用上下文,并丢弃会话专属推理轨迹。
Apple Machine Learning Research(RSS)AI 评分4040 DACA-GRPO:面向扩散语言模型强化学习的去噪感知信用分配方法
Apple 研究者提出 DACA-GRPO,一种可插拔的 GRPO 训练增强方法,用于扩散语言模型强化学习。它通过 Denoising Progress Scores 提取逐 token 重要性权重(无额外前向开销),并用 Stratified Masking Likelihood 降低 mean-field 似然偏差。
Apple Machine Learning Research(RSS)AI 评分3838 Glyph:面向企业数据目录列描述与敏感本体标注的多策略智能体系统
Apple 研究团队提出 Glyph,一个将列描述生成与列类型标注建模为有状态图编排的多智能体 LLM 生产系统。其 Descriptor 通过推理-行动工具循环从企业 GitHub 按需检索管道源码来支撑生成,Tagger 并行运行描述、业务线正则与元数据三种策略,并用 RRF 融合排序结果,从 275 叶节点的数据分类本体中打标。
NVIDIA Blog(RSS)AI 评分4949 黄仁勋在 Dreamforce:Salesforce 首个 CRM 推理模型 Koa 基于 NVIDIA Nemotron 3 Super 构建
Salesforce 在 Dreamforce 发布首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练而成,训练语料覆盖 14+ 行业的合成企业场景。
Google ResearchAI 评分2929 Google Research 提出 Retrieve-for-Train:用 RL 编译扩散模型绕过推理瓶颈,加速复杂 AI 搜索
Google Research 提出 Retrieve-for-Train 框架,通过离线强化学习发现奖励对齐的查询扇出并编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现推理时单次非自回归的查询扇出。该方法在 Gemma3-4B 和 Qwen3-4B 上微调扇出语言模型,用集合级属性奖励评估整组结果,无需人工标注,也无需推理时的 CoT 思考 token。
Josh Woodward@joshwoodwardAI 评分5353
Logan Kilpatrick@OfficialLoganKAI 评分5757Google DeepMind:Blog(RSS)精选AI 评分8282 Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 语音模型
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时对话模型,前者面向规模化与成本效率,后者面向高复杂度任务与多步推理。
推荐理由:官方给出两款语音模型的基准成绩与开放渠道,可据此判断实时语音智能体的能力与成本取舍。
Google DeepMind@GoogleDeepMindAI 评分5252NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分3434 Dense 与 MoE 模型对比:活跃参数、吞吐量与选型时机
NVIDIA 技术博客对比 Dense 与 MoE 两种模型架构,说明参数组织方式对性能的影响。以 Nemotron 3.5 Lightning 为例,该模型总参数 30B,但每个 token 仅激活 3B 参数,依靠 MoE 架构按 token 选择部分参数,从而在保留大模型容量的同时降低单次计算量。文章围绕活跃参数、吞吐量与选型时机展开分析。
NVIDIA Blog(RSS)AI 评分4040 NVIDIA 如何用 DSX 最大化 AI 工厂产出:从兆瓦到 Token
NVIDIA 在 AI Infra Summit 上公布 DSX MaxLPS 的首个部署验证结果:Lambda 在五机架 19 节点 HGX B200 集群上,用与 16 节点满功耗相同的电力预算跑出 24% 的集群 token 吞吐提升,从约 400 万 tokens/秒升至 500 万,每瓦性能提升 23%。
NVIDIA Blog(RSS)AI 评分4949 NVIDIA 在 AI Infra Summit 展示 Vera Rubin 与 DSX 平台能效进展
NVIDIA 在 AI Infra Summit 上展示 Vera Rubin 系统与 DSX 平台,其 DSX MaxLPS 通过全厂电力优化可实现每兆瓦最多 1.4 倍 token。
NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分2020 NVIDIA NVLink 6 如何为 AI 工厂提供多层弹性
NVIDIA 详解 NVLink 6 如何为大规模 AI 工厂提供多层弹性。在超大规模 AI 训练中,集群内每块 GPU 每秒需在数千次集合通信操作中同步梯度;推理阶段非计划停机则直接减少请求处理总量,限制营收。
NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分2121 NVIDIA Groq 3 LPX 的确定性执行如何在 NVIDIA Vera Rubin 上驱动高能效高交互推理
NVIDIA Groq 3 LPX 通过确定性执行,在 NVIDIA Vera Rubin 平台上实现高交互推理的能效提升。该方案针对 AI 工厂的功耗约束,以每瓦性能而非原始吞吐量作为衡量 AI 平台价值的核心指标。Vera Rubin 平台正是为在有限功耗预算内最大化输出而设计。
Odyssey@odysseymlAI 评分2828
Hugging Face:Blog(RSS)精选AI 评分6262 Hugging Face 发布 ALTK-Evolve 一致性指南与 Consistency Analyzer,将智能体一致性差距减半
IBM Research 与 Hugging Face 在 ALTK-Evolve 中推出一致性指南和 Consistency Analyzer,用于诊断和改善智能体重复运行的不稳定性。
推荐理由:原文给出一致性差距的量化诊断方法与开源实现,读者可据此评估和改进智能体在重复运行下的可靠性。
Gary Marcus:The Road to AI We Can Trust(RSS)AI 评分3030 Gary Marcus 解读 Sam Altman 的"pacing"表态
Gary Marcus 解读 Sam Altman 在 X 上发帖中的措辞,将其"pacing"说法翻译为:我们会以最快速度推进,只要不进监狱、不被诉讼搞到公司消失,但为了观感,我们把它叫作"pacing"。Marcus 还指出,任何能减少监管不确定性的举措都可能有利于 IPO。
NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分2828 NVIDIA FLARE 如何跨 Docker、Kubernetes 和 Slurm 扩展联邦学习
NVIDIA 技术博客介绍如何用 NVIDIA FLARE 将联邦学习从单服务器、少量客户端的简单部署扩展到跨 Docker、Kubernetes 和 Slurm 的共享基础设施。随着项目规模增长,挑战从运行算法转向运营共享基础设施:按需分配 GPU、隔离多个研究任务,并让每个参与机构保留对自身数据的控制权。
Gary Marcus:The Road to AI We Can Trust(RSS)AI 评分5454 美国秘密 AI 评估框架 FOIA 披露 132 页记录但内容几乎全被打码
Gary Marcus 披露,Protect Democracy 针对美国政府秘密 AI 安全评估框架提起 FOIA 诉讼后,政府回应了 132 页记录,但几乎所有关键内容都被打码。
NVIDIA Blog(RSS)AI 评分4242 费城儿童医院如何用开源 NVIDIA AI 实现儿童心脏建模与手术模拟
费城儿童医院(CHOP)基于开源医学影像框架 MONAI 构建心脏建模服务,将原本需 4 小时的建模流程缩短至数秒,并已用于复杂心室间隔缺损手术规划。全美超 20 家儿童医院开展心脏建模项目,波士顿儿童医院建模支持其过半心脏手术、约每年 500 例,CHOP 今年预计完成约 200 例。
MiniMax Design (H3)@Hailuo_AIAI 评分3737一句简述 ➕ 一块画布 🟰 一整支制作团队,尽在 #MiniMaxDesign。
引用Stefan 3D AI@Stefan_3D_AII gave Astra one brief and it delivered the whole scene in Blender, camera direction included. All of it ran inside MiniMax Design. Astra sits there as the agent and talks to Blender over an official connector, so everything syncs straight onto the canvas. The final video is MiniMax H3, from the same canvas. #MiniMaxdesign - https://design.minimax.io/
MiniMax Design (H3)@Hailuo_AIAI 评分2020引用Koldo Huici@koldo2kI used the work generated with GPT-6 Astra to build out a set, a story. Now I'm bringing it to life with @Hailuo_AI Minimax H3. Here's a tip that's worked well for me 👇
MiniMax Design (H3)@Hailuo_AIAI 评分2222引用楽園|AI動画&AI音楽@dave392750うきょさんのプロンプトでMinimaxH3Designで作成しました。 これマジでヤバいですね。 @Hailuo_AI #MiniMaxH3
Nous Research:GitHub 新仓库AI 评分3737 Nous Research 发布 Hermes Agent 记忆 Wiki 插件
Nous Research 在 GitHub 上线 hermes-memory-wiki,为 Hermes Agent 提供可浏览的会话历史 Wiki 与持久记忆审计面板。该插件以 dashboard plugin 形式接入,用于查看会话记录并审计持久记忆内容。
vLLM 官方博客(RSS)AI 评分4646 vLLM x Novita AI:面向 Kimi K2.x 的 INT4 MoE 算子 Chord,H200 最高 1.3x、B300 最高 2.15x
Novita AI 开源了 Chord,一个面向 BF16 激活、INT4 权重与 group-32 scale 的 W4A16 MoE CUDA 算子,专为 Kimi K2.x 服务形态打造。
vLLM 官方博客(RSS)AI 评分4545 如何用 GB300 NVL72 为 Kimi-K3 训练最快的 DSpark 推测解码器
vLLM 团队借助 Speculators 训练库,为 2.8T 参数的 Kimi K3 训练出 DSpark 推测解码器,在数学推理上把单流交互速度从约 110 提升到约 435 tok/s/user,并发负载下同等交互性时输出吞吐最高提升约 3.5 倍。
MiniMax (official)@MiniMax_AIAI 评分3636引用SGLang@sgl_projectSGLang-Diffusion with VDN-H3 now generates 14.4s of 768p video in just 9.0s 🚀 On 8× B200, 8 step denoising takes just 6.9s, reaching over 2× real time. The 9.0s figure covers the full generation request after warmup. No measured quality regression versus dense 50-step H3 across 103 test prompts. 🧵
Google DeepMind@GoogleDeepMindAI 评分3232天气预报在向可再生能源转型中发挥着关键作用。 WeatherNext 3 为电网运营商以及风能和太阳能发电企业提供风机轮毂高度风速和太阳辐射预测,助力更智能、更清洁的能源规划。🧵

Josh Woodward@joshwoodwardAI 评分2626引用News from Google@NewsFromGoogleToday @FastCompany awarded @Google the winner of their 2026 Innovation by Design Awards for our holistic design vision and new AI design language, seen across our products, from @GeminiApp to @GoogleMaps' Immersive Navigation and Search AI Mode. Read the full story. https://www.fastcompany.com/91589966/google-innovation-by-design-2026