全部AI 动态
全部动态
今日 122 条
Epoch AI@EpochAIResearchAI 评分6363
Sierra:Blog(RSS)AI 评分4040 Sierra 通过 AIUC-1 认证,AI 智能体安全测试覆盖对抗场景
Sierra 宣布通过 AIUC-1 认证,该认证经 Schellman 独立审计并由 AIUC 完成大量测试,专门针对 AI 智能体的实际行为,包括操纵尝试、受保护信息访问和越权操作等对抗场景。
Baidu Inc.@Baidu_IncAI 评分4040Apollo Go 在香港上路了。🚘 全无人驾驶测试在这座城市的道路上持续推进——一起来看看 Apollo Go 的实际表现。↓

OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分2929 Cooley 如何用 ChatGPT 加速 IPO 工作
Cooley 基于 ChatGPT Work 构建了 GO Public,将智能引入 IPO 流程,帮助律师更早发现问题并把判断力集中在最关键处。
Latent Space(RSS)AI 评分4747 AINews:Yegge 关停 Gas Town,Databricks 用 GPT-6 Astra 后编码支出增 60%
Steve Yegge 关停了 Gas Town,并承认每月花费数千美元订阅编码智能体,却只做出了 Gas Town 这一个项目。Databricks 向约 3500 名工程师铺开 GPT-6 Astra,其在高复杂度系统设计与长周期任务上"明确"优于 Opus 5 / Sol 5.6,但整体编码支出增加约 60%,公司为此设立专门的 Astra 子预算。
Huawei Cloud@HuaweiCloud1AI 评分2323
Greg Brockman@gdbAI 评分5959引用Patrick Wendell@pwendellToday we rolled out Astra to every engineer at Databricks (N=~3500). Some notes that may be helpful to others: 1. Astra unambiguously out performs our previous highest-end models (Opus 5, Sol 5.6) on highly complex tasks, especially those related to high level system design or long range horizontal tasks. 2. Engineers given Astra increased overall coding spend by around 60% compared to baseline. 3. It is not clear Astra meaningfully improves on medium/low complexity coding tasks compared to earlier models. We suspect those tasks are mostly saturated (i.e. perfectly executed) by existing models. 4. We learned above by piloting Astra with around 200 users to gain signal on both quality and cost. We use Unity Gateway to do cohort-based experiments for all new models. 5. We give engineers a sub-budget specific to Astra to encourage them to use Astra selectively on complex tasks while preferring lower cost models for everyday tasks. Our engineers are able to mix-and-match tools and models within their overall budget envelope (we also allow for increased budgets through various mechanisms). These budgets are defined in Unity Gateway and regularly revisited. Note: We do not have robust comparisons of Astra-vs-Fable because we have net yet rolled out Fable widely due to data retention policies.
Newcomer 新闻长文(RSS)AI 评分4040 市场地图:89 家获 VC 投资的 AI 金融科技初创公司,覆盖银行、审计与合规
Newcomer 发布第二份 AI 金融服务市场地图,收录 89 家获 VC 投资的初创公司,聚焦投资银行与财富管理、CFO 办公室、欺诈与合规、基金管理、会计税务与审计等七类工具。
Microsoft:Official Blog(RSS)AI 评分4545 Microsoft 发布教育 AI 五项原则:与 AFT 达成协议并推出学校隐私与安全标准
Microsoft 公布教育领域 AI 五项原则,并与美国教师联合会(AFT)签署协议、推出面向学校产品的 Privacy & Safety Standard,限制学生和教师数据使用并要求对重大决策保留人工监督。Microsoft 称这是大型科技公司与美国最大教师工会之一首次共同界定教育产品中可信 AI 的标准,并邀请业界共同遵循。
Latent Space(RSS)AI 评分5757 AIUC 融资 4000 万美元,Rune Kvist 谈用标准和保险为 AI 智能体承保
AIUC 宣布完成由 Ribbit Capital 和 First Harmonic 领投的 4000 万美元 A 轮融资,正在与 Cursor、Harvey、Lovable、ElevenLabs 等公司合作。
Epoch AI@EpochAIResearchAI 评分4242我们正在扩展 AI 数据中心研究,以提供更全面的全球 AI 基础设施图谱。我们的数据现已覆盖全球约 44% 的 AI 算力,覆盖面正在快速增长。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分5353 OpenAI 公布模型错位报告框架并附六份行为报告
OpenAI 公布一套用于跟踪、调查和披露模型错位(misalignment)的框架,并同步发布六份关于意外或令人担忧的模型行为的报告。
Google Cloud:Databases(RSS)AI 评分3434 Google Cloud M4N 虚拟机系列正式 GA:面向 I/O 与内存密集型负载的最高单核 IOPS 和吞吐
Google Cloud 宣布 M4N 虚拟机系列在 Compute Engine 正式可用,面向 I/O 密集型高内存负载,提供同类高内存实例中最高的单核 IOPS 和吞吐,Oracle 数据库 TCO 降低超 20%。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分2929 OpenAI 与 AARP 为 10 座美国城市老年人提供 ChatGPT 免费实操工作坊
OpenAI 与 AARP 合作,将在美国 10 座城市为 1000 名老年人提供免费的 ChatGPT 实操工作坊,帮助他们安全掌握实用的 AI 技能。
Aidan Gomez@aidangomezAI 评分5555引用Cohere@cohereCohere and Aleph Alpha announce the signing of a definitive agreement, becoming the first foundational AI model developer anchored on both sides of the Atlantic 🇨🇦🇩🇪 Operating globally as Cohere, the unified company will grow to more than 1,000 employees across both continents.
Demis Hassabis@demishassabisAI 评分4141NVIDIA Blog(RSS)AI 评分5353 Emerald AI、Google 与 NVIDIA 发起 AI Energy Management Alliance 推动灵活用电数据中心
Emerald AI、Google 与 NVIDIA 宣布发起 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态调整用电。联盟主张技术中立、按性能衡量灵活性,制定并网前的响应义务、统一技术要求和更快并网通道,汇聚 AI 平台、数据中心、电力公司与电网运营商等价值链成员,以提升现有电网容量利用、缩短 AI 设施并网时间。
Mistral AI:News(网页)AI 评分4242 Mistral 与 Mozilla 合作,为 Firefox 浏览器带来开放、私密的多语言 AI
Mistral 与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。
Latent Space(RSS)AI 评分6060 Latent Space AINews:TypeSafe 发布决策模型 Jev,同期还有 Periodic Neon 与 Gemini 3.8 Live
Latent Space AINews 汇编 2026-09-14 至 09-15 的 AI 动态,头条是 TypeSafe 的 Jev:一个用 RLCD 训练、只做分类/路由/打分的非自回归决策模型,宣称比小型前沿 LLM 快 20–200 倍、便宜 40–400 倍且输出 token 免费,社区提醒它不能生成自由文本、更接近结构化选择的低成本推理引擎。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分2828 OpenAI 经济研究:员工如何用 AI 解锁新工作方式
OpenAI 经济研究显示,员工使用 AI 的方式已超出传统岗位职责,部分新活动正成为其工作中的常规环节。该研究聚焦员工如何借助 AI 拓展工作边界,并识别出哪些新行为会被反复纳入日常工作。
NVIDIA Blog(RSS)AI 评分4242 曼彻斯特大学用 NVIDIA Earth-2 预测全英空气污染
曼彻斯特大学团队基于 NVIDIA Earth-2 的 CorrDiff 生成式降尺度模型,用一年英国逐小时污染模拟数据训练出覆盖全英、分辨率 2-3 平方公里的空气污染模型,在 Isambard-AI 单节点 8 块 GPU 上仅用两天完成训练。
NVIDIA Blog(RSS)AI 评分4949 黄仁勋在 Dreamforce:Salesforce 首个 CRM 推理模型 Koa 基于 NVIDIA Nemotron 3 Super 构建
Salesforce 在 Dreamforce 发布首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练而成,训练语料覆盖 14+ 行业的合成企业场景。
SemiAnalysis 长文 RSS(RSS)AI 评分6767 SemiAnalysis 反驳数据中心暂停令正在扼杀美国建设潮的说法
SemiAnalysis 分析认为数据中心暂停令严重拖慢美国建设的说法不准确。其模型预测 2027 年美国新增 38GW IT 容量,是 2026 年的两倍以上;约 300 个地方暂停令中实际被直接延迟的容量仅约 2.3GW,其中纽约州约 0.8GW、地方限制约 1,525MW,主要由俄亥俄 AWS 园区等三个项目构成。
Fei-Fei Li@drfeifeiAI 评分3232机器人学习的研究人员/工程师加入 @theworldlabs 的绝佳机会!❤️🔥
引用Yunzhu Li@YunzhuLiYZWe're hiring in robot learning at @theworldlabs! Join me, @drfeifei, and the team to define and scale the next generation of world models for robot learning! Atlas for Robotics: https://www.worldlabs.ai/blog/atlas#robotics-simulation Real-to-Sim-to-Real: https://www.worldlabs.ai/blog/real-to-sim-to-real Apply: https://jobs.ashbyhq.com/worldlabs/85994fa5-c44c-48b4-84fc-aece7934c2cb
Latent Space(RSS)AI 评分5050 Latent Space 访谈 Good Start Labs CEO:游戏训练能否迁移到真实工作
Latent Space 访谈 Good Start Labs CEO Alex Duffy,探讨用 Diplomacy、1830 等游戏训练 AI 模型能否让技能迁移到真实工作。
Sundar Pichai@sundarpichaiAI 评分3636NVIDIA Blog(RSS)AI 评分4040 NVIDIA 如何用 DSX 最大化 AI 工厂产出:从兆瓦到 Token
NVIDIA 在 AI Infra Summit 上公布 DSX MaxLPS 的首个部署验证结果:Lambda 在五机架 19 节点 HGX B200 集群上,用与 16 节点满功耗相同的电力预算跑出 24% 的集群 token 吞吐提升,从约 400 万 tokens/秒升至 500 万,每瓦性能提升 23%。
NVIDIA Blog(RSS)AI 评分4949 NVIDIA 在 AI Infra Summit 展示 Vera Rubin 与 DSX 平台能效进展
NVIDIA 在 AI Infra Summit 上展示 Vera Rubin 系统与 DSX 平台,其 DSX MaxLPS 通过全厂电力优化可实现每兆瓦最多 1.4 倍 token。
NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分2020 NVIDIA NVLink 6 如何为 AI 工厂提供多层弹性
NVIDIA 详解 NVLink 6 如何为大规模 AI 工厂提供多层弹性。在超大规模 AI 训练中,集群内每块 GPU 每秒需在数千次集合通信操作中同步梯度;推理阶段非计划停机则直接减少请求处理总量,限制营收。
NVIDIA Technical Blog(开发者技术博客 · RSS)AI 评分2121 NVIDIA Groq 3 LPX 的确定性执行如何在 NVIDIA Vera Rubin 上驱动高能效高交互推理
NVIDIA Groq 3 LPX 通过确定性执行,在 NVIDIA Vera Rubin 平台上实现高交互推理的能效提升。该方案针对 AI 工厂的功耗约束,以每瓦性能而非原始吞吐量作为衡量 AI 平台价值的核心指标。Vera Rubin 平台正是为在有限功耗预算内最大化输出而设计。
Pragmatic Engineer(RSS)AI 评分7373 Gergely Orosz 实地探访 OpenAI 的智能体软件工厂:Codex 成为核心研发支柱
Gergely Orosz 采访 OpenAI 七位工程师与工程负责人,报道 Codex 和 ChatGPT Work 如何成为公司内部几乎所有工作的支柱。
Gary Marcus:The Road to AI We Can Trust(RSS)AI 评分5454 美国秘密 AI 评估框架 FOIA 披露 132 页记录但内容几乎全被打码
Gary Marcus 披露,Protect Democracy 针对美国政府秘密 AI 安全评估框架提起 FOIA 诉讼后,政府回应了 132 页记录,但几乎所有关键内容都被打码。
NVIDIA Blog(RSS)AI 评分4242 费城儿童医院如何用开源 NVIDIA AI 实现儿童心脏建模与手术模拟
费城儿童医院(CHOP)基于开源医学影像框架 MONAI 构建心脏建模服务,将原本需 4 小时的建模流程缩短至数秒,并已用于复杂心室间隔缺损手术规划。全美超 20 家儿童医院开展心脏建模项目,波士顿儿童医院建模支持其过半心脏手术、约每年 500 例,CHOP 今年预计完成约 200 例。
Josh Woodward@joshwoodwardAI 评分2626引用News from Google@NewsFromGoogleToday @FastCompany awarded @Google the winner of their 2026 Innovation by Design Awards for our holistic design vision and new AI design language, seen across our products, from @GeminiApp to @GoogleMaps' Immersive Navigation and Search AI Mode. Read the full story. https://www.fastcompany.com/91589966/google-innovation-by-design-2026
Mira Murati@miramuratiAI 评分4545我们正在构建机器智能,以扩展人类的意志与判断力。很高兴你能加入团队,帮助我们探索如何让这一未来变得安全。
引用Neil Chowdhury@ChowdhuryNeilI’ve joined @thinkymachines to work on safety & alignment. The default trajectory is that as AI gets more powerful, control over it will concentrate in the hands of a few. I’d rather build safety systems that let control over AI be shared widely. Longer thoughts below.
SemiAnalysis 长文 RSS(RSS)AI 评分5757 SemiAnalysis 分析机器人智能应放在端侧还是数据中心推理
SemiAnalysis 长文分析机器人模型的大脑应放在机上还是数据中心。当前通用机器人模型仅数十亿参数(π0.7 50亿、DreamZero 140亿),远小于 LLM,受实时性、成本、数据和网络约束;Jetson Thor 约为 GB200 的 1/10 FLOPs。
StepFun@StepFun_aiAI 评分2121
MiniMax Design (H3)@Hailuo_AIAI 评分1515引用Miora Design@Miora_DesignFinal call. Bestiary closes tonight, Sep 14 at 23:59 (PT). ⏳ $8,000 cash, 200,000 Credits, and ten Audience Choice awards are still on the table — and they go to the people who actually hit submit. One strange, beautiful short film, 30 seconds or longer, generated with MiniMax H3. Any myth, any era, any world you can dream up. The bestiary doesn't close itself. Finish your film before the clock runs out.
Mustafa Suleyman@mustafasuleymanAI 评分5858OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分2727 Fyxer 如何用 OpenAI 模型打造值得信任的 AI 行政助理
Fyxer 基于 OpenAI 模型、微调与记忆能力,并结合真实用户反馈,打造出能整理收件箱、以用户本人语气起草邮件的 AI 行政助理。