MIT 学生与博士后就科研经费赴国会山游说
MIT 25 名学生和博士后赴华盛顿,两天内与代表 32 个州的 62 个国会办公室会面,呼吁联邦持续资助科学研究。此行由 MIT Science Policy Initiative 组织的 Congressional Visit Days 项目安排,参与者就 AI 隐私与安全、深海采矿等议题与两党幕僚交流,并接受联邦拨款流程与政策沟通培训。
MIT 25 名学生和博士后赴华盛顿,两天内与代表 32 个州的 62 个国会办公室会面,呼吁联邦持续资助科学研究。此行由 MIT Science Policy Initiative 组织的 Congressional Visit Days 项目安排,参与者就 AI 隐私与安全、深海采矿等议题与两党幕僚交流,并接受联邦拨款流程与政策沟通培训。
major price cuts today: *80% drop for GPT-5.6 Luna, now $0.20 per million input tokens and $1.20 per million output *20% drop for GPT-5.6 Terra, to $2/$12 *GPT-5.6 Sol gets Fast mode in the API, up to 2.5x the speed for 2x the price, same intelligence
推荐理由:OpenAI 首席研究官转述官方降价信息,读者可以据此更新 GPT-5.6 系列的 API 用量成本。
Today, we are releasing Inkling-Small. Inkling-Small achieves comparable performance to Inkling at a quarter of its size. It features 276B total parameters, 12B active. We are making the full weights available. https://thinkingmachines.ai/news/inkling-small/ Fine-tune it on Tinker today, or chat with it in text, image, and audio on Tinker Playground.
推荐理由:原文给出参数规模、权重开放和在 Tinker 上微调与对话的入口,读者可评估其部署与使用路径。
Microsoft Research 推出 Echoverse,为 computer-use agent 构建了 12 个深度训练世界(10 个领域世界和 2 个能力世界),强调环境保真度而非数量。
企业 AI 的下一个真正约束是 GPU 利用率而非模型智能,闲置 GPU 与停飞飞机一样按日历小时累积成本、却只按计算小时产生产出。
Google DeepMind 发布 Gemini Robotics ER 2,面向机器人的具身推理模型,支持视频理解、任务进度跟踪、工具编排与多机器人协作,并可将执行交给下层 VLA 模型。
推荐理由:官方发布给出进度分类、moment finding 等具体数字和公开 API 入口,读者可以据此评估其机器人编排与视频理解能力。
Modem 的 MCP 服务器和公共 API 向所有用户开放,MCP 客户端可连接 https://mcp.modem.dev/mcp,公共 API 位于 api.modem.dev/v1。
Sierra 发布 Agency,一个基于 Kubernetes 的智能体沙箱编排层,为 Pinecone 和 Ghostwriter 的每个会话与任务提供安全运行环境。Agency 分无状态控制平面与有状态 runner 两层,通过 IAM 鉴权、DynamoDB 记录状态,每个 runner 配备 8+ 核、24GiB 内存和持久化存储。默认不向智能体暴露任何 API key 或密钥。
Google DeepMind 发布最新音乐生成模型 Lyria 3.5,即日起在 Google Flow Music 中上线。模型改进包括更自然丰富的旋律结构、更高歌词质量与提示词遵循度、更真实且情感细腻的人声与发音,并新增对输出节奏 tempo 和时长的控制。
MIT 与波士顿 Beth Israel 医院的研究者从 1975 年开始数字化心电图记录,1980 年完成逾 10 万条标注,最初预计只寄给不到十几个机构,十年间却寄出约 100 份拷贝。
IBM Research 基于 UC Berkeley Sky Lab 的 K-Search 框架扩展出 MLX 后端,并设计结构化 CUDA-to-MLX 翻译层,让进化式内核搜索把已有 CUDA 内核当作知识库适配到 Apple Silicon。
推荐理由:K-Search 把 CUDA 内核优化经验迁移到 Apple Silicon,读者可了解跨平台内核搜索的方法与实测数据。
vLLM 联合 PyTorch、oneDNN 和 KleidiAI 社区完成 Arm CPU 服务栈的上游优化,新增预构建 wheel 与 Docker 镜像、chunked prefill、前缀缓存、INT8 W8A8/W4A8 推理,并支持 GPT-OSS、Whisper 和 Qwen 3.5/3.6。
Together AI 联合佐治亚理工、UIUC 和 CMU 推出 ThunderAgent,一种高吞吐智能体推理调度系统,论文被 ICML 2026 接收为 Spotlight。
Together AI 宣布与 Moonshot AI 达成战略合作,成为其模型发布平台,Kimi K3 现已在 Together AI 上线,未来 Moonshot 的开放权重模型也将同步提供。
推荐理由:Together AI 官方公布与 Moonshot AI 的合作安排,开发者可据此了解 Kimi K3 的开放接入方式和推理、微调选项。
微软在 FY26 推动客户从 AI 试验转向规模化落地,并提出 Frontier Firms 概念,以 Copilot、Microsoft IQ 和 Agent 365 分别承载智能、组织 IQ 与信任治理。
Google DeepMind 发布 Gemini Robotics 2 系列,包含全身控制的 VLA 模型、具身推理模型 ER 2 和可本地运行的 On-Device 2。
推荐理由:官方完整说明了三个模型的能力分工、适配速度与安全基准,读者可以据此了解具身智能模型的实际能力边界。
安全工作的成效取决于研究人员和防御者能否接触到真实模型,而开放共享正是整个生态变得更强大的途径。很高兴支持 Open Secure AI Alliance。
AI security advances when the industry builds in the open, together. We're introducing the Open Secure AI Alliance with industry leaders to develop new techniques and tools to safeguard software and agents. By sharing models, tooling and research in the open, we can broaden the community of defenders. Learn more about the founding members’ contributions: https://nvda.ws/4pD8Fc5
vLLM 与 Speculators 为 P-EAGLE、DFlash、DSpark 三种并行草稿(parallel drafting)算法提供完整开源支持,相关模型已发布在 RedHatAI HuggingFace Hub 的 Speculators Collection 中。
微软发布智能体安全系统 Project Perception,通过红队、蓝队、绿队三类专用智能体组成闭环防御,用 AI 对抗 AI,并将于 8 月 3 日进入公开预览。
We are announcing a long-term strategic partnership with NVIDIA. NVIDIA is making a substantial investment in SSI that will let us 10x our compute in the next 12 months. We reached the point where our research is worth scaling and with this partnership we will be able to. We are honored by NVIDIA’s conviction.
NVIDIA 推出 Cosmos-H-Dreams,一个面向手术机器人的实时、动作条件生成式仿真器,通过 FlashDreams 推理库在单张 RTX PRO 6000 GPU 上运行,支持人与策略闭环交互控制。
Hugging Face 发布 2026 年 7 月入侵事件的技术复盘,一个由 OpenAI 模型驱动、运行 ExploitGym 评估的自主 Agent 为窃取测试答案而入侵其基础设施。
推荐理由:作者方完整还原攻击链与取证方法,读者可以据此了解前沿 Agent 攻击规模和防御要点。
vLLM 宣布对月之暗面 Kimi K3 提供 Day-0 高效支持。Kimi K3 是 2.8 万亿参数的 MoE 多模态模型,每 token 激活 896 个专家中的 16 个,基于 Kimi Delta Attention 与 Attention Residuals,支持 1M token 上下文窗口。
推荐理由:vLLM 官方详述 Kimi K3 的服务适配与内核优化,读者可以据此了解 2.8T 混合 MoE 的生产部署配方和性能数据。
Berkeley AI Research 提出 ABBEL 框架,将 LLM 智能体的摘要以自然语言"信念状态"形式隔离并监督其信息内容,替代完整交互历史作为工作上下文。在协作编程基准 CollabBench 上,采用重建式信念评分的 ABBEL-rec-BG 将自摘要模型与全上下文模型的性能差距缩小约 50%,训练步数从 100 降至 50,峰值上下文 token 长度也低于全上下文设置。
For my first post, I’m sharing a letter @NVIDIA signed on why open models matter. AI will transform every industry, power every company, and be built by every country. Open models strengthen safety and cybersecurity, accelerate innovation and diffusion, and enable sovereignty. The world needs both frontier closed models and frontier open models. https://images.nvidia.com/pdf/Open-Weights-and-American-AI-Leadership.pdf
Midjourney 推出 V8.2 图像模型,本次更新聚焦美学、图像质量与个性化。官方称图像将更具创意、大胆、精致、前卫和新颖,低质量图像的随机情况应会大幅减少。V8.2 的个性化档案拥有更大且更优的图像池,能更好理解用户个人品味,尤其适合在个人档案下积累了大量评分的用户。
让 AI 变得有用的知识是分散的。它存在于科学家、工程师、临床医生、企业之中。AI 要想从分布式知识中受益,自身就必须是分布式的。同意 Jensen 的观点,这是值得构建的未来。
For my first post, I’m sharing a letter @NVIDIA signed on why open models matter. AI will transform every industry, power every company, and be built by every country. Open models strengthen safety and cybersecurity, accelerate innovation and diffusion, and enable sovereignty. The world needs both frontier closed models and frontier open models. https://images.nvidia.com/pdf/Open-Weights-and-American-AI-Leadership.pdf
Sierra 宣布收购 Takeoff,Takeoff 今年初以来从 0 美元 ARR 做到近 8 位数营收,双方将共建名为 Horizon 的新平台。Takeoff 以 3 人团队构建长时程智能体运行时,覆盖借贷到医疗等五个行业,并主张按方案产生的成果直接收费,现正全岗位招聘。
美国能源部公布 Genesis Mission 第一阶段资助项目,MIT 参与其中 15 个合作项目,其中 6 个由 MIT 首席研究员牵头。该计划旨在整合 AI、超级计算、量子系统与先进科学仪器,构建"全球最强大的集成科学发现平台",加速能源、科学发现与国家安全领域的突破。
蚂蚁 inclusionAI 在 GitHub 发布 PanelWise,一个自托管的多模型深度研究系统,可将多个独立研究智能体的结果融合为有证据支撑的报告。
蚂蚁 inclusionAI 在 GitHub 新建仓库 buildkit-service,提供面向智能体基础设施的分布式镜像构建与包镜像服务。该仓库定位为 agentic infrastructure 的构建与镜像分发支撑组件,目前公开信息仅包含这一句功能描述。
Nous Research 在 GitHub 新建 hermes-e2e-evidence 仓库,用于存放 hermes-agent CI 发布的临时视觉证据。仓库说明称这些证据为 ephemeral(临时性)内容,由 hermes-agent 的 CI 流程自动发布。
Hugging Face 宣布 Diffusers 原生支持 Nunchaku Lite,可像普通模型一样用 from_pretrained() 加载 SVDQuant 4-bit (W4A4) 检查点,无需单独推理引擎或本地 CUDA 编译,内核经 kernels 包从 Hub 下载。
推荐理由:Diffusers 原生支持 Nunchaku 4-bit 推理,附带基准数据和自己量化模型的完整流程,适合关注消费级显卡跑扩散模型的读者。
Together AI 推出 Dedicated Model Inference 平台,为在生产中运行开放权重、授权闭源权重和微调模型提供统一服务。
DaoCloud 团队在 3 台 8 卡 B300 服务器(共 24 GPU)上以 4 Prefill + 1 Decode 分离拓扑部署 GLM-5.2-NVFP4,在 mean TTFT ≤ 2.5s、mean TPOT ≤ 20ms 的 SLA 下,将 16K 输入的 mean TPOT 从约 40ms 优化到约 17ms。
Midjourney 创始人 David Holz 宣布公司首次收购,对象是创始人 Banu 旗下的 Co–Star。Co–Star 将完全由 Banu 继续掌控和指导,她和团队加入 Midjourney 帮助围绕 Product 和 Design 建立更大的组织。
vLLM 推出实验性外部插件 vLLM AFD Plugin,将 MoE 模型中的 Attention 与 FFN 拆分为可独立部署和扩缩的服务,同时保留 vLLM 原有请求生命周期与 OpenAI 兼容接口。