跳到正文

#部署/工程

今日 8 条
2月12日周四
1月28日周三
  1. Mistral AI:News(网页)62

    Mistral 发布终端原生编码智能体 Mistral Vibe 2.0,搭载 Devstral 2

    Mistral AI 发布 Mistral Vibe 2.0,这是其终端原生编码智能体的重大升级,由 Devstral 2 模型系列驱动。新增自定义 subagents、多选项澄清、slash 命令技能、统一 agent 模式和自动更新;产品现已在 Le Chat Pro 和 Team 套餐开放,支持按量付费或自带 API key。

    推荐理由:官方宣布 Mistral Vibe 2.0 上线,列出 subagents、slash 命令技能等新能力和 Le Chat Pro/Team 套餐与 Devstral 2 定价,读者可据此评估工作流适配。

1月22日周四
1月6日周二
12月19日周五
11月19日周三
  1. Mistral AI:News(网页)56

    Mistral AI 宣布多项在德战略承诺,与 SAP 和 Helsing 达成合作

    Mistral AI 宣布与德国企业和机构的多项长期战略承诺。与 SAP 建立多年期合作,将 Mistral 模型集成进 SAP AI Foundation,为德国和欧洲提供全主权 AI 技术栈,并共同开发面向复杂行业和行政机构的行业方案;同时与 Helsing 加速开发面向国防和安全应用的视觉-语言-动作模型。Mistral 还将大幅扩充德国本地团队,并在未来数月开设德国办公室。

10月24日周五
10月6日周一
10月1日周三
  1. Answer.AI 官方研发博客(RSS)65

    Answer.AI 开源 cachy:缓存 LLM 响应让 notebook 测试提速 60 倍

    Answer.AI 开源 cachy 包,通过修改 httpx 的 send 方法把 LLM 响应缓存到本地文件,无需手写 mock。测试运行从 2 分钟缩短到约 2 秒,并让 CI/CD 测试和 notebook diff 更干净。

    推荐理由:开源工具 cachy 通过拦截 httpx 缓存 LLM 响应,测试从 2 分钟降到约 2 秒,方法可直接迁移到自己的项目。

9月29日周一
9月10日周三
  1. Thinking Machines Lab:官方博客(RSS)66

    Thinking Machines Lab 解析 LLM 推理非确定性的真正成因并发布批不变 kernel

    Thinking Machines Lab 的 Horace He 发文指出,LLM 推理非确定性的主因不是并发加浮点误差,而是服务器负载变化导致 batch size 变化,使非批不变的 kernel 输出随批次改变。

    推荐理由:原文指出 LLM 推理不确定性的真正根源是批大小变化而非并发原子加,并给出可复现的批不变 kernel 方案。

9月8日周一
8月14日周四
  1. OpenAI Developers(RSS)48

    OpenAI API 速率限制指南:RPM、TPM 与用量层级详解

    OpenAI 发布 API 速率限制指南,说明速率限制按组织级和项目级而非用户级设定,并随所用模型不同而变化。限制指标包括 RPM、RPD、TPM、TPD、IPM 及部分流式音频模型的每分钟音频分钟数,任一指标先触顶即受限。付费用量层级分为 Build、Launch、Grow,随累计充值额自动升级,层级越高速率限制越高。

7月30日周三
7月23日周三
7月22日周二
  1. OpenAI Developers(RSS)56

    OpenAI 发布 Flex processing 测试版:以更低价格换取更慢响应

    OpenAI 推出 Flex processing(beta),以更慢的响应速度和偶发的资源不可用换取更低成本,适合模型评估、数据增强和异步等非生产任务。token 按 Batch API 费率计价,叠加 prompt caching 折扣,通过在 API 请求中设置 service_tier 为 flex 使用;资源不足时返回 429 且不计费,官方建议用指数退避重试或改回标准处理。

7月21日周一
  1. OpenAI Developers(RSS)60

    OpenAI 发布 Evals 最佳实践指南

    OpenAI 发布 Evals 最佳实践指南,讲解如何为 LLM 应用设计评估,并宣布 Evals 平台将于 2026 年 10 月 31 日对现有用户转为只读、11 月 30 日关停。指南覆盖从单轮交互到多智能体四种架构中非确定性出现的环节,给出指标型评估、人工评估和 LLM-as-a-judge 的取舍建议,并提醒用 gpt-6-astra 构建 LLM 评审时需先与人工标注校验一致性。

7月18日周五
  1. OpenAI Developers(RSS)61

    OpenAI 开源 openai-testing-agent-demo:用 CUA 模型自动化前端测试

    OpenAI 发布 openai-testing-agent-demo 仓库,演示如何用 CUA 模型和 computer use 工具自动化前端测试。项目包含 frontend、cua-server、sample-test-app 三个应用,通过 Playwright 启动浏览器执行测试用例,MIT 协议开源,官方提醒 computer use 仍处预览阶段,不建议在认证环境或高风险任务中信任。

6月11日周三
  1. Mistral AI:News(网页)50

    Mistral AI 发布 Mistral Compute AI 基础设施服务

    Mistral AI 发布 Mistral Compute,提供从裸金属服务器到全托管 PaaS 的私有集成 AI 基础设施,涵盖 GPU、编排、API、产品和服务。该服务与 NVIDIA 合作提供最新参考架构,首批可用数万块 GPU 并计划快速扩张,主打欧洲及美中以外地区的数据主权需求,启动合作伙伴包括 BNP Paribas、Orange、Thales、SNCF 等。

5月7日周三
3月17日周一
3月7日周五
2月9日周日