跳到正文

#产品更新

今日 75 条
8月19日周三
8月18日周二
8月17日周一
  1. Together AI 研究与产品博客(RSS)51

    Together AI 推出端点级 LLM A/B 测试功能

    Together AI 在平台上推出端点级 LLM A/B 测试功能,让团队用真实用户流量比较候选模型与现网模型,而非只看 benchmark 或影子流量。实验挂在端点上,须有一个 control 和一至多个 variant,variant 部署权重须为 0,百分比为固定流量份额且与副本数无关。

8月14日周五
8月13日周四
8月12日周三
  1. Sierra:Blog(RSS)29

    Sierra 谈 Horizon 智能体:跟进就是成交

    Sierra 称其 Horizon 智能体可为每位潜在客户配备一名 AI 智能体,持续数天、数周甚至数月主动跟进,直到客户购买或放弃。文中以车险为例,AI 智能体 Jamie 在客户保存报价后当晚即发短信,第 4 天解答保险条款问题,第 7 天完成通话并促成保单购买。Sierra 表示该智能体遵循企业合规要求,沟通内容由企业控制。

  2. Meta Engineering Blog(RSS)56

    WhatsApp 推出端侧 Scam Alert 功能,在端到端加密下实现可验证的诈骗提醒

    WhatsApp 推出可选的 Scam Alert 功能,在设备端运行机器学习模型,对非联系人消息进行诈骗概率分类,消息内容不出设备、不自动上报。模型下载经 Cloudflare Ed25519 签名与第三方 append-only 透明账本校验,遥测数据经 TEE、OHTTP 与差分隐私聚合处理;该功能已在 Beta 有限推出,并扩展了 Bug Bounty 计划。

8月11日周二
  1. Sierra:Blog(RSS)50

    Sierra 为 Agent 推出开箱即用的 IVR 电话导航能力

    Sierra 宣布其平台上的 Agent 可开箱即用地导航复杂的 IVR 电话系统,官方评测中整体通过率从 57% 提升至 85%,增幅约 49%。该能力覆盖通话时机、多级菜单、DTMF 按键音、静默处理和识别真人,配合记忆与智能重试逐步提升成功率;已有医疗支付方、数字药房和收入周期管理公司在使用,文章还展望了 Agent 可信身份认证的长期方向。

  2. Mistral AI:News(网页)60

    Mistral 推出区域推理端点与优先级层,并接入第三方开源模型 GLM-5.2

    Mistral 宣布三项推进 AI 主权的举措:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键业务负载提供自定义速率限制和带 SLA 的可用性承诺。

    推荐理由:Mistral 把区域推理端点、SLA 优先级层与第三方开源模型接入放在同一套基础设施上,读者可据此判断主权 AI 的落地方式。

  3. Kimi.ai37

    Kimi K3 现已在 @databricks 上线!

    引用Databricks@databricks

    Moonshot AI's latest open-weight model, Kimi K3, is now available on Databricks through Unity AI Gateway. @Kimi_Moonshot Run Kimi K3 where your data already lives - governed, secure, and ready for custom AI apps and agents built with the data in your Lakehouse. Unity AI Gateway lets you deploy Kimi K3 with enterprise-grade access controls. Govern every call, monitor performance, and scale securely across your AI apps. Test Kimi K3 alongside other frontier models without changing your application code. The open-weight frontier just arrived on Databricks. Try it today. https://www.databricks.com/blog/kimi-k3-moonshot-ai-now-available-databricks-through-unity-ai-gateway

8月8日周六
  1. Sierra:Blog(RSS)44

    Sierra 推出 Voice Personas:为 AI 智能体打造品牌专属语音人格

    Sierra 发布 Voice Personas,让企业为同一个 AI 智能体配置不同语音人格,覆盖多语言、多品牌与多市场场景。该功能结合语音、个性与语言感知行为,并接入 Sierra Agent SDK,支持调整语速、应对打断及对话中切换语音或语言。Sierra 称某智能体搭配自然语音与人格后问题解决率提升近 50%,Voice Personas 现已上线。

8月6日周四
8月5日周三
  1. Google Cloud:Databases(RSS)30

    Target 如何用 Spanner Graph 提升零售发现体验并将数据库维护成本降低 50%

    Target 基于 Spanner Graph 构建企业本体,将图关系、向量嵌入、全文检索与事务数据统一到同一数据库引擎,替代原有 Elasticsearch 加 NoSQL 的碎片化架构。迁移采用零停机四阶段方案,完成后下线旧 Elasticsearch 集群,数据库维护成本降低 50%。该平台为 Gift Finder 等对话式购物助手提供结构化上下文,支撑 GraphRAG 式商品发现。

8月4日周二
8月3日周一
7月31日周五
  1. Mark Chen81

    OpenAI 宣布 GPT-5.6 系列降价与功能更新:GPT-5.6 Luna 输入价格降至 $0.20 per million tokens、输出 $1.20,降幅 80%;GPT-5.6 Terra 降价 20% 至 $2/$12;GPT-5.6 Sol 在 API 中新增 Fast mode,速度最高提升 2.5x,价格为 2 倍,智能水平不变。Mark Chen 评论称这是迈向"便宜到无需计量"的智能的又一步。

    引用Sam Altman@sama

    major price cuts today: *80% drop for GPT-5.6 Luna, now $0.20 per million input tokens and $1.20 per million output *20% drop for GPT-5.6 Terra, to $2/$12 *GPT-5.6 Sol gets Fast mode in the API, up to 2.5x the speed for 2x the price, same intelligence

    推荐理由:OpenAI 首席研究官转述官方降价信息,读者可以据此更新 GPT-5.6 系列的 API 用量成本。

  2. Google Cloud:Databases(RSS)38

    AlloyDB 新增 IAM 群组认证,为 AI 智能体提供安全访问

    Google Cloud 为 AlloyDB 推出 IAM 群组认证预览版,将身份驱动的访问控制引入企业级工作负载,并与 Cloud SQL 统一安全策略。该功能支持定义最多 200 个 Google Groups,让 AI 智能体传递终端用户身份,使数据库按用户权限授权并记录精确审计日志。Bilt 已采用该方案消除共享凭证风险。

7月30日周四
  1. Sierra:Blog(RSS)48

    Sierra 推出 Agency:为 AI 智能体打造安全可扩展的沙箱基础设施

    Sierra 发布 Agency,一个基于 Kubernetes 的智能体沙箱编排层,为 Pinecone 和 Ghostwriter 的每个会话与任务提供安全运行环境。Agency 分无状态控制平面与有状态 runner 两层,通过 IAM 鉴权、DynamoDB 记录状态,每个 runner 配备 8+ 核、24GiB 内存和持久化存储。默认不向智能体暴露任何 API key 或密钥。

7月28日周二
7月27日周一
  1. vLLM 官方博客(RSS)72

    vLLM 发布 Kimi K3 Day-0 支持,2.8T MoE 模型最高 370 tok/s

    vLLM 宣布对月之暗面 Kimi K3 提供 Day-0 高效支持。Kimi K3 是 2.8 万亿参数的 MoE 多模态模型,每 token 激活 896 个专家中的 16 个,基于 Kimi Delta Attention 与 Attention Residuals,支持 1M token 上下文窗口。

    推荐理由:vLLM 官方详述 Kimi K3 的服务适配与内核优化,读者可以据此了解 2.8T 混合 MoE 的生产部署配方和性能数据。

7月23日周四
  1. Hugging Face:Blog(RSS)69

    Diffusers 原生集成 Nunchaku Lite 4-bit 扩散模型推理

    Hugging Face 宣布 Diffusers 原生支持 Nunchaku Lite,可像普通模型一样用 from_pretrained() 加载 SVDQuant 4-bit (W4A4) 检查点,无需单独推理引擎或本地 CUDA 编译,内核经 kernels 包从 Hub 下载。

    推荐理由:Diffusers 原生支持 Nunchaku 4-bit 推理,附带基准数据和自己量化模型的完整流程,适合关注消费级显卡跑扩散模型的读者。