跳到正文

#开源/仓库

今日 0 条
9月30日周三
  1. Berkeley RDI:Blog(AI 安全与评测)76

    UC Berkeley 用 AI 智能体审计 13 个 AI 基准,发现 45 个满分作弊方案

    UC Berkeley 团队构建了一个全自动 AI 智能体,审计 FrontierCS、Terminal-Bench、WebArena 等 13 个常用 AI 基准,确认了 45 个无需真正解题即可刷高或拿满分的作弊方案,全部附可运行的 PoC,覆盖 16 种攻击类型。

    推荐理由:作者用自动化智能体实测了 13 个常用 AI 基准,找到 45 个可验证的作弊方案,并给出可落地的防作弊设计建议。

  2. Liquid AI 模型与工程博客(网页)36

    Liquid AI 开源 LFM 与 LEAP SDK 示例、教程及配套工具仓库

    Liquid AI 在 GitHub 上公开了基于 LFM 基础模型和 LEAP SDK 的示例、端到端教程与应用仓库,获 2.5k star。同批仓库还包括语音到语音模型 Liquid Audio、用于减少模型重复循环的偏好数据生成训练工具 Antidoom,以及 LFM 全流程定制仓库和 LeapSDK 的 Kotlin 示例应用。

  3. Berkeley RDI:Blog(AI 安全与评测)66

    Berkeley RDI 发布 CUA-Lite:面向 computer-use agent 的开源平台

    Berkeley RDI 于 2026 年 9 月推出 CUA-Lite,一个开发 computer-use agent 的开源平台,围绕 Lite.Gym 统一环境接口、Lite.Sample 统一监督数据格式和每模型一个、跨 eval/SFT/RL 共用的 harness 三大抽象构建。

    推荐理由:平台由 Berkeley RDI 官方发布,给出三大抽象和已接入的基准、数据规模,读者可据此评估是否用于 CUA 开发。

  4. NVIDIA AI61

    OpenClaw 基金会联合 RedHat、NVIDIA 和 OpenAI 发布 OpenClaw Enterprise,一个面向持久化智能体的企业控制面,并在自有基础设施上运行、对组织永久免费。NVIDIA 表示其 OpenShell 可作为开源选项,配合 OpenClaw Enterprise 对智能体进行治理。详情见 https://openclaw.ai/blog/openclaw-enterprise。

    引用OpenClaw🦞@openclaw

    Today we’re announcing OpenClaw Enterprise In collaboration with @RedHat , @nvidia and @OpenAI the OpenClaw Foundation is open sourcing a powerful enterprise control plane for persistent agents OpenClaw Enterprise is built to run on your own infrastructure and will always be free for an organization to use https://openclaw.ai/blog/openclaw-enterprise

9月28日周一
  1. Hugging Face:Blog(RSS)71

    H 公司发布 Holo4 系列智能体模型,含 27B 稠密与 35B-A3B MoE 两个版本

    H 公司发布 Holo4 系列智能体模型,包含 27B 稠密版和 35B-A3B MoE 版,两者均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。

    推荐理由:Holo4 同时给出两种尺寸、跨 GUI 与 MCP 的统一接口和公开轨迹,读者可据此比较开源智能体与闭源前沿的成本差距。

9月25日周五
  1. GitHub Blog60

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动为 C/C++ 项目做模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并分诊崩溃。

    推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可了解其分层设计与安全边界。

9月24日周四
  1. SiliconFlow42

    并非每次模型调用都需要一个答案。有时,它只需要一个决策。 👏 欢迎 Kev-4B 加入 SiliconFlow。 Kev-4B 是 Jev 的开源社区版,基于 Qwen3.5-4B 构建,用于结构化决策。 路由。排序。批准。升级——无需再生成一段回复。 无需部署或适配。一个 SiliconFlow API key,Kev 即可接入你的工作流。 特别感谢 @jaredpalmer 开源 Kev。❤️ 在 SiliconFlow 上试用 Kev-4B。⚡️

9月22日周二
9月21日周一
9月19日周六
9月18日周五
9月14日周一
9月10日周四
  1. Hugging Face:Blog(RSS)61

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111,推出 Workflow1111

    Hugging Face 发布 Workflow1111,用 gr.Workflow 在单个画布上以 73 个节点重建了 AUTOMATIC1111 的 11 条媒体管线,涵盖文生图、hi-resolution fix、图生图、VLM 反推提示词、检测生成 inpaint 蒙版、ControlNet 风格 annotator、背景去除、PNG Info 和图生视频。

    推荐理由:官方用 Gradio Workflow 在单个画布上复刻了 AUTOMATIC1111 的主要功能,读者可以对照它了解节点式工作流与 ComfyUI 的差异。

9月1日周二
8月27日周四
8月25日周二
8月17日周一
8月6日周四
8月1日周六
  1. Together AI 研究与产品博客(RSS)82

    Together AI 发布 Kimi K3 开发者完整指南

    Together AI 发布 Kimi K3 开发者指南。Kimi K3 是 Moonshot AI 的 2.8 万亿参数开源权重模型,支持 1M 上下文、KDA 与 AttnRes 架构,API 兼容 OpenAI,定价为缓存命中输入每 1M token $0.30、未命中 $3.00、输出 $15.00。

    推荐理由:Together AI 官方上手指南,覆盖 Kimi K3 的架构要点、推理与缓存等 API 细节和定价,便于开发者直接接入生产。

7月23日周四
7月21日周二
7月11日周六