跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

231条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 221–231 条 · 共 231 条
5月25日周二
  1. Hugging Face:Blog(RSS)62

    Gradio 2.0 发布:1 行代码为 Hugging Face 模型创建 GUI

    Gradio 2.0 发布,可用 1 行代码加载并使用 Hugging Face Model Hub 上超过 10,000 个模型并生成 GUI。默认走 Hugging Face 托管 Inference API(可自带 API key 或无 key 公共访问),也可 pip install transformers 在本地运行模型。

    推荐理由:原文给出用 1 行代码为 Hugging Face 模型搭 GUI 的方法,还支持多模型并行或串联组合,可直接上手复用。

3月31日周三
  1. Hugging Face:Blog(RSS)63

    Hugging Face 解读 BigBird 的块稀疏注意力机制

    Hugging Face 发布长文解读 BigBird 的块稀疏注意力,说明其如何用全局、滑动和随机三种注意力近似 BERT 的全注意力,从而以更低计算成本处理最长 4096 的序列。

    推荐理由:原文用伪代码和图示拆解 BigBird 的全局、滑动、随机三种注意力,读者可以借此理解块稀疏注意力的实现细节。

2月9日周二
1月19日周二
2月14日周五
  1. Hugging Face:Blog(RSS)64

    Hugging Face 教程:用 Transformers 和 Tokenizers 从零训练一个世界语语言模型 EsperBERTo

    Hugging Face 发布教程,演示用 transformers 和 tokenizers 从零训练 84M 参数的 RoBERTa 风格模型 EsperBERTo,并微调到世界语词性标注任务。

    推荐理由:Hugging Face 官方教程完整走通从语料、分词器到预训练和下游微调的全流程,步骤和代码可直接复用到其他低资源语言。

8月20日周二
  1. OpenAI:官网动态(RSS · 排除企业/客户案例)75

    OpenAI 发布 774M 参数版 GPT-2 并公开模型共享协议

    OpenAI 发布 774M 参数的 GPT-2 语言模型,此前已分别于 2 月发布 124M 小模型、5 月分阶段发布 355M 中模型,并与合作伙伴及 AI 社区研究了模型的潜在滥用与社会效益。同时发布一份开源法律协议,便于机构间建立模型共享合作,并发布技术报告,总结与 AI 研究社区协调发布规范的经验。

    推荐理由:OpenAI 官方说明分阶段放行 774M 模型的决策依据,并附上模型共享协议与发布规范报告,可了解其审慎发布策略。

11月8日周四
  1. OpenAI:官网动态(RSS · 排除企业/客户案例)66

    OpenAI 发布深度强化学习教育资源 Spinning Up in Deep RL

    OpenAI 发布 Spinning Up in Deep RL,一个面向大众的深度强化学习教育资源,目标是让任何人学会成为熟练的深度强化学习实践者。资源包含清晰的 RL 代码示例、教学练习、文档和教程。

    推荐理由:OpenAI 官方推出的深度强化学习教育资源,包含代码示例、练习和教程,适合想系统入门该领域的读者。

5月25日周五
  1. OpenAI:官网动态(RSS · 排除企业/客户案例)63

    OpenAI 发布完整版 Gym Retro 强化学习游戏平台

    OpenAI 发布完整版 Gym Retro,一个用于游戏强化学习研究的平台。公开游戏数量从约 70 款 Atari 游戏和 30 款 Sega 游戏扩展到超过 1,000 款,覆盖多种底层模拟器,并同时发布了用于向平台添加新游戏的工具。

    推荐理由:原文给出游戏数量从约百款扩到超千款的具体变化,并附添加新游戏的工具,便于研究者评估平台适用性。

7月20日周四
  1. OpenAI:官网动态(RSS · 排除企业/客户案例)75

    OpenAI 发布强化学习算法 Proximal Policy Optimization(PPO)

    OpenAI 发布一类新的强化学习算法 Proximal Policy Optimization(PPO),性能与当时最先进方法相当或更好,且实现和调参更简单。凭借易用性和良好表现,PPO 已成为 OpenAI 的默认强化学习算法。

    推荐理由:原文说明 PPO 性能可比肩或超过 SOTA 方法且更易实现调参,读者可据此了解它为何成为 OpenAI 默认强化学习算法。

12月5日周一
4月27日周三
  1. OpenAI:官网动态(RSS · 排除企业/客户案例)74

    OpenAI Gym 公开测试版发布

    OpenAI 发布 OpenAI Gym 公开测试版,这是一个用于开发和比较强化学习(RL)算法的工具包。它包含一套持续扩充的环境(从模拟机器人到 Atari 游戏),并提供一个用于比较和复现结果的网站。

    推荐理由:OpenAI 官方发布强化学习算法开发与比较工具包的公开测试版,读者可据此了解其环境套件与结果复现机制。