跳到正文

推理能力

模型推理能力的进展:思维链、推理模型、数学与逻辑基准的突破与争议。

最新精选

第 101–103 条 · 共 103 条
10月29日周四
6月24日周日
  1. Lilian Weng:Lil'Log(RSS)66

    Lilian Weng 长文解读深度学习中的注意力机制:从 Seq2Seq 到 Transformer 与 Self-Attention GAN

    Lilian Weng 在 Lil'Log 发表注意力机制综述教程,从 seq2seq 的定长上下文向量缺陷讲起,解释注意力如何解决长句遗忘问题,并给出 Content-base、Additive、Scaled Dot-Product 等多种对齐分数函数的汇总表。

    推荐理由:原文系统梳理了注意力机制从 seq2seq 到 Transformer 的各种形式与对齐分数函数,适合作为理解后续模型架构的基础参考。

2月19日周一
  1. Lilian Weng:Lil'Log(RSS)62

    Lilian Weng 长文梳理强化学习核心概念与经典算法

    Lilian Weng 在 Lil'Log 发布强化学习综述教程,从智能体与环境交互的基本概念讲起,覆盖 MDP、Bellman 方程、动态规划、蒙特卡洛方法。

    推荐理由:文章系统梳理了强化学习的核心概念与经典算法,从动态规划到策略梯度再到 AlphaGo Zero,适合作为入门起点。