跳到正文

全部动态

今日 56 条
6月19日周五
  1. Saining Xie25

    🫡 创始人模式下的品味

    引用David@DavidSHolz

    @scaling01 i actually filmed and edited the video myself 😅 also implemented the 3d visualization technical deep dive, it all runs in a browser in realtime!

6月17日周三
  1. Together AI 研究与产品博客(RSS)53

    Together AI 实测 Kimi K2.7 Code 与 Claude Fable 5 生成落地页,成本约低94%

    Together AI 让 Kimi K2.7 Code 和 Claude Fable 5 各生成12个落地页对比,Kimi 平均比 Fable 便宜约16倍、比 Opus 便宜约8倍,整体成本低约94%,质量接近但评分略低。通过自定义 MCP 服务器提供截图和设计参考,Kimi 生成的页面层级、排版和构图明显改善,所有页面及成本、token 用量和生成时间明细已发布在 OVSC 网站。

  2. Dwarkesh Patel:Podcast & Blog(RSS)43

    Ada Palmer:马基雅维利是有史以来最被误解的思想家

    历史学家 Ada Palmer 在 Dwarkesh Patel 播客中称马基雅维利是史上最被误解的思想家。她讲述马基雅维利曾任佛罗伦萨高级外交官,1513 年美第奇家族重掌佛罗伦萨后将其解职、拷打并流放,他随后写下《君主论》献给洛伦佐·迪·皮耶罗·德·美第奇。Palmer 还推出新播客,首季主题即为马基雅维利。

6月13日周六
  1. Sierra:Blog(RSS)29

    Sierra 博客:AI 在客户体验(CX)中的可能性探索

    Vivid Seats 上线 AI 客服不到四周,问题解决率提升 40%、客户满意度提升 35%,CX 团队从处理排队转向根因修复和产品洞察。Wilson 的 AI 智能体可追问身高与偏好来推荐手套等具体产品,Minted 则用 AI 打通各客户平台识别趋势。Sierra 博客称客户对话正从成本项变为产品改进与业务增长的洞察来源。

6月11日周四
6月10日周三
  1. Andrej Karpathy76

    Anthropic 发布 Claude Fable 5,作者称其与 Mythos 为同一底层模型但增加了安全护栏,基准几乎全面 SOTA。他认为质变程度堪比去年 11 月的 Claude 4.5,尤其擅长长程难题求解,但护栏目前过于敏感;软件唾手可得令他的软件需求大增(Jevon 悖论)。

    引用Claude@claudeai

    Fable 5 is state-of-the-art on nearly all tested benchmarks, with exceptional performance in software engineering, knowledge work, scientific research, and vision. The longer and more complex the task, the larger Fable 5’s lead over our other models.

    推荐理由:作者补充了基准之外的第一手使用感受,指出长难题求解能力跃升和安全护栏偏敏感,可作选型参考。

  2. Ethan Mollick:One Useful Thing(RSS)79

    Ethan Mollick 试用了首个 Mythos 级模型 Claude 5 Fable 后谈协作体验

    Ethan Mollick 分享了他提前试用首个面向公众发布的 Mythos 级模型 Claude 5 Fable 的体验,认为其明显超越此前所有模型,单个提示词即可连续工作最多十二小时执行多页规格。

    推荐理由:作者以亲历测试描述使用感受与局限,给出了可验证的工作时长、成本和黑盒化体验等一手细节。

6月9日周二
6月8日周一
6月6日周六
6月5日周五
  1. Ethan Mollick:One Useful Thing(RSS)61

    Ethan Mollick 宣布新书《Co-Existence》10月20日出版,探讨与有时比你强的 AI 共处

    Ethan Mollick 宣布新书《Co-Existence》将于 10 月 20 日出版,主题是如何与有时但并非总是比你强的 AI 协作,现已开放预购。他自述每章草稿均亲自撰写,用 AI 做读者反馈和事实核查;新书网站用 Claude Code(Opus 4.8)几分钟建成,并专门为 AI 智能体提供版本,还用 OpenAI Codex 对多个模型做了 A/B 测试。

  2. Dwarkesh Patel:Podcast & Blog(RSS)43

    Dwarkesh Patel 对话 Alex Imas 与 Phil Trammell:AGI 之后什么仍然稀缺?

    Google DeepMind AGI 经济学总监 Alex Imas 与 Epoch 经济学负责人 Phil Trammell 在 Dwarkesh Patel 播客中讨论 AGI 时代的经济学问题。Imas 认为,人类参与本身构成价值来源的"关系型部门"仍将稀缺,因为人类天然稀缺。两人还探讨了如何对 AI 财富征税与再分配、发展中国家如何参与 AI 供应链收益,以及资本份额是否会上升。

6月4日周四
6月1日周一
5月30日周六
  1. Steve Yegge:Medium(RSS)69

    Steve Yegge:技术面试正在消亡,campfire 模式将取而代之

    Steve Yegge 撰文称运行了约50年的技术面试流程正在走向消亡,AI 辅助简历、AI 作弊和岗位快速变化正让传统评估体系失效。他结合在 Amazon 担任 Bar Raiser 和 Google 招聘委员会的经历指出面试结果统计上很差,主张用实习、co-op 等临时雇佣以及他称为 campfire 的付费真实工作试用替代面试,并让候选人的工作成果形成可携带的记录。

5月27日周三
  1. Ethan Mollick:One Useful Thing(RSS)68

    Ethan Mollick 谈选择保持人类思考,AI 使用应有意而非默认依赖

    Ethan Mollick 撰文讨论 AI 无处不在的写作与认知投降风险,指出无脑依赖 AI 会削弱思考与学习。他引用土耳其约千名高中生的实验,用普通 ChatGPT 做作业的学生考试成绩反而低于无 AI 组;而台北十所高中近千名学生的 Python 课程中,AI 导师个性化出题让学生在无 AI 期末考试中高出 0.15 个标准差,相当于六到九个月额外学业。

    推荐理由:作者结合多项实验研究和自身写作经验,分析了默认依赖 AI 如何导致认知投降,并给出学习场景下避免捷径的具体做法。

5月26日周二
5月25日周一
5月23日周六
5月21日周四
  1. AI as Normal Technology(RSS)45

    AI 风险是否需要政府非常规干预?——对 Derek Thompson 观点的回应

    针对 Derek Thompson 主张 AI 的涌现能力使其区别于以往技术、需政府以限制企业发布等"非常规"手段应对,AINT 一文提出反驳:非常规干预具有预防性、波及非直接责任方、绕开常规治理程序三大特征,门槛应更高。文章主张以分布式韧性建设替代依赖单一卡点的 AI 不扩散方案,并指出联邦政府僵化使非常规干预看似更有吸引力。

5月18日周一
5月17日周日
  1. Dwarkesh Patel:Podcast & Blog(RSS)48

    Dwarkesh Patel:将智能与权力混为一谈的错误

    Dwarkesh Patel 指出,把智能定义为"跨领域达成目标的能力"实际上等同于把智能等同于权力,按此定义斯大林将是史上最智能的人。他认为当前 AI 通过训练在编程等具体经济任务上变强,与获取权力并非强相关,现实中的权力更多来自权威与信任带来的大规模协作,而非个体谋略。他判断未来是自动化公司以正常资本主义方式胜过其他竞争者,而非单一 AI 在智力上碾压所有人。

5月16日周六
5月15日周五
5月12日周二
  1. Andrej Karpathy65

    Andrej Karpathy 分享技巧:在查询末尾要求 LLM "structure your response as HTML",再用浏览器查看生成的文件,也可要求输出为幻灯片。他进一步提出,音频是人类偏好的输入而视觉是 AI 偏好的输出,输出形式将从文本、markdown 演进到 HTML,最终可能是扩散神经网络直接生成的交互式视频;输入端还缺少指向屏幕等交互方式。

    引用Thariq@trq212

    http://x.com/i/article/2052796100608974848

5月11日周一
  1. Import AI48

    Import AI 456:RSI 与经济增长、AI 监管的“激进可选性”与神经计算机

    Institute for Law & AI 提出“激进可选性”监管思路,主张政府短期避免过度监管,同时提前建设信息收集、举报人保护、评估与人才等制度工具,以应对 AI 可能带来的剧烈冲击。Meta 与 KAIST 的论文提出 Neural Computer,试图用神经网络在学习到的运行时状态中统一计算、内存与 I/O。

5月8日周五
5月4日周一
5月1日周五
4月24日周五
4月11日周六
  1. Sam Altman:Blog(RSS)65

    Sam Altman 发文回应住宅遭燃烧瓶袭击,谈 AI 信念与行业反思

    Sam Altman 发文称前夜凌晨 3:45 有人向其住宅投掷燃烧瓶,无人受伤,他公开家庭照片希望劝阻下次袭击。文章阐述他对 AI 的信念,包括 AI 需民主化、权力不应过度集中于少数 AI 实验室、需要全社会层面的安全应对;回顾在 OpenAI 十年中的失误与对与 Elon 诉讼前拒绝其单方控制权的坚持,并称业内戏剧化冲突源于'看见 AGI 后无法忽视'的掌控欲,呼吁降降温、在民主程序内辩论。

4月8日周三
4月7日周二
  1. Together AI 研究与产品博客(RSS)25

    什么是 AI Native Cloud?

    Together AI 提出 AI Native Cloud 概念,指围绕 AI 全生命周期(预训练、微调、评估、大规模推理)垂直整合的云平台,而非为 Web 应用优化的传统 CPU 云。其核心特征包括从 GPU、NVLink/RDMA 高速互联到训练与推理框架的统一全栈,以及持续吸收前沿研究、快速将研究转化为生产的能力。

4月6日周一
4月1日周三
3月31日周二
3月17日周二