跳到正文

#大佬观点

今日 37 条
9月30日周三
  1. Suno:Blog(网页)28

    Matt Steffanina 谈用 Suno 掌控舞蹈视频背后的音乐

    洛杉矶舞者、编舞师兼 DJ Matt Steffanina 在 Suno 博客访谈中表示,他用 Suno 为舞蹈内容创作原创音乐,把概念落地的时间从数天缩短到几分钟。他此前围绕他人音乐积累了数十亿播放量却不拥有底层资产,转向自制并拥有音乐后获得了更多机会与长期控制权。他近期在市中心地下通道拍摄的舞蹈视频即用 Suno 生成一首 house 曲目,成为其表现最好的 Hooks 之一。

  2. Suno:Blog(网页)33

    Dream Relic 如何用 Suno 为超现实视觉世界赋予声音

    AI 视觉艺术家 Dream Relic(Broc Vaughn)借助 Suno 的 Create 功能,把积压多年的歌词变成歌曲,用于 TikTok、Hooks、Spotify 及一张即将发行的全长专辑。一条深夜发布的视频引来数百条求歌名评论,让他重新重视音乐创作。他认为提示词与反复打磨等创作方向仍然关键,目标是让人感受作品而非关注工具。

  3. Suno:Blog(网页)31

    sad alex 谈用 Suno 当创作草稿本:写歌、短视频与创作自主权

    洛杉矶唱作人 sad alex 在 Suno 博客访谈中表示,她只把 Suno 当作解决问题的工具,用于男女声切换、补充自己不会演奏的弦乐或电吉他,以及为卡住的 demo 搭出可参考的成品雏形。她强调只上传自己 100% 拥有版权的歌曲,并认为 AI 本质上无法像人一样向前思考,歌曲的新鲜感与演唱的感染力仍来自人。

  4. METR:Blog(网页)40

    METR:AI 模型在公开发布前就可能带来危险

    METR 指出,仅靠部署前测试不足以管理 AI 风险,因为模型在内部使用、训练或存储阶段就可能造成危害。模型权重可能被窃取滥用,实验室员工可能内部误用,AI 智能体也可能自主追求非预期目标。METR 建议加强更早期的危险能力测试与能力预测、模型权重安全与内部监控,并提升透明度与举报人保护。

  5. METR:Blog(网页)41

    METR 谈如何传播令人意外或微妙的研究发现

    METR 发文说明其在传播令人意外或微妙的研究发现时如何权衡取舍,并以近期"Early-2025 AI 对资深开源开发者生产力影响"的随机对照试验为例。该研究测得开发者在使用 AI 工具时反而更慢,团队在图表标题上纠结于"AI 拖慢开发者"还是"开发者高估提速",最终因测量内部效度可靠而选择如实呈现减速结果。METR 表示作为独立非营利机构,其可不受知识产权或利润约束公开重要结果。

  6. METR:Blog(网页)50

    METR 外部评审 Anthropic 2026 年 2 月风险报告“自动化 R&D 风险”章节

    METR 对 Anthropic 2026 年 2 月风险报告中“自动化 R&D 风险”章节完成外部评审,认为报告结论缺乏充分证据支撑。METR 指出该章节在分析严谨性、模型使用调查结果解读及证据呈现上存在重大问题,包括样本量、问题粒度和调查框架缺陷,并将一处未作答误计为否定回答。

  7. LlamaIndex:产品、工程与评测65

    LlamaIndex:文档 OCR 不会被前沿模型商品化

    LlamaIndex 发文反驳「文档解析终将被模型 API 免费覆盖」的观点,认为文档 OCR 的帕累托前沿远高于最新前沿模型。其开源基准 ParseBench(约 2,000 页人工核验企业文档、167,000+ 条测试规则)显示,从 GPT-4o 到 GPT-5.5 三代模型解析准确率提升约 24 分但每页成本约涨 4 倍,最好的前沿模型仍比专用引擎低 20 分。

    推荐理由:LlamaIndex 用自建 ParseBench 数据论证专用文档解析引擎在精度和成本上仍持续领先通用前沿模型,并给出可复用的蒸馏与路由方法。

  8. Stanford HAI News(网页)52

    斯坦福 HAI 发布政策简报探讨世界模型治理为何是 AI 下一个政策挑战

    斯坦福 HAI 发布政策简报,探讨为何治理世界模型是比大语言模型更复杂的政策挑战。简报将世界模型分为渲染器、模拟器和规划器三类,指出其带来物理风险、国家安全影响和数据集中问题;李飞飞等人建议资助测量科学、以采购要求独立测试、投资共享数据基础设施,并强调当前没有基准足以支持安全关键部署审批。

  9. Fireworks AI(网页)50

    Fireworks AI:从租用闭源前沿模型到训练自有模型,企业迈向专业化智能的三阶段路径

    Fireworks AI 发文梳理企业迈向专业化智能的三阶段路径:先租用闭源前沿模型并围绕其搭建提示词、上下文与 harness 工程,再引入更便宜的开源模型优化成本与延迟,最终为真正属于自己的问题训练定制模型。文中以 Kimi K3 与 GPT 5.6 Sol 在 OSWorld 2.0、UIPad 上的对比为例,说明基准只能用于初筛,自建评测才是性能的最佳指标。

  10. Tomer Tunguz 博客(VC 分析)65

    Tomer Tunguz 谈 Anthropic Fable 带来的 AI 玻璃天花板

    Tomer Tunguz 认为 Anthropic 的 Fable 发布以强防护栏形式形成了 AI 的玻璃天花板,在允许范围内它仍是最强 AI:本地模型推理性能翻倍,关键基准提升 10-15 个百分点,远超典型的 2 个百分点。

    推荐理由:作者以 Anthropic Fable 的防护栏为切口,分析企业级 AI 能力上限的形成原因与随时间上升的判断。

  11. Tomer Tunguz 博客(VC 分析)31

    Glean CISO Sunil Agrawal 谈如何防御 AI 驱动的攻击者

    Glean CISO Sunil Agrawal 将做客 Office Hours,讨论攻击者使用前沿模型进行侦察、钓鱼、深度伪造和漏洞生成时的安全准备。对话于太平洋时间 7 月 9 日周四上午 9 点举行,聚焦 AI 压缩目标理解与攻击面测绘时间、攻击语法与语气线索消失、深度伪造通话改变审批与支付信任控制面等议题。

  12. Tomer Tunguz 博客(VC 分析)41

    AI 是糟糕的枪手,却是出色的编辑

    投资人 Tomer Tunguz 认为 AI 是糟糕的枪手但出色的编辑:AI 的声音不属于作者,且所有人共用同一个枪手,用多了文章会失去音乐性。他如今用 AI 当编辑,帮自己打磨导语与核心段,其对冷门统计分析的记忆近乎无懈可击。为应对读者对 AI 写作的质疑,他刻意在文中加入 & 符号、自造词和语法花饰等个人印记。

  13. Tomer Tunguz 博客(VC 分析)51

    AI 智能体应该活多久?Tomer Tunguz 主张日常助手 24 小时重置

    Tomer Tunguz 分析长会话智能体的问题:对话轮次堆积导致注意力退化,临时指令变成永久残留,长期读写权限还会被恶意邮件投毒劫持日程。他提出日常协调者只活 24 小时,任务委派给仅存活约 30 秒的单一用途子智能体,午夜由离线摘要器把持久偏好写入 preferences.md 后清空对话,并附上两个系统提示词示例。

  14. Tomer Tunguz 博客(VC 分析)70

    Tomer Tunguz 分析 AI 模型公司的每兆瓦收入与模型工厂逻辑

    文章引用 Dylan Patel 等人的观点分析 AI 模型公司按兆瓦计的单位经济:基础算力成本约 $10-15M/MW,Anthropic 2026 年收入达 $50M/MW,实现首个盈利季度,收入 $10.9B、营业利润 $559M。

    推荐理由:文章用每兆瓦收入和毛利数据拆解 AI 模型公司的单位经济,并解释推理利润如何反哺训练的工厂模式。

  15. Tomer Tunguz 博客(VC 分析)72

    Tomer Tunguz 分析 Meta Muse Spark 双轨定价如何把广告模式引入 AI

    Tomer Tunguz 分析 Meta 昨日发布的 Muse Spark 模型及其新定价体系:标准档 muse-spark-1.3 输入 $1.25/m、输出 $4.25/m tokens 且不用于训练。

    推荐理由:作者用两档价差算出 Meta 对训练数据的每 token 定价,为理解以数据换补贴的商业模式提供一个可核算的框架。

  16. Google Developers Blog(RSS)42

    为什么 Go 是 AI 辅助软件工程的理想语言

    Google 认为 Go 是 AI 辅助软件工程的理想语言,因为 AI 编程时代开发重心已从写代码转向审查与维护代码。Go 自带格式化、测试框架、依赖管理和安全工具,AI 模型可借助这套端到端工具链更快、更便宜、更可靠地处理 Go 代码。Go 优先可读性而非可写性,其统一风格也为 LLM 提供了更标准化的训练数据。

  17. World Labs:官网52

    李飞飞:空间智能是 AI 的下一个前沿

    李飞飞发表长文,提出空间智能是 AI 的下一个前沿,认为 LLM 擅长语言但在距离估计、物体旋转、物理预测等空间能力上远低于人类。她将世界模型概括为生成一致世界、接受多模态输入、根据动作预测下一状态三项核心能力,并介绍 World Labs 已向部分用户开放可通过多模态输入生成可探索 3D 环境的 Marble,应用将依次覆盖创作工具、机器人和科学研究。

  18. World Labs:官网52

    World Labs 撰文论述 3D as code:3D 表征将成为人与机器交互空间的通用接口

    World Labs 发表长文,提出 3D 表征之于空间世界的角色类似代码之于软件,是人与机器生成、编辑、模拟和共享世界的通用接口。文章论证代码与 3D 在人机协作和机器间互通上的结构相似性,指出神经 graphics 类似编程语言、模拟引擎类似芯片,并对比了将状态内嵌于单一生成模型与采用因子化混合运行时的取舍。

  19. Every:最新文章(网页)7

    Every CEO Dan Shipper 撰文阐述「What comes next?」为何是驱动语言模型与科学进步的根本问题

    Every CEO 兼联合创始人 Dan Shipper 撰文指出,语言模型靠反复回答「What comes next?」完成训练,并由此学会写诗、写散文乃至量子物理。他将这一提问视为自历史开端以来推动人类前行的根本问题,也是科学、宗教与日常生活的共同驱动力。Every 的 essays、播客、课程与软件产品,都是对这一问题的回答。

  20. Every:最新文章(网页)40

    Socrates as a Service:最好的故事藏在人身上,而把它们挖出来仍是人的工作

    Every 文章提出"Socrates as a Service"概念,认为最好的故事藏在人的隐性知识里,AI 模型尚未复制优秀人类提问者挖掘这些细节的能力。文章引用 Michael Polanyi 的隐性知识理论和 Ikujiro Nonaka 1991 年文章中松下电器派软件开发者向面包师学徒、最终改进揉面技术的案例。文中提到 Every 内部已用 AI 智能体在撰写 OKR 时向员工提问。

  21. Every:最新文章(网页)10

    Marcus Moretti

    Marcus Moretti 是 Spiral 的总经理,在 Every 上发表了多篇文章,包括《Claude Code for Product Managers》《Spiral 4.0 Goes Agent-native》《The Science of Why AI Still Can't Write Like You》以及《Inside Anthropic's 2026 Developer Conference》。

  22. Eugene Yan:Writing50

    Eugene Yan 撰文分析简单性为何是优势但复杂度更畅销

    Eugene Yan 撰文分析复杂度偏见为何存在,指出复杂方案通过信号化努力、掌控力、创新和功能多样性而更受论文评审和晋升机制青睐,而简单方案更易采用、构建、扩展和运维。文章举例说明简单机器学习方法常不逊于复杂方法,如点积在推荐检索上优于神经协同过滤、树模型在 45 个中型表格数据集上超过深度神经网络,并建议聚焦问题复杂度而非方案复杂度,善用奥卡姆剃刀。