CoRe:协同演化奖励模型,缓解视频扩散模型中的潜在奖励攻击
针对固定潜在奖励模型优化会导致"潜在奖励攻击"、生成视频感知与运动质量下降的问题,研究者提出协同演化奖励框架 CoRe,持续用生成器当前样本重训奖励模型并锚定真实视频偏好,防止生成器通过偏离数据分布刷高奖励。在 Wan2.1-T2V-1.3B 上,CoRe 的生成质量优于预训练模型和既有对齐方法,且避免了固定奖励优化的质量崩溃。
针对固定潜在奖励模型优化会导致"潜在奖励攻击"、生成视频感知与运动质量下降的问题,研究者提出协同演化奖励框架 CoRe,持续用生成器当前样本重训奖励模型并锚定真实视频偏好,防止生成器通过偏离数据分布刷高奖励。在 Wan2.1-T2V-1.3B 上,CoRe 的生成质量优于预训练模型和既有对齐方法,且避免了固定奖励优化的质量崩溃。
快手宣布高管分工调整,创始人兼 CEO 程一笑兼任社区科学线负责人,原负责人于越转任可灵 AI 公司董事兼 CEO。程一笑在全员信中表示可灵始终是快手 AI 战略的核心布局;此前快手已宣布 Kling 4.0 将于 10 月正式上线,Kling 4.0 Flash 于 9 月 28 日率先开放小范围体验。
广告做完了。版本还没。 不同尺寸。不同市场。同一广告活动。 用 Luma 的 Ad Variants 让你的广告走得更远。
MiniMax Hailuo 以 WAIFF 2026 全球合作伙伴及中国特别单元联合发起方身份亮相戛纳,并发布由多模态模型生成的 2026 品牌影片。
MiniMax 正式开源下一代通用视频模型 MiniMax H3,支持文本、图像、视频、音频的多模态统一理解,可生成最长 15 秒、768p(经 H3-Regenerate-2K 可达 2K)、24 FPS 并带 32 kHz 立体声音频的视频。
推荐理由:官方开源公告给出了完整的三模块系统结构、模型规格和本地部署方式,读者可以据此评估在自己的视频生成流程中如何接入。
SGLang Diffusion 团队发布 MiniMax-H3 视频生成基准,在 8× NVIDIA H200(141 GB)、SGLang v0.5.18。
Meta Superintelligence Labs 发布 Muse Image 并预览 Muse Video,均为该实验室首批媒体生成模型。
NVIDIA 在 IBC 2026 宣布大幅扩展 NVIDIA AI for Media,为广播、体育与流媒体工作流新增 GPU 加速 SDK、NIM 微服务与蓝图。
CMU 研究者发布 CHAI,一个基于批判式人机监督的视频描述管线,与 100+ 专业视频创作者合作一年构建,对应 CVPR 2026 论文(Highlight,Top 3%)。
Black Forest Labs 发布多模态基础模型 FLUX 3,基于 Self-Flow 方法在统一架构内联合学习图像、视频和音频,现已开放 Early Access。
推荐理由:原文给出 FLUX 3 的多模态架构、早期对比评测数字和分阶段开放计划,读者可据此评估其对创作与具身场景的适用性。
Black Forest Labs 宣布 FLUX 3 Video 初版正式开放,可通过 BFL API 和部分合作伙伴使用。模型支持最长 20 秒、HD(720p)与 Full HD(1080p,经上采样)的视频生成,并伴随生成原生音频;能力包括文生视频、图生视频与关键帧、视频续接(最多 4 秒)、单次生成多镜头、多语言对白与唇形同步、Draft Mode 低成本预览等。
推荐理由:原文给出具体生成时长、分辨率、多语言与评测结果,读者可据此判断 FLUX 3 Video 在视频生成工作流中的可用性。
Black Forest Labs 推出 FLUX Video Upscale,作为独立 FLUX Tool 和 endpoint,可将 480p 起的视频重生成至最高原生 4K,支持 1.5x、2x、3x 放大,并可原生理解 FLUX 3 输出。
Black Forest Labs 发布多项生成式 AI 与视觉智能研究,包括面向图像、视频和音频生成的模态无关自监督流匹配框架,以及对比 SD-VAE、RAE、FLUX.1 和 FLUX.2 等扩散模型自编码器表示的研究。此外还介绍了 FLUX.1 Kontext,一个在潜空间中进行上下文图像生成与编辑的统一模型,实现了快速且业界领先的效果。
MaLiang-Harness 是一个将 MLLM 驱动的视觉生成组织为持续构建、检查与修订过程的统一框架,用于弥合程序可执行但违反构图、外观或运动要求的 Program-to-Visual(P2V)差距。
Condé Nast 与 AWS 生成式 AI 创新中心合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,将单次内容检索耗时从 250 分钟降至 2 分钟以内。
@pinkshihtzu ぽんた的取景勘景,从城堡到巨大机器人,一条推文就拍成了电影 🏍️✨
ぽんた、R2の世界でロケハン🐾🎬 PixVerse R2を先行体験! 「あのお城、行ってみたい」から始まる冒険。 バイクに乗って、巨大ロボットに出会って… この景色、映画に撮りたくなるなあ。 みんなも一緒に遊んでみてね! @PixVerse #PixVerse #pixverseR2 #PixVerseCPP #PR
Got early access to Kling 4.0 Flash! One of my first tries. Prompt understanding is awesome. @Kling_ai #Kling4 Prompt ⤵️
满血版 KLING 4.0 实战呈现 🎬 #Kling4 #KlingAI #KlingModeOn
SPARE。由 可灵 Kling 4.0 满血版生成的短片。 感谢可灵 AI 的内测邀约。本片使用 可灵 Kling 4.0 满血版全能参考生成。 满血版比 Flash 还是强不少。 - 原生 30 秒直出 - 画面与声音更清晰 - 口型匹配更精准 - 21:9 电影画幅 可灵 Kling 4.0 将于 10 月上线。 中文字幕版:
@sailorv321 走着走着月亮上冒出怪兽,实时生成就是这么回事。下一个是消除重力? 🌕👾
Let’s try PixVerse R2 together! PixVerse R2 の早期アクセスをもらったので、リアルタイム生成ワールドを触ってみた。遊び方は2つ。 ① 探索モード ギャラリーからワールドを選んで入る。今回は「Lone Moon」。WASDで月面を歩くと、行った先の地面がその場で生成されていく。マップは用意されてなくて、尾根を登ったら惑星が昇ってきた。 ② Live すでに動いてる世界に入って、「次に何が起きるか」を打ち込むだけ。「摩天楼の間に巨大怪獣」と送ったら、歩いてる最中に街が変わって怪獣が出てきた。次に「重力が消える」で、自転車も人も車も空に浮いていった。 全部リアルタイム生成でレンダー待ちゼロ。「動画を作る」というより「シーンを操作してる」感覚で、動画AIというよりゲームに近い。 @PixVerse @PixVerseCreator #pixverser2 #PixVerse #PixVerseCPP
Window Lab,用 Krea Agent 创建的应用。 只需上传你的视频,调整运动控制,即可获得你想要的效果。 在下方试试 👇
No cameras. No sets. Just two filmmakers with a mission: Push @imagine's cinematic capabilities to their limits and make a pilot of Homer’s Odyssey. @WonderStudiosX, an AI-native creative studio who partnered with us on this, delivered the pilot in 15 days, using 2,070 images and 1,558 videos. Here’s a thread on the best tips from creative lead Dev Walker 🧵
NVIDIA 发布 Metropolis Blueprint for Video Search and Summarization(VSS)3.3,用于降低视觉 AI 智能体的构建与运行成本。该蓝图及其智能体技能将视频接入、流处理、事件检测、检索、摘要与报告整合为可维护的系统,让视觉语言模型在生产规模下理解视频。
更多证据表明企鹅天生就会说唱 我们让这只衣冠楚楚的企鹅用 PixVerse Canvas 表演了 Yamê 的《Bécane》,效果太炸了 提示词见下方
@hungrycomposer 飞越巨型石像,就像天空欠你房租一样 ☁️🗿
I got early access to PixVerse R2. Exploring a real-time AI world feels very different from traditional video generation. Flying through this world and controlling the experience in real time was fascinating. @PixVerse #pixverseR2 @PixVerseCreator #pixverseCPP
Nick & Judy 加入了 Raindance 趋势 用 PixVerse 重新演绎的 Raindance。提示词见评论区 ↓
This is what a product image can become. The video below was created with Product Hero Videos in PixVerse Growth Studio. Upload your product image, choose the specs you need, and Growth Studio can turn it into a polished product showcase video—without filming or writing a script from scratch. It’s built for brands and sellers who want to make their product detail pages feel more alive, and create more ecommerce-ready video assets from the catalog they already have. Try it with your own product images → http://growth.pixverse.ai #PixVerse #ProductHeroVideo #PDPVideo #EcommerceVideo #AIVideo #EcommerceMarketing
感谢 Yihui,出品速度好快呀。 正在努力让下面这种视频,在 YouMind 里也能顺畅制作。
来了 @stark_nico99 @YouMind_AI ,Manus 风格的YouMind 宣传片。
Seedance 2.5 草稿模式现已登陆 Krea。 用 480p 生成来试验——场景合适时再切换到 1080p。 立即体验 👇
一个提示词。一支精修视频。 Manus Studio 的 Alchemy 模式就像拥有一整支创意团队,在导演、编剧、分镜,并跟着音乐节奏剪辑每一个节拍。 视频、原始提示词和完整会话见推文串。
AWS 发布 vLLM-Omni 图像视频生成示例,在同一 vLLM-Omni DLC 上部署两个 SageMaker AI 端点:实时端点跑 FLUX.2-klein-4B 文生图,异步端点跑 Wan2.1-VACE-1.3B 图生视频。
可灵(Kling)宣布 Kling 4.0 将于10月发布,Kling 4.0 Flash 现已对 Ultra 年付订阅用户开放。