工具01
Pika 接入 Gemini Omni:用自然语言改视频
Pika 接入了 Gemini Omni:丢进一段视频,就能用 prompt 改背景、改机位、换服装、加特效,甚至让主体改说法语——而且同日上了 Pika MCP,意味着这一整套能直接从 Claude 这类助手里驱动。这把「编辑」拉进了和「生成」同一个对话式入口——过去分属不同工序(甚至不同厂商)的补光、换装、重构图、配音,如今一次调用里全办了;而把它做成 MCP 工具(紧随 Higgsfield 之后),说明厂商预期的主要操作者是 Agent,而不是坐在网页界面前的人。对品牌方,最实的杠杆是本地化与批量变体:一条母片扇出各市场的语言/服装/背景版本,无需重拍;但把它写进报价前先压测身份与连续性——prompt 式编辑仍会跨帧漂移。
来源 Pika @pika_labs · 2026.07.10 ↗
模型02
Meta 携 Muse Video 入局专业 AI 视频(尚未公开)
Meta 正式入局 AI 图像与视频;Muse Video 尚未公开,Curious Refuge 用 Seedance 复刻了 Meta 的 demo 片段来对比,判断 Muse「看起来很强」。作为上周 Muse Image 的姊妹作,它把第三家超大厂前沿实验室推进了专业 AI 影像——这个此前基本被 Seedance 主导的领域——意味着价格压力,更重要的是不再有单一厂商锁定。对工作室,启示是把模型层保持可替换,把每个新前沿模型当成「插进自家 QC 之后的候选」,而不是重构管线的理由;且这目前仍只是 demo,按正式发布评判,别按营销片。
来源 Curious Refuge @CuriousRefuge · 2026.07.10 ↗
行业03
OpenArt Director 让「导演型 Agent」从单品变成品类
TechHalla 展示了一个他「没拍」的镜头——而是用 OpenArt Director(一个自然语言导演工具)「vibe 导演」出来的,这是继 Pika 的 Director’s Suite 之后一周内冒出的第二个导演型 Agent。两个独立产品在几天内都收敛到「你描述影片、Agent 来执行」,说明这正在成为一个品类而非某家的单点押注,而「对话式导演」这个前门正在快速同质化。对自建工作室,这把护城河推到了 prompt 的下游:品味、镜与镜之间的连续性、QC 与逐帧溯源,才是「vibe 导演」前端仍保证不了的部分;这些工具要拿来跑、摸清它们的默认判断,但把控制面——什么能过、一致性怎么守——攥在自己手里。
来源 TechHalla @techhalla · 2026.07.10 ↗
模型04
给「导演大脑」跑分:GPT-5.6 Sol vs Fable 5 驱动 Seedance
Higgsfield 跑了一组评测,让 GPT-5.6 Sol 与 Fable 5 分别充当「规划镜头、撰写 prompt」的推理模型,两者都经 Seedance 2.0 出片,覆盖卡通、武士、动作等样本。这把过去混在一起的两个角色干净地分开了:导演(负责规划与 prompt 的 LLM)与渲染器(视频模型)——于是「用哪个模型」拆成了两个问题,而「导演大脑」成了可替换、可跑分的选择,而非固定前提。对在建 Agent 导演管线的团队,启示是把导演 LLM 当成一个有自己评测集、可替换的组件,并让 prompt 工艺保持模型无关,好在各家你追我赶时随时换脑——这正是为什么 prompt 系统应作为一个独立版本化的层存在,与任何单一模型解耦。
来源 Higgsfield AI @higgsfield_ai · 2026.07.10 ↗
技法05
prompt 的杠杆不是长度,是内建一个自我复核循环
AZIZ AI 提出:一条弱 prompt 的问题很少是「太短」,而是它在模型自我复核之前就结束了;一条 500 字符、但内建了「让模型拒绝草率初答」循环的 prompt,可能胜过一条只堆描述的 5000 字符 prompt。这个洞察能从对话延伸到图像与视频 prompt:一条点明质量标准、强制自检的紧凑指令,比一条给了模型更多游走空间的冗长指令输出更稳——这也正是版本化 prompt 系统靠 anti-slop 约束 + 检查清单、而不是靠堆长度的原因。对制作团队,启示是别再用字数衡量 prompt 的用功程度,而要把「检查」这一步建进去:写明标准、列出禁止出现的东西、让模型在收尾前对照核验——要打磨的是循环,不是长文。
来源 AZIZ AI @aziz4ai · 2026.07.10 ↗