跳到正文

AI 影视制作

持续跟踪AI 影视制作的技术变化、实践方法与相关研究。

9条精选

最新精选

第 1–9 条 · 共 9 条
10月1日周四
  1. RedShark News81

    Cinema 4D 2026.4内置MCP服务器,支持Claude与ChatGPT操作场景

    Maxon在Cinema 4D 2026.4中加入内置Model Context Protocol(MCP)支持,让Claude Desktop和ChatGPT Desktop可依据自然语言指令,在艺术家当前的Cinema 4D场景中调用软件工具完成任务;该功能默认关闭,现已支持Windows和macOS,无需额外安装。其他兼容MCP的应用可能可以连接,但不在官方支持范围内。 Maxon称,这套实现面向程序化、迭代性和重复性工作,不用于生成式创作。可交由助手处理的任务包括整理数百个导入对象并建立一致层级、创建对象与材质变体、准备多通道渲染、组织场景,以及基础的3D摄像机跟踪、UV映射、绑定和动画。所有操作均通过Cinema 4D自身的工具和API在用户机器及场景内执行,结果保留为可检查、修改或撤销的原生Cinema 4D场景数据。 面向工作室和企业团队,Cinema 4D提供访问令牌、可配置权限和审计日志。连接默认在本地运行,与网络中其他机器协作需要另行选择启用;MCP服务器由适配器访问令牌保护。用户可限定助手能够调用的工具组并控制Python执行,每批MCP改动会分别记录在撤销历史中,相关命令也会写入本地审计日志。

    推荐理由:材料具体说明本地连接、权限控制、审计与原生数据机制,可供团队评估智能体接入三维制作管线的边界。

  2. postPerspective78

    Maxon 为 Cinema 4D 加入 Claude 与 ChatGPT 的 MCP 支持

    Maxon 为 Cinema 4D 推出内置 MCP 服务器,允许艺术家通过自然语言指令,让 Claude、ChatGPT 或 Codex AI 助手在 Cinema 4D 工作流中执行任务。该功能面向程序化、迭代性和重复性工作,可用于整理大量导入对象的层级、创建对象与材质变体、准备多通道渲染、组织场景,以及处理基础的 3D 摄像机跟踪、UV mapping、绑定和动画等任务。 所有操作均通过 Cinema 4D 自身工具和 API,在艺术家的本机场景中完成;结果保留为原生 Cinema 4D 场景数据,而非扁平化生成输出,用户可以检查、修改、撤销并继续编辑。每批 MCP 驱动的改动都会分别写入撤销历史,相关命令还会记录在本地审计日志中。 MCP 连接默认关闭,需要用户主动启用,并由 MCP adapter access token 保护。用户可以限定助手可使用的 Cinema 4D 工具组,并单独控制 Python 执行;连接默认在本机运行,与网络中其他机器协作时还需另行选择加入。该功能适用于 Windows 和 macOS 上的 Cinema 4D 2026.4 或更高版本,启用连接不需要额外安装。

    推荐理由:本地连接、工具权限、审计日志与分批撤销等设计,为评估 AI 助手接入三维制作管线的安全边界提供具体参考。

9月30日周三
  1. CG Channel78

    Maxon发布Cinema 4D 2026.4,新增官方MCP Server

    Maxon发布Cinema 4D 2026.4,核心更新是新增官方MCP Server,允许外部AI工具通过自然语言提示控制这款三维软件,以自动处理程序化、迭代性和重复性任务。该服务器正式支持Claude Desktop与ChatGPT Desktop,可用于调整场景层级或命名规范、管理多通道渲染、设置摄影机跟踪,以及执行基础三维建模、UV编辑、角色绑定与动画、粒子和液体模拟;更复杂的任务可结合Python脚本完成。 Maxon强调,这项连接并非生成式系统,不会自行设计或生成图像,也不会判断镜头效果。所有指令均由用户发起,执行的操作会进入撤销记录;MCP Server关闭时不会运行。它默认关闭并在艺术家的计算机上本地运行,如需连接局域网内其他机器必须另行选择启用。除云端AI服务外,它也可配合LM Studio等本地模型应用,但GPU显存可能成为限制。 MCP Server仅可在完整版Cinema 4D中运行,不支持After Effects所含的Lite版,也不能用于Team Render或命令行渲染。Cinema 4D 2026.4兼容Windows 10及以上版本和macOS 14.0及以上版本,仅提供订阅,价格为109美元/月或839美元/年。

    推荐理由:文章梳理MCP Server的可控任务、本地运行边界与版本限制,可用于评估自然语言自动化接入现有Cinema 4D流程的条件。

9月29日周二
  1. CineD77

    Adobe After Effects AI Assistant进入公开测试,支持全项目操作、表达式与项目清理

    Adobe已将After Effects AI Assistant转为正式公开测试,面向整个项目执行整理、检查、技术问题修复和表达式编写,而非只处理当前合成。它位于After Effects (Beta)当前测试流build 7或更高版本中,可从标题栏图标、Window菜单或时间线面板的Quick Apply打开;用户可选择逐项授权,或允许其自动执行操作。 Adobe称,Assistant主要用于整理包含数千图层的项目、根据自然语言编写表达式,以及清理继承而来的工程。它还可拼写检查和翻译文本图层、生成不同比例的合成版本,并从同一面板调用Firefly图像和视频生成,但Adobe表示这些功能的成功率不一。8月中旬更新加入文本图层编辑、Open Comp操作以及直接生成并导入文件,并改进图层重命名后的表达式引用修复、3D渲染器选择、形状图层层级处理和Checkbox表达式中的.value使用。 此前一次离线帧相关请求曾让Assistant扫描磁盘上的素材位置,引发文件访问疑虑。Adobe随后表示问题已修复,Assistant在解析路径时不再扫描或枚举项目外文件,并会限制在当前任务范围内。Adobe还称不会使用用户内容训练模型,聊天内容仅为调查错误而暂时保留,项目视觉工具需要时才截取单帧画面;涉及NDA的用户仍被建议自行判断。 早期测试者主要指出速度和可靠性问题。一名用户称,某项图像序列任务经过十多分钟处理和往返沟通才进入最终操作,但Assistant理解任务后执行本身是即时的。现有限制还包括仅支持上传JPG和PNG参考文件、可生成但不能执行脚本,以及撤销操作按步骤处理而非整项请求分组。该测试版现可通过Creative Cloud桌面应用的Beta apps标签安装,免费使用并包含Firefly生成,但受未公布具体数值的每日和每周限额约束;正式版定价尚未公布。2026年9月发布的正式版After Effects 26.5不包含Assistant。

    推荐理由:文章把公开测试功能、文件访问修复与早期用户的耗时反馈并置,可用于评估其进入客户项目前的权限和可靠性边界。

9月25日周五
  1. RedShark News77

    Adobe 向 Google Gemini 与 Anthropic Claude 扩展创作和文档工具

    Adobe 宣布将 Photoshop、Lightroom、Express 和 Firefly 工具直接集成到 Google Gemini 对话中,并把 Adobe for Claude 插件扩展至 80 多项工具。Gemini 集成即日起面向全球所有方案推出,可通过 Personal Intelligence 设置访问;Adobe 列举的用途包括统一产品摄影的灯光与色彩、在保留品牌元素的前提下适配多个社交渠道,以及定制模板化营销活动。 Adobe for Claude 插件现覆盖 Acrobat、Express、Photoshop、Illustrator、Premiere、Lightroom、InDesign 和 Adobe Stock;相比 4 月推出时的 50 多项工具,当前已增至 80 多项。Acrobat 新增删除页面、合并与拆分 PDF、隐去信息、格式转换与导出,以及用于页面重排、文本编辑和标注的交互式编辑器,并加入 Document Review skill。Express 则新增基于图层的交互式编辑器,可分别控制图像、文本、颜色和字体,无需从头重新生成设计。 Claude 端的更新即日起在桌面、移动端和网页端全球推出。用户可通过访客登录或 Adobe 账户使用连接器;Adobe 账户可获得更高使用限额和会话连续性。文章还提到,Adobe 已在 8 月将各个 ChatGPT 应用合并为一个可调用 70 多项 Creative Cloud 工具的插件。

    推荐理由:两项集成把 Adobe 创作与文档工具带入对话式工作流,并明确了覆盖范围、访问方式和账户差异。

9月23日周三
  1. CG Channel78

    Adobe 完成收购 Topaz Labs

    Adobe 已完成对 AI 图像与视频增强公司 Topaz Labs 的收购,计划将其增强模型扩展至 Adobe Firefly、Firefly Services 和 Creative Cloud 应用。该交易于 6 月宣布,当时仍需监管批准;Topaz Labs 的应用和 AI 模型将继续通过其网站作为独立产品提供,CEO Eric Yang 将加入 Adobe,并继续领导原团队。双方尚未说明订阅价格是否会改变。 Topaz Labs 创立于 2000 年代中期,最初开发 Photoshop 插件,之后转向独立的 AI 图像与视频处理软件。到 2025 年,公司拥有数百万用户,年收入为 4,800 万美元;其技术因用于修复电视档案录像而获得技术艾美奖。其产品包括图像放大工具 Gigapixel,以及 Topaz Photo 和 Topaz Video。部分 CG 艺术家会先以较低分辨率渲染三维图像或动画,再用 Gigapixel 提高原始渲染结果的分辨率。 两家公司此前已有产品合作。Adobe 去年开始在自家产品中提供第三方 AI 模型,Topaz Labs 是早期合作伙伴之一;Photoshop 27.0 的 Generative Upscale 可选用 Bloom 和 Gigapixel 模型。目前有五个 Topaz Labs AI 模型用于 Adobe 产品,包括 Firefly Boards 和实验性的 Firefly Assistant。Adobe 还特别提到 Topaz Labs 的 GPU 显存优化技术 NeuroStream,称其可帮助消费级硬件在本地运行更大的 AI 模型,并支持其拓展高效的设备端 AI 视频处理。

    推荐理由:交易完成后的产品独立性、团队去向与模型整合范围均有交代,可帮助现有用户评估工作流连续性。

9月22日周二
  1. CineD76

    Eddie AI v4 技术解析:新增视觉 B-roll 剪辑、参考样片与 NLE 协作 Agent

    Eddie AI v4 将基于提示词的辅助剪辑从依赖转录的粗剪扩展到视觉工作,可制作 B-roll 序列、蒙太奇及按音乐节拍剪辑的内容;CineD 在 IBC 2026 采访了联合创始人兼 CEO Shamir Allibhai,并观看了 Mac 应用演示。用户仍可导入最多 100 小时素材,由系统完成记录、片段同步、multicam 分组以及采访与视觉镜头分类,再以自然语言生成和修改剪辑。新版可使用用户提供或生成的音乐,按节拍剪辑、进行一次调色处理,并将结果发送至 NLE 或渲染为 MP4;Allibhai 称成片可继续推进至精剪,但也承认其“能力提升 10 倍”的说法可能有所夸张。 应用界面左侧管理 edits 和 media,右侧输入提示词,中间显示结果与选择逻辑。演示中的声画剪辑分别置于 V1 和 V2,导出支持范围现已包括 Avid Media Composer。Allibhai 表示,更好的视觉理解让系统能够更准确地安排 B-roll;Eddie AI 会连接 ChatGPT 和 Claude,并叠加公司自身技术与微调,其中说话者识别结合音频和视觉线索判断发言人。Backgrounder 在原有的人脸和行业词典上下文之外,新增导入视频文件或 XML 参考剪辑的能力,可读取宽景、近景及返回宽景等结构,并把该模式应用于新剪辑。 分析并非在本地完成。Eddie AI 会转码并上传低分辨率代理文件供服务器分析,全分辨率媒体保留在原位置;云同步使同一剪辑可在 Mac、PC、网页和 iPhone 应用中访问,也可从 ChatGPT 或 Claude 内驱动。Allibhai 称服务符合 SOC 2 Type II,且不会使用客户数据训练模型。 新版还提供可在剪辑中标记的专家 Agent,例如 MrBeastMethod Agent 可先评议时间线,再由 Eddie AI 执行修改。公司页面说明,这些 Agent 根据电影工作者的公开演讲及相关文章训练,相关人士未必给予认可;任何执行剪辑的 Agent 都会新建版本,不覆盖用户原有剪辑。另一项功能允许 Eddie AI 作为额外编辑加入 Blackmagic Cloud、Premiere Pro Productions 或其他团队协作项目,与人类实时工作;据 Allibhai 描述,该 Agent 会直接操作 NLE 图形界面,包括移动光标和点击。 Eddie AI v4 已可使用,并以按需购买的 credits 取代订阅。导入每小时源素材最多收费 2.50 美元,购买较大额度包时费用更低;提示词按工作量扣费,采访素材记录较便宜,生成 B-roll 较贵。额度包从 10 美元购买 1,000 credits 起,新账户获赠 1,000 credits,且 credits 不会过期;原有订阅用户已转换至新的额度体系。

    推荐理由:文章结合现场演示与创始人访谈,具体拆解视觉剪辑、参考样片复用和协作型 Agent 的工作方式与数据边界。

8月28日周五
  1. fxguide80

    本地部署开放权重模型可提升生成式媒体工作流的稳定性与可控性

    fxguide刊载GenAI工作流与色彩科学顾问JD Vandenberg的分析,认为在自有基础设施上部署开放权重模型,能为媒体与娱乐制作提供更稳定的版本、更可控的数据安全与成本,并更深入地接入既有后期管线;代价是团队需要相应的技术能力和自带基础设施。文章同时提醒,开放插件生态本身可能引入恶意代码,ComfyUI等工具及艺术家自行下载的软件会给内部网络带来审计压力,因此可信的本地方案仍需经过严格的软件审查。 在稳定性方面,托管模型可能在缺少完整变更记录的情况下更新,相同输入与seed未必继续产生相同结果,服务也可能停止。文中以Critterz为例称,OpenAI于3月关闭Sora应用和网页服务后,该项目错过原定的戛纳亮相并更换AI合作方,现计划于2027年初发布。本地保存并固定模型权重,则有助于维持制作期间的版本一致性。 在安全与成本方面,制作网络通常依照MPA和TPN内容安全要求限制数据外传,而调用托管模型会让尚未发布的素材穿过外部服务。文章认为,本地模型可以在完全隔离的网络内运行,不向第三方传输数据。生成式媒体又需要大量迭代,Shy Kids制作约90秒的Air Head成片时进行了数百次、每次10至20秒的生成;Patrick Cederberg粗略估计素材与成片比例约为300:1,即使按保守方式理解也超过80:1。按2026年8月约每秒0.05至0.75美元的API价格,成片成本还要乘以难以预估的生成比例。本地部署并不会让生成变得便宜,但可把成本约束在预先购置和运营的硬件范围内。 格式也是现有服务与专业后期之间的障碍。文中称,多数生成视频工具输出H.264、8-bit、4:2:0且为显示参照格式,缺少alpha、深度、cryptomatte和场景线性数据;Air Head的素材以480p生成后再由外部工具放大。相比之下,VFX交付常使用EXR,一个4K、三通道、half-float的未压缩帧约53MB,多层EXR达到每帧200MB并不罕见。本地模型可以直接置于团队的色彩管理和文件管线中,输出后续环节实际需要的格式,也可从Nuke节点或Resolve插件调用,通过既有渲染管理器排队,并沿用OCIO、ACES及资产版本管理体系。 硬件方面,Vandenberg称多数当前开放权重视频模型的量化或蒸馏版本可在单张RTX 5090的32GB VRAM上运行;RTX PRO 6000 Blackwell配有96GB VRAM,零售价约13,250美元。现有渲染农场、高端GPU工作站,以及运行FilmLight Baselight或Blackmagic DaVinci Resolve的多GPU调色系统,也可能在闲置时承担推理任务。 文章最后区分开放权重与开源。可下载模型参数并不自动授予微调、再分发或商业交付权利;不同模型可能采用Apache 2.0、带使用限制的社区许可、非商业许可,或要求另签商业协议。因此,团队需要在建立管线前核查具体许可,并归档制作实际使用的权重。文章并未主张全面取代网页或API服务,而是认为本地开放权重模型更适合重视版本固定、内容安全、成本边界和深度管线集成的制作环境。

    推荐理由:文章从稳定性、安全、成本、格式与管线集成五方面比较本地开放权重模型和托管服务,为VFX团队评估部署路径提供框架。

7月17日周五
  1. fxguide84

    Foundry 发布 SmartRoto,以 AI 辅助 Nuke 转描关键帧制作

    Foundry 发布面向 Nuke、NukeX、Nuke Studio 和 Nuke Indie 的 AI 插件 SmartRoto,用于在保留艺术家样条设计与控制权的前提下,加速转描关键帧制作。它不会自动创建完整样条,也不是围绕分割蒙版描出轮廓的自动抠像工具;艺术家仍需在主体清晰可见的画面上将其拆分为合理的关节化形状,SmartRoto 负责让这些样条随序列中的主体移动、变形。年订阅价格为 499 美元,提供节点锁定与浮动许可证。 工作流区分两类关键帧。模型预测的是 smart keys,艺术家创建或修正的是 user keys;后者被视为确定依据,不会被覆盖。艺术家先在初始帧创建形状,再选择主体变化明显的画面建立关键帧,然后让 SmartRoto 为所选形状生成 smart key。若预测存在偏差,调整后的画面会成为锁定的 user key,再次运行模型时,修正信息会影响周围范围。控制粒度细化到单个形状,因此同一帧可以同时包含 user keys 与 smart keys。工具既可处理整段序列,也可限定输入、自定义或入出点范围,并提供关键帧精简工具,寻找可由插值表达的运动区间。 Foundry 表示,该系统既不依赖光流,也不从图像分割蒙版反推轮廓,而是依据图像特征直接传播样条,并利用多个形状之间的空间关系作为约束。样条仍可编辑且具备亚像素精度,也可按常规方式为生成的蒙版渲染运动模糊。模型接受过含运动模糊画面的训练,严重模糊时可能需要更多手动关键帧;部分遮挡可以处理,完全遮挡仍需设置形状生命周期。外观相同的角色也可能被混淆。 该项目约四年前在 Foundry 内部重新启动,模型和训练数据由研究团队从头构建;Foundry 称训练素材均获许可,模型可用于商业工作,全部运算在本地完成,不向云端传输数据。显存需求随分辨率和同时跟踪的形状数量变化,约需 8GB VRAM,高分辨率及大量形状会需要更多。 最终测试邀请专业转描艺术家在两周内分别使用普通 Nuke 与 SmartRoto 处理多种镜头,并随机安排工具使用顺序。第二周结束时最高达到 4 倍速度,但 Foundry 产品负责人 Adam Cherbetji 称该数字偏高,更稳定的结果是完成同一镜头约快 2 倍,且经常高于这一水平。文章还将其与 SIGGRAPH 2026 的 RotoShop 对比:RotoShop 从 SAMv2 等模型的分割蒙版拟合姿态绑定的 Bézier 样条,SmartRoto 则绕过蒙版,直接根据图像特征传播艺术家创建的样条;两种路线都把可编辑、高精度样条作为 VFX 转描的最终交付物。

    推荐理由:文章结合工作流拆解与专业艺术家测试,说明可编辑样条驱动的 AI 转描如何减少关键帧劳动及其适用边界。