跳到正文
9月23日周三
  1. postPerspective67

    CaptionX 推出 Clips,将长视频和播客转成可发布短片

    CaptionX 推出 Clips,可从最长三小时的视频或播客中提取完整、可独立发布的短片,并按相对质量排序。该功能仅依据带逐词时间戳的转录文本判断内容,不分析视频画面或音频波形;生成和预览免费,用户只为最终保留的短片付费。Clips 现已在 Adobe Premiere 内及浏览器中提供。 系统首先以规则将转录文本划分为完整句子,终止标点、约 0.75 秒的停顿或长度上限均可触发分句,同时标记因说话者换气而形成的虚假结尾。模型接收编号句子列表,为每段候选短片返回连续的起止句及一个承载吸引点的“峰值”句,而不直接返回时间戳;随后由独立的确定性引擎校验边界,拒绝从半句开始或以无实质内容的“yeah”结束,最后才从所选词语的真实时间戳换算成秒。 候选短片按吸引点、回报感、独立完整性、情绪、可引用性和节奏六个维度评分,再由代码确定排序。CaptionX 将分数定义为同一视频内的相对质量指标,而非播放量或传播潜力预测。 处理长文件时,浏览器分片读取文件,仅提取压缩音频并在本地重新编码为较小的语音级文件;两小时视频约生成 30MB 音频。转录文本按相互重叠的 10 分钟窗口分析,每隔八分钟滑动一次并行运行,因此厂商称三小时播客可在数十秒内完成。公司表示,生成的短片通常有 20%至40%会被用户舍弃。

  2. Deadline32

    2026 圣塞巴斯蒂安创意投资者大会首日:创作风险、AI 与巴西电影制作热潮

    圣塞巴斯蒂安电影节第五届创意投资者大会首日汇集 Mubi、Studiocanal、Neon、Pastel、Goodfellas 等公司高管和制片人,围绕美国市场复苏与收缩、行业避险倾向、AI 对制作的影响及巴西电影制作热潮展开讨论。与会者总体保持乐观,但也指出疫情、罢工、影院关闭,以及游戏、社交媒体和流媒体同时兴起,已重塑电影融资、发行和观众结构。 Neon 的 Elissa Federoff 表示,美国市场自疫情后逐年增长,但行业需要调整预期;社交平台不必然蚕食院线,一些重要影片反而来自已在 YouTube 建立受众的创作者。Sumerian Pictures 的 Rob Williams称,公司每年约有 7—8 部影片进入院线,以较少片量换取对单片的集中投入。Pastel 的 Adele Romanski 则表示,公司正有意识地推进国际合拍,目前有三个项目,并更重视让新人导演的首部或第二部作品进入 Cannes Film Festival,以争取国际影响力、院线支持与融资机会。她同时批评市场普遍规避风险,投资方偏好明星阵容和既有 IP,令押注新声音或难以按常规分析的影片更加困难。 AI 并非当天讨论重点,但 Goodfellas CEO Vincent Maraval 表示,公司后台业务已主要由 AI 系统运行,用于改善组织并减少重复性工作;在适当监督下,AI 也可能帮助年轻电影人扩展创作边界。他称 Goodfellas 正在销售的 Michel Hazanavicius 新片 The Third Hand 大量使用 AI,使复杂战斗场面的拍摄由十天缩短至两天。面对这会减少现场岗位的质疑,他回应称,若必须增加十天制作,该片可能根本无法完成;这是企业高管对具体项目的说法,正文未提供独立验证或更详细的技术流程。 巴西制片人 Rodrigo Teixeira 将当地制作现状描述为一轮热潮,代表性作品包括 Walter Salles 的 Im Still Here 与 Kleber Mendonça Filho 的 The Secret Agent。他强调,两位作者导演不能代表巴西电影的大多数,其国际成功也难以直接复制,但提升了巴西艺术家的“自尊”,进而创造机会。Teixeira 还透露,他正与美国导演 James Gray 开发下一部长片,未公开项目细节,仅称计划明年拍摄。

9月22日周二
  1. RedShark News72

    Adobe Premiere 移动版免费登陆 Android

    Adobe Premiere 移动版现已在 Android 上免费提供,距离 iPhone 版推出已有一年。应用可从 Google Play Store 下载,要求设备运行 Android 13 或更高版本,并至少配备 5 GB RAM。 该应用提供逐帧精确剪辑和多轨时间线,可叠加视频、音乐、文字、旁白及效果;Enhance Audio 可一键降低背景噪声并改善采访、旁白等录音的清晰度。用户还可使用创作者模板或自定义模板,添加 Adobe Stock、自有文件或提取音频中的素材,并编辑和导出最高 4K 视频。应用无需强制登录,没有广告、水印或升级提示。 Firefly 驱动的生成式 AI 功能包括 Generative Fill、Image-to-Video 和 Generate Sound Effects。Android 版目前仍缺少 iOS 版的关键帧、节拍检测以及在 Premiere 桌面版继续编辑等功能,Adobe 表示这些功能后续会加入。免费版覆盖基本视频剪辑功能,额外的生成额度和存储空间需付费升级。

  2. CineD76

    Eddie AI v4 技术解析:新增视觉 B-roll 剪辑、参考样片与 NLE 协作 Agent

    Eddie AI v4 将基于提示词的辅助剪辑从依赖转录的粗剪扩展到视觉工作,可制作 B-roll 序列、蒙太奇及按音乐节拍剪辑的内容;CineD 在 IBC 2026 采访了联合创始人兼 CEO Shamir Allibhai,并观看了 Mac 应用演示。用户仍可导入最多 100 小时素材,由系统完成记录、片段同步、multicam 分组以及采访与视觉镜头分类,再以自然语言生成和修改剪辑。新版可使用用户提供或生成的音乐,按节拍剪辑、进行一次调色处理,并将结果发送至 NLE 或渲染为 MP4;Allibhai 称成片可继续推进至精剪,但也承认其“能力提升 10 倍”的说法可能有所夸张。 应用界面左侧管理 edits 和 media,右侧输入提示词,中间显示结果与选择逻辑。演示中的声画剪辑分别置于 V1 和 V2,导出支持范围现已包括 Avid Media Composer。Allibhai 表示,更好的视觉理解让系统能够更准确地安排 B-roll;Eddie AI 会连接 ChatGPT 和 Claude,并叠加公司自身技术与微调,其中说话者识别结合音频和视觉线索判断发言人。Backgrounder 在原有的人脸和行业词典上下文之外,新增导入视频文件或 XML 参考剪辑的能力,可读取宽景、近景及返回宽景等结构,并把该模式应用于新剪辑。 分析并非在本地完成。Eddie AI 会转码并上传低分辨率代理文件供服务器分析,全分辨率媒体保留在原位置;云同步使同一剪辑可在 Mac、PC、网页和 iPhone 应用中访问,也可从 ChatGPT 或 Claude 内驱动。Allibhai 称服务符合 SOC 2 Type II,且不会使用客户数据训练模型。 新版还提供可在剪辑中标记的专家 Agent,例如 MrBeastMethod Agent 可先评议时间线,再由 Eddie AI 执行修改。公司页面说明,这些 Agent 根据电影工作者的公开演讲及相关文章训练,相关人士未必给予认可;任何执行剪辑的 Agent 都会新建版本,不覆盖用户原有剪辑。另一项功能允许 Eddie AI 作为额外编辑加入 Blackmagic Cloud、Premiere Pro Productions 或其他团队协作项目,与人类实时工作;据 Allibhai 描述,该 Agent 会直接操作 NLE 图形界面,包括移动光标和点击。 Eddie AI v4 已可使用,并以按需购买的 credits 取代订阅。导入每小时源素材最多收费 2.50 美元,购买较大额度包时费用更低;提示词按工作量扣费,采访素材记录较便宜,生成 B-roll 较贵。额度包从 10 美元购买 1,000 credits 起,新账户获赠 1,000 credits,且 credits 不会过期;原有订阅用户已转换至新的额度体系。

    推荐理由:文章结合现场演示与创始人访谈,具体拆解视觉剪辑、参考样片复用和协作型 Agent 的工作方式与数据边界。

  3. Production Expert65

    面向音频专业人士的 6 款 Stem 分离工具对比

    Production Expert 对比了 6 款面向音乐与影视后期的 Stem 分离工具,主要差异在于实时或离线处理、本地或云端运行、输出数量以及后续编辑能力。文章指出,离线工具可在分析音频后处理,部分服务需要上传素材,可能以数据安全和隐私换取更高质量;实时插件通常精度稍低,但能即时得到结果且不涉及第三方。实际分离质量仍应以用户自己的素材试用为准。 LALAL.AI Stem Separator 以 VST 或 AU 插件实时运行,可选择或排除人声、鼓、钢琴、贝斯、原声吉他和电吉他,并以最高 6 秒延迟减轻处理器负担。zplane PEEL STEMS 2 支持 AAX、VST3 和 AU,将混音拆成人声、鼓、贝斯和 Other;分离滑块可在自然度、串音与更激进但处理痕迹更明显的结果之间取舍,PEEL Focus EQ 还可选取频段和声场区域并通过双输出分别处理。 SoliderSound Go-Splitter Pro 在 Apple Silicon 与 Windows 上独立、离线且本地运行,支持批量排队处理、BPM 与调性自动检测、一键将 Stem 转为 MIDI,以及 WAV 单轨或 ZIP 会话导出;厂商称其可生成录音室级 WAV Stem,文章同时强调应自行试用验证。Waves StudioVerse Mix Unlock 随 2026 年 7 月的 Waves v17 更新加入,可在 StudioVerse Audio Effects 内实时拆分人声、鼓、贝斯和乐器,并用 StudioVerse 预设链及 Waves 插件分别处理;该功能包含在 Waves Creative Access 订阅中,也可单独购买。 Acon Digital Remix 实时输出人声、贝斯、钢琴、鼓和 Other 五路,Sensitivity 控件用于平衡伪影与串音,参数均可自动化;在 Pro Tools、Reaper 等支持多输出的 DAW 中,可将各 Stem 分送至独立辅助轨或总线。离线上传服务 MVSEP 则提供多种针对不同任务优化的算法,以及音频转 MIDI、修复和声音克隆;其比较表列出各算法的 SDR 等指标,Premium 账户可使用超过 100 种算法、不限次数分离及 API,免费账户也能在限制条件下使用。

  4. Variety35

    圣塞巴斯蒂安电影节 Zinemaldia Startup Challenge 聚焦 AI、沉浸式技术与绿色制作

    圣塞巴斯蒂安电影节的 Zinemaldia Startup Challenge 公布本届入选阵容,10 个项目来自西班牙及欧洲其他地区,涉及 AI 监督工具、虚拟制作工具、碳排放追踪平台等技术,重点覆盖 AI、沉浸式技术与绿色制作。 该竞赛创办于 2019 年,旨在发掘可应用于电影及更广泛视听产业的新兴技术。本届共收到 68 份申请。由于所提供

  5. Newsshooter61

    shortshort 将长视频自动制作成带逐字字幕的 9:16 竖屏短片

    shortshort 可从一段最长 3 小时或 2GB 的上传视频中选取独立段落,制作带逐字字幕的 9:16 竖屏短片,面向需要将访谈、座谈、会议和活动素材转为社交媒体内容的用户。系统先生成逐字转录文本,再由 AI 寻找语义完整且在句末结束的段落;为保持句子完整,成片时长可能比指定长度短或长最多 25%。 画面重构会跟踪屏幕中的人脸,每个镜头采用一个缩放级别,并将强调性推进限制在 x1.0 至 x1.6;宽景、双人镜头、幻灯片和屏幕共享会保持完整画面,不强行裁切到人脸。渲染前可以修改构图、关键帧、字幕样式和标题,手动编辑器及 MP4 导出无需账号。输出上限为 MP4、1080×1920、30 fps,不提供配音、自动发布或添加 B-roll。 服务按源素材分钟数而非生成片段数计费,同一小时素材生成 3 条或 20 条短片的成本相同。注册可免费获得 60 分钟额度且无需银行卡;免费方案每段视频最多生成 3 条并带水印,Starter 为每月 €12、240 credits、4 小时视频且每段最多 5 条,Creator 为每月 €29、800 credits、13 小时 20 分钟且每段最多 10 条,Studio 为每月 €79、3,000 credits、50 小时且每段最多 20 条。作者认为其定价相对于已有 NLE 工具提供的能力偏高,并对 AI 工具可能影响创意与岗位表达了担忧。

9月20日周日
  1. CG Channel51

    Animcraft 6.0、OctaneRender 2026.5、Radeon ProRender 3.7 与 Unigine 2.22 更新汇总

    CG Channel 汇总了 Animcraft 6.0、OctaneRender 2026.5、Radeon ProRender for Blender 3.7 和 Unigine 2.22 的主要更新,涵盖 AI 绑定与动画、GPU 渲染器兼容性,以及实时三维引擎的动画制作工具。 Animcraft 6.0 为跨软件动画库构建工具加入由 Basefount 自研的 AI 角色绑定与蒙皮模块,官方描述为采用数十亿参数并在本地推理,并非通用 LLM 封装,可跨 3ds Max、Maya 等 DCC 应用工作。新版还加入基于 NVIDIA Kimodo 模型的片段式文本生成动画模块,支持时间线拼接、地面路径与起始帧姿势约束;这些 AI 功能与核心应用分开定价。 OctaneRender 2026.5 为 Otoy GPU 生产渲染器的稳定版更新,原生支持面向笔记本和移动工作站的 NVIDIA RTX Spark,并支持 OpenColorIO 2.5 配置。价格和系统要求相较 OctaneRender 2026.4 没有变化。 Radeon ProRender for Blender 3.7 支持 Blender 5.2,并基于 Radeon ProRender SDK 3.1.7。Windows 编译版可免费获取,源代码采用 Apache 2.0 许可证。文章指出,AMD 目前似乎仍在维护该软件,但自 2023 年的 3.6 版以来没有显著功能更新。 Unigine 2.22 加强了面向娱乐制作的动画工具集,新增可在 Unigine Editor 内直接制作过场动画的时间线工具 Sequencer;Animation Graph 增加 IK、Look At、关节约束和程序化姿势控制。该版本还实验性重做导航与寻路系统,加入用于行星尺度地理空间数据流送的 Cesium 集成,并改进 Gaussian Splatting 支持;价格和系统要求相较 Unigine 2.21 没有变化。

9月18日周五
  1. CG Channel42

    2026 Digital Storytelling 大会公布演讲嘉宾与议程

    挪威 CG 大会 Digital Storytelling 将以“Art and the New Machine”为副标题,于 2026 年 10 月 9 日在奥斯陆 Cinemateket 举办 20 周年活动。议程将回顾挪威 VFX 的发展历程,介绍斯堪的纳维亚地区当前的 VFX 与游戏开发成果,并讨论 AI 等新技术将如何影响电影制作及艺术家的未来角色。 三度获得奥斯卡科学与技术奖的 Paul Debevec 将发表主题演讲“Image-Based Lighting: Past, Present and Future”,梳理基于图像的照明从早期研究及《The Matrix》中的应用,到 2000 年代 Spider-Man 影片使用的 Light Stage 系统,再到《The Mandalorian》等作品所用现代 LED volume 的演进。Storm Studios VFX 主管 Espen Nordahl 将结合《The Last of Us》《Percy Jackson》和《Sinners》,讨论实拍特效与数字特效的协作;他凭《Sinners》的 VFX 获奥斯卡提名。Framestore VFX Supervisor Stuart Penn 则将解析《Project Hail Mary》以实拍为主导的特效工作,以及外星角色 Rocky 如何与实体木偶配合呈现。 Embark Studios 创意总监 Tahir Tanis 将介绍瑞典游戏开发商为《ARC Raiders》进行的世界构建;Kristiania University College 教授 Morten Moen和 Norwegian VFX Association 主席 Stephanie Erso 将分别参与两场回顾挪威 VFX 历史的演讲。闭幕圆桌由文章作者主持,Espen Nordahl、Stuart Penn 与 Rebel Unit 联合创始人、凭《Gravity》获 VES Award 的 Theodor Groeneboom 将讨论 AI 当前在制作中的使用,以及它未来可能如何重塑艺术家的角色;文章明确表示,与会者并不声称已经知道这项技术最终将走向何方。 活动全部环节均以英语进行。门票为 NOK 1,250(原文称约 $350),包含 20 周年招待会入场资格。

9月1日周二
  1. fxguide40

    专访 Crafty Apes CEO Alana Newell:从合成师到工作室领导者,并将 VFX 能力拓展至沉浸式内容

    在本期 fxpodcast 中,Crafty Apes CEO Alana Newell 讲述了自己从一线合成工作转向工作室管理的经历,以及职位变化如何重塑衡量成功的方式。艺术家可以从完成单个镜头、看到成片中获得直接满足,而管理一家在八个办公室拥有约 400 名员工的公司,很少有如此即时的成就感。她将成绩视为团队的集体成果,但在需要为全公司产出负责时,失误会带来更强的个人压力。 Newell 的制作背景仍是其管理方式的基础,影响着 Crafty Apes 的项目报价、风险评估和艺术家沟通。公司既承接高规格大型制作,也处理需要定制方案的小型项目;这种多样性同时是一项风险分散策略。她认为,与依赖五个大客户相比,同时参与 50 个项目的工作室更能承受档期变化带来的冲击。 在技术方面,Newell 的关注点不限于生成式 AI。VFX 公司长期积累了有关制作周期、镜头复杂度和实际交付时间的数据,机器学习可帮助工作室改进报价、人员规划和项目选择。她认为,VFX 制作管线对机器学习而言不是“bug”,而是一项“feature”。Crafty Apes 也在鼓励艺术家拓展能力;在她看来,新兴工具更有利于好奇且适应力强的人,而不是那些声称在刚出现的专业领域已有多年经验的求职者。公司重视内部培养,同时也将外部人才和观念视为创意刺激的重要来源。 Crafty Apes 为 Sphere 的 The Wizard of Oz 所做的工作,展示了传统 VFX 知识如何用于新型内容格式。Newell 还看到沉浸式娱乐、互动装置、博物馆和主题公园项目中的机会,其中包括目前与 Universal 合作的项目。她因此将 Crafty Apes 定义为“内容创作公司”,而不只是一家视觉特效公司。完整节目还讨论了现代 VFX 的经济模式、全球激励政策、跨国办公室的统一文化、女性领导力,以及行业为何可能向电影和剧集之外继续扩展。

8月28日周五
  1. fxguide80

    本地部署开放权重模型可提升生成式媒体工作流的稳定性与可控性

    fxguide刊载GenAI工作流与色彩科学顾问JD Vandenberg的分析,认为在自有基础设施上部署开放权重模型,能为媒体与娱乐制作提供更稳定的版本、更可控的数据安全与成本,并更深入地接入既有后期管线;代价是团队需要相应的技术能力和自带基础设施。文章同时提醒,开放插件生态本身可能引入恶意代码,ComfyUI等工具及艺术家自行下载的软件会给内部网络带来审计压力,因此可信的本地方案仍需经过严格的软件审查。 在稳定性方面,托管模型可能在缺少完整变更记录的情况下更新,相同输入与seed未必继续产生相同结果,服务也可能停止。文中以Critterz为例称,OpenAI于3月关闭Sora应用和网页服务后,该项目错过原定的戛纳亮相并更换AI合作方,现计划于2027年初发布。本地保存并固定模型权重,则有助于维持制作期间的版本一致性。 在安全与成本方面,制作网络通常依照MPA和TPN内容安全要求限制数据外传,而调用托管模型会让尚未发布的素材穿过外部服务。文章认为,本地模型可以在完全隔离的网络内运行,不向第三方传输数据。生成式媒体又需要大量迭代,Shy Kids制作约90秒的Air Head成片时进行了数百次、每次10至20秒的生成;Patrick Cederberg粗略估计素材与成片比例约为300:1,即使按保守方式理解也超过80:1。按2026年8月约每秒0.05至0.75美元的API价格,成片成本还要乘以难以预估的生成比例。本地部署并不会让生成变得便宜,但可把成本约束在预先购置和运营的硬件范围内。 格式也是现有服务与专业后期之间的障碍。文中称,多数生成视频工具输出H.264、8-bit、4:2:0且为显示参照格式,缺少alpha、深度、cryptomatte和场景线性数据;Air Head的素材以480p生成后再由外部工具放大。相比之下,VFX交付常使用EXR,一个4K、三通道、half-float的未压缩帧约53MB,多层EXR达到每帧200MB并不罕见。本地模型可以直接置于团队的色彩管理和文件管线中,输出后续环节实际需要的格式,也可从Nuke节点或Resolve插件调用,通过既有渲染管理器排队,并沿用OCIO、ACES及资产版本管理体系。 硬件方面,Vandenberg称多数当前开放权重视频模型的量化或蒸馏版本可在单张RTX 5090的32GB VRAM上运行;RTX PRO 6000 Blackwell配有96GB VRAM,零售价约13,250美元。现有渲染农场、高端GPU工作站,以及运行FilmLight Baselight或Blackmagic DaVinci Resolve的多GPU调色系统,也可能在闲置时承担推理任务。 文章最后区分开放权重与开源。可下载模型参数并不自动授予微调、再分发或商业交付权利;不同模型可能采用Apache 2.0、带使用限制的社区许可、非商业许可,或要求另签商业协议。因此,团队需要在建立管线前核查具体许可,并归档制作实际使用的权重。文章并未主张全面取代网页或API服务,而是认为本地开放权重模型更适合重视版本固定、内容安全、成本边界和深度管线集成的制作环境。

    推荐理由:文章从稳定性、安全、成本、格式与管线集成五方面比较本地开放权重模型和托管服务,为VFX团队评估部署路径提供框架。

8月24日周一
  1. fxguide73

    Nikola Todorovic 详解 Autodesk Flow Studio 新 3D Editor 与 Canvas 工作流

    Autodesk Flow Studio 通过新的 3D Editor 与 Canvas 工作流,把可交互的三维场景调度和生成式二维视频模型结合起来,让电影制作者先控制表演、场面调度、构图与摄影机运动,再生成和细化最终画面。fxguide 采访 Wonder Dynamics 联合创始人、现任 Autodesk 成员 Nikola Todorovic;他强调该系统并非用单条 Prompt“制作一部电影”,而是把 AI 纳入可指导、可修改的制作流程。 3D Editor 可使用角色、动画、动作捕捉数据、摄影机轨迹和生成环境组装镜头。表演与摄影机运动可以分别取自不同参考视频,摄影机也可直接设置关键帧;包括由 World Labs Marble 创建的 Gaussian splat 世界在内,具备空间一致性的环境可用于 blocking、布局与摄影机设计。随后,艺术家可进入基于节点的二维环境 Canvas 生成和调整画面,由当前 AI 视频模型处理灯光融合、氛围、模拟效果和电影化收尾。三维场景不一定直接输出最终像素,而是为生成结果提供表演、调度、构图和摄影机运动约束;追求速度时也可只使用 Canvas。 Todorovic 将 Prompt 工作流的问题概括为“80/20 规则”:AI 能很快生成图像的前 80%,但在移动物体、修改表演或细化摄影机路径且保留已有成果时,最后 20% 容易变得不可预测。Flow Studio 试图借助三维指导和二维生成的组合,使这类迭代更可控,并减少模型给出统计上安全但缺乏创作特异性的结果。 该流程优先使用录制的人类表演。视频和音频可驱动角色,在生成模型改变最终外观前保留表演者的节奏与意图;Todorovic 认为,仅靠音频或描述表演的 Prompt 难以稳定地产生鲜明表演,音频驱动动画也常出现泛化的手势和表情。音频整合仍在演进,目前视频模型可在收尾阶段生成声音,Autodesk 正在探索让更多源表演音频贯穿整体流程。 Flow Studio 基于云端,3D Editor 以保持高交互性为设计目标;Canvas 的生成时间取决于所选模型、镜头长度与分辨率,世界生成目前需要数分钟。平台面向个人制作者、3至5人的团队以及更大规模的工作室。Todorovic 将 3D Editor 视为原 Wonder Dynamics 平台的下一步,后者曾组合约 25 个机器学习、计算机视觉与生成系统,将 CG 角色置入实拍素材;新编辑器则把这些原本分离的输出集中到更易使用的导演环境中。

8月11日周二
  1. fxguide61

    Impossible Objects 如何用 HP ZGX Nano 上的 AI 模型增强 VFX 制作

    洛杉矶 VFX 公司 Impossible Objects 通过本地运行的定制 AI 模型与传统 CG、2D 合成相结合,扩展广告及影视项目的制作能力;本文由 HP 赞助,相关性能与工作流效果主要来自公司成员的介绍。团队在 ComfyUI 中建立面向制作的定制流程,使用内部拍摄素材微调开源模型,并以 Foundry Nuke、Adobe After Effects、SideFX Houdini 等工具完成传统 CG 和合成。 AI 负责人 Nhan Le 表示,通用 AI 视频模型尚不能满足汽车广告对写实度的要求,完全生成的镜头也受分辨率和色彩限制,因此团队不会直接向客户交付全生成镜头,而是提取生成式 AI 的可用部分并交由传统 2D 合成控制最终效果。内部模块可根据原始镜头随时间变化的灯光生成匹配结果,减少逐帧调整;针对汽车项目,团队还会持续调整模型对素材细节的记忆,以维持镜头中的细小特征一致性。 为满足本地计算与素材安全需求,工作室新增两台集成 NVIDIA GB10 Grace Blackwell Superchip 的 HP ZGX Nano G1n。团队使用 ZGX Toolkit 将 ComfyUI 任务发送到设备,并通过背部的 200 Gbps ConnectX-7 端口连接第二台设备;据 Le 介绍,这可增加可用内存,以加载更高分辨率模型和更长的 4K 视频片段,集成后吞吐量很快提升至原来的两到三倍。本地部署也让涉及品牌 IP 和专有设计的素材不必上传至云端模型,并可从内部拍摄到模型训练全过程追踪资产来源与所有权。 在虚拟制作方面,Impossible Objects 称其方法可从 LED volume 拍摄素材中推断和计算跟踪信息,用于场景延伸及 LED 画面清理,减少过去手工提取和重新应用跟踪数据的工作。公司未来计划把多台 HP ZGX Nano 组成统一集群,连接自有 NAS,并探索由多 Agent LLM 管理内部渲染农场;这部分仍处于搭建计划阶段。

7月17日周五
  1. fxguide84

    Foundry 发布 SmartRoto,以 AI 辅助 Nuke 转描关键帧制作

    Foundry 发布面向 Nuke、NukeX、Nuke Studio 和 Nuke Indie 的 AI 插件 SmartRoto,用于在保留艺术家样条设计与控制权的前提下,加速转描关键帧制作。它不会自动创建完整样条,也不是围绕分割蒙版描出轮廓的自动抠像工具;艺术家仍需在主体清晰可见的画面上将其拆分为合理的关节化形状,SmartRoto 负责让这些样条随序列中的主体移动、变形。年订阅价格为 499 美元,提供节点锁定与浮动许可证。 工作流区分两类关键帧。模型预测的是 smart keys,艺术家创建或修正的是 user keys;后者被视为确定依据,不会被覆盖。艺术家先在初始帧创建形状,再选择主体变化明显的画面建立关键帧,然后让 SmartRoto 为所选形状生成 smart key。若预测存在偏差,调整后的画面会成为锁定的 user key,再次运行模型时,修正信息会影响周围范围。控制粒度细化到单个形状,因此同一帧可以同时包含 user keys 与 smart keys。工具既可处理整段序列,也可限定输入、自定义或入出点范围,并提供关键帧精简工具,寻找可由插值表达的运动区间。 Foundry 表示,该系统既不依赖光流,也不从图像分割蒙版反推轮廓,而是依据图像特征直接传播样条,并利用多个形状之间的空间关系作为约束。样条仍可编辑且具备亚像素精度,也可按常规方式为生成的蒙版渲染运动模糊。模型接受过含运动模糊画面的训练,严重模糊时可能需要更多手动关键帧;部分遮挡可以处理,完全遮挡仍需设置形状生命周期。外观相同的角色也可能被混淆。 该项目约四年前在 Foundry 内部重新启动,模型和训练数据由研究团队从头构建;Foundry 称训练素材均获许可,模型可用于商业工作,全部运算在本地完成,不向云端传输数据。显存需求随分辨率和同时跟踪的形状数量变化,约需 8GB VRAM,高分辨率及大量形状会需要更多。 最终测试邀请专业转描艺术家在两周内分别使用普通 Nuke 与 SmartRoto 处理多种镜头,并随机安排工具使用顺序。第二周结束时最高达到 4 倍速度,但 Foundry 产品负责人 Adam Cherbetji 称该数字偏高,更稳定的结果是完成同一镜头约快 2 倍,且经常高于这一水平。文章还将其与 SIGGRAPH 2026 的 RotoShop 对比:RotoShop 从 SAMv2 等模型的分割蒙版拟合姿态绑定的 Bézier 样条,SmartRoto 则绕过蒙版,直接根据图像特征传播艺术家创建的样条;两种路线都把可编辑、高精度样条作为 VFX 转描的最终交付物。

    推荐理由:文章结合工作流拆解与专业艺术家测试,说明可编辑样条驱动的 AI 转描如何减少关键帧劳动及其适用边界。

7月14日周二
  1. fxguide62

    Jamie Hearing 解析 Clear Angle 如何以扫描连接 VFX 与神经渲染

    Clear Angle Studios 数字特效主管 Jamie Hearing 介绍了公司如何把人体、面部与环境扫描扩展到 Gaussian splatting、辐射场和机器学习辅助影像流程。本文依据 fxpodcast 的节目介绍整理,内容还包括作者 Mike Seymour 参观英国 Pinewood 设施及亲自接受人体扫描的经历,并非播客完整逐字稿。 Pinewood 的全身扫描系统由 24 台相机和多组 LED 灯组成,用于在静态姿势下获取人体几何与纹理;Clear Angle 已在全球部署 18 套此类设备,各相机针对身体不同区域校准,并在复杂部位提供更高精度。公司也在探索不以清理后的网格为终点的采集方式,通过神经渲染重现相机所见,以处理头发、反射和透明材质等传统重建中的难点。 其模块化 VCR 体积采集系统使用 40 台配备 Sony 传感器的机器视觉相机,可覆盖完整人物或多人,并提供同步灯光和高帧率采集。该系统由 Dorothy 头部采集装置演进而来,后者用于面部扫描、FACS 姿势和 4D 面部表演捕捉。Clear Angle 近期还把 DI4D 纳入工作流,利用其 4D 捕捉与 TopoTrack,在时间序列中维持拓扑和纹理对应,为皮肤、表情及纹理的非线性运动提供更连贯的参考。 环境采集方面,公司在冰岛等项目中组合 LiDAR、航拍、无人机与摄影测量,覆盖近距离纹理和大范围环境。Hearing 强调,关键不只是增加数据量,还要取得适合下游 VFX 决策的数据、元数据与原始传感器信息。随着机器学习工作流增加,扫描也开始被用作训练数据,用于完善角色、表演或神经渲染管线的最后 10% 至 20%。

7月10日周五
  1. fxguide73

    Beeble 发布 SwitchHDR,以 AI 将 SDR 视频重建为场景线性 HDR 素材

    Beeble 发布 AI 模型 SwitchHDR,用于从常规 SDR 视频推断 HDR 表示,并输出采用 AP0 色彩原色、符合 ACES2065-1 的场景线性 16-bit EXR 序列,面向电影、广告、修复、VFX 与其他专业后期流程。该模型已通过 Beeble 网页应用提供;fxguide 对其进行了测试,并采访了 Beeble 创始人兼 CEO Hoon Kim。 Beeble 称,SwitchHDR 使用真实 HDR 素材训练,目标不是把 SDR 信号简单扩展或映射到 HDR 容器,而是根据训练所得推断合理的 HDR 表示。文章同时强调这种重建无法找回画面中实际未被编码的信息,所得数值也未必在物理或数学上精确;其用途是为调色、合成以及将旧素材、档案影像、素材库内容、纪录片来源或旧 plates 纳入 HDR 母版提供更可信的处理余量。 SwitchHDR 支持由艺术家控制重建区域。用户可用亮度遮罩指定高光和阴影区域,再分别通过文本提示词引导重建;AI 处理可以只作用于选定区域,其余画面直接保留。这让创作者可以决定是否重建过曝窗口等区域,而不是完全依赖一键式黑箱转换。 fxguide 认为其结果优于许多自动 SDR-to-HDR 工具,但测试也发现,复杂纹理中的时间一致性仍有轻微问题。Kim 表示产品从后期需求出发,重点包括完整序列的时间一致性、ACES2065-1 16-bit EXR 输出,以及让艺术家通过遮罩和提示词决定在何处重建;仍然存在细节的区域由模型恢复,完全剪切的区域则交由艺术家控制重建方式。

6月21日周日
  1. CG Channel74

    CG 艺术家需要了解 Unreal Engine 6 的 10 件事

    Epic Games 在 Unreal Fest 2026 上披露 Unreal Engine 6 的架构与发布路线,重点不是图形能力演示,而是编程、内容分发和跨平台运营;CG Channel 据主题演讲及 Epic 博文整理了影响艺术家和制作团队的 10 项变化。 UE6 将合并传统 Unreal Editor 与 Unreal Editor for Fortnite,使同一套工具创建的游戏能够面向主机、PC、移动平台和 Fortnite 生态发布。引擎将以 UEFN 编程语言 Verse 为基础;Epic 计划让原本按单机方式编写的单线程风格 Verse 游戏代码自动分布到多台服务器。新的 Verse Scene Graph 则作为支持预制件式工作流与组合方式的组件框架,把材质、网格和 Niagara 系统表示为 Verse 类的派生类型,并借助编译器统一验证数据及相关代码。 随着新框架成熟,Epic 计划弃用 Blueprints 和 Actors,但早期版本仍会保留,并提供现有项目的转换工具。该决定在用户群体中引起争议,因为 Blueprints 长期为缺乏传统编程背景的艺术家和设计师提供了可视化脚本工作流。Verse Scene Graph 及更高层框架也旨在增强内容的可移植性,例如从 Fab 获取的车辆资产未来可能不再只是骨骼网格和动画,而是能在不同游戏中工作的完整 Verse 模块。 生成式 AI 将在 UE6 工作流中承担辅助角色。Epic 提到的方向包括缩短角色绑定、粒子系统设置、蒙皮骨骼权重和灯光调整等人工环节,并倾向于连接外部 AI 模型,而非运营自有 AI 服务。Unreal Engine 5.8 已加入 MCP server,可由 Claude、Gemini 等 LLM 通过自然语言控制引擎;计划明年初推出的工具还会把扩散模型接入 Unreal Engine,让离线制作的风格帧或建筑可视化能够使用三维场景的深度数据和法线贴图作为输入。Epic 称 LLM、生成式 AI 模型及 Codex 等 AI 编码工具将在 UE6 内容制作中发挥重要作用。 Epic 还计划把 glTF、USD 等现有开放标准作为 UE6 的一等格式;缺少适用标准时,则开放自身系统的规范、Verse API 和资产约定。UEFN 的版本控制系统 Lore 已以 MIT 许可证发布到 GitHub,可从小团队的零配置单服务器部署扩展到多区域、大规模部署;Epic 正把它迁移为内部主要版本控制系统,并计划在 UE6 上线时完成使用切换。 UE6 计划于 2027 年底进入早期访问,稳定版预计在其后 12至18个月推出,但 Epic 对这些时间使用了较强的约略表述。GitHub 上已经开放 UE6 开发分支,Epic 强调它并非 alpha 版本,而是用于提前展示开发方向。UE6 将包含主要的 UE5 技术,但会进行破坏兼容性的重大架构调整,升级路径预计类似 UE4 到 UE5,并提供部分项目转换工具;已经在 UE5 中弃用的旧粒子系统 Cascade 将被彻底移除。Epic 目前没有安排 Unreal Engine 5.9,5.8 之后可能直接过渡到 UE6,不过仍保留按需要发布 5.9 的选择。

4月16日周四
  1. CG Channel58

    Reallusion公布2026路线图,以混合AI扩展Character Creator与iClone

    Reallusion公布2026技术路线图,预告面向Character Creator和iClone的RTX渲染、Headshot 3、AccuFace 2、CC Wrap、Joint Corrective Morphs、AI Studio及iClone 9等工具。该文为Reallusion撰写的赞助内容,其中既包含免费更新,也包含尚待正式发布的产品与功能,相关性能描述来自厂商。 Character Creator和iClone将免费加入与NVIDIA合作开发的RTX渲染,利用RTX GPU与DLSS提供厂商所称的近实时路径追踪,并针对数字人头发、皮肤和次表面散射提供控制,同时支持动态时段、云层密度和大气运动调整。Joint Corrective Morphs也将作为免费更新,通过基于关节的变形系统改善复杂姿势下的肌肉形变和身体结构表现。 Headshot 3将使用Reallusion自研并训练的AI模型,从二维图像重建头部网格,改进拓扑、身份特征保留和比例;其功能还包括基于文本提示词的4K AI图像生成、可用贝塞尔调整的样条头形细化、镜头校正、纹理通道增强、遮罩笔刷及依据全身图像测量的身体匹配。正式发布前,购买折扣版Headshot 2的用户可通过预售优惠免费获得Headshot 3。 面向iClone的AccuFace 2采用针对Character Creator 5角色训练的新跟踪系统,支持实时摄像头和视频输入,并着重捕捉高频口型与细微面部动作。CC Wrap则可把AI生成模型、传统3D模型和服装网格适配到标准Character Creator拓扑,使静态网格进入CC与iClone动画流程;它还支持从图像参考生成3D服装并自动设置蒙皮权重。 AI Studio计划通过Reallusion AI Cloud服务,把3D预演转换为写实或风格化图像与视频,并利用iClone动作数据和参考素材控制角色及摄影机运动。iClone 9将支持为任意模型添加骨骼、在层级匹配的角色间重定向动作、自定义Control Rig、挤压与拉伸、弹簧动力学、次级运动及碰撞感知模拟。用户可通过订阅自动取得新版本更新,也可在软件正式发布后购买永久许可证。

12月18日周四
  1. Cinema Technology32

    《Cinema Technology Magazine》2025 年冬季刊现已出版

    《Cinema Technology Magazine》2025 年冬季刊以英国电影放映行业为重点,探讨技术将如何影响其下一阶段发展。该刊是一份关注影院行业技术的独立季刊,已出版三十余年,日常内容涵盖影院设计与建设、新产品评测、观点文章、地区及全球活动动态和影院案例等。 本期收录 IMIS 关于同色异谱(Metamerism)的近期研讨会、挪威影院大会回顾、Odeon 的可持续发展路径、HDR 采用曲线、Everyman Whiteley、音频相位、AI 动态及 BBFC 放映设施升级等内容;同时讨论影院触觉技术的潜力、汽车影院的未来、伦敦 VistaVision 放映,以及影院行业可从园艺中心行业借鉴的经验。

5月22日周四
  1. Cinema Technology45

    Cinema Technology Community 发布影院放映业白皮书《AI in Action: Insights from the Cinema Exhibition Frontline》

    非营利独立行业组织 Cinema Technology Community(CTC)发布白皮书《AI in Action: Insights from the Cinema Exhibition Frontline》,旨在帮助会员了解 AI 在影院放映业的当前应用及未来走向。 白皮书更新了 CTC 此前内容中的关键概念,并结合最新进展、案例与思考,介绍 AI 在影院排片、客户互动、营销、无障碍服务和技术运营等方面的实际使用情况;同时审视相关伦理与环境问题,并探讨实时节目编排、AI 智能体等潜在发展方向。 该白皮书面向 CTC 会员,可通过 www.cinema-technology.com 获取。CTC 同时继续提供免费的 Community Membership,影院行业从业者可在其网站注册。