跳到正文
10月6日周二
  1. postPerspective64

    Ambassadors 向所有用户开放视觉 AI 工作流平台 Mosa

    阿姆斯特丹创意制作公司 Ambassadors 已向所有用户开放其内部开发的视觉 AI 工作流平台 Mosa。平台于 6 月首次亮相,随后由 10 个品牌和代理机构参与封闭测试,其间搭建了 40 多个工作流并生成 500 多项资产。 Mosa 源于 Ambassadors 自身制作中的工具衔接问题。随着 AI 被用于更多项目,团队需要在图像、视频和提高分辨率等不同工具之间手动传递提示词、数据及品牌要求;其艺术家、制片人与技术人员此前会分别使用 Fal、Higgsfield、Magnific 和 ComfyUI。Mosa 将 AI 模型、数据与流程步骤整合到一个可视化工作流中,使团队能为不同项目、格式和市场复用流程,并从同一画布连接不同 AI 提供商和数据源。 Ambassadors 称,一个过去需要把单一主概念手动适配至 10 个市场的项目,现在可作为一个工作流运行。Mosa 能提取核心信息,使用适合的模型生成本地化文案与视觉内容,依据品牌规范检查输出,并一次交付完整资产集。平台支持图像、视频和音频工作流;每个步骤会显示所用资源及成本,让团队在运行前了解费用。AI Agent 可帮助用户搭建和理解工作流,无需编程。 公开上线后,个人创作者和自由职业者可按实际用量付费;工作室、代理机构及企业内部创意和营销团队可使用项目共享、完整工作流协作、成员用量上限、共享预算分配和 SSO。面向大型组织的企业方案包括专属客户经理、解决方案工程师、定制培训和由 Mosa 团队设计搭建的托管工作流,并可按需接入用户自己的 API keys。

10月1日周四
  1. Deadline69

    Ted Cruz 阻止参议院通过《NO FAKES Act》

    美国参议员 Ted Cruz 周三提出异议,阻止参议院在中期选举休会前通过旨在限制未经授权 AI 深度伪造的《NO FAKES Act》,法案因此暂时搁置。该法案拟赋予个人授权他人以数字方式复制其声音和肖像的权利,并为新闻、纪录片、体育、传记作品以及评论、批评和戏仿等用途设置排除条款。 Cruz 表示法案对讽刺和政治评论使用个人形象的例外仍不充分。他担心所谓“真正的戏仿”是否符合例外可能由大型科技平台判断,并以 The Babylon Bee、The Onion、洛杉矶市长候选人 Spencer Pratt 使用 Karen Bass 的 AI 深度伪造形象,以及 Donald Trump 在政治传播中使用 AI 图像为例。Cruz 称自己希望法案通过,但要求其团队未来数周与提案人继续加强言论自由保护。 主要提案人 Marsha Blackburn 反驳称,法案已经为多类言论提供广泛例外,相关第一修正案争议将由法院而非科技平台裁决。她表示,内容被移除者可提交反通知;若受害者要求内容继续下架,将在 14 天内触发司法审查,否则内容可恢复。法案获得多家娱乐业工会、制片厂、唱片公司及 OpenAI、Google/YouTube 支持,已于 6 月通过参议院司法委员会;Cruz 当时投了赞成票,但已要求在提交全院前处理政治讽刺适用问题。

9月30日周三
  1. ProVideo Coalition48

    《Remembering》:首部以作者本人克隆声音朗读的有声书

    TecnoTur 为 Anna Pittman 的首部著作《Remembering: Wholeness and Awakening through the Twelve Steps》制作并发行多个版本,其中英文有声书采用作者本人的克隆声音朗读。全书定稿为 308 页、63,325 词;考虑到真人配音需要投入大量录制、补录和编辑时间,且 Anna 希望保留自己的声音,团队基于制作周期和预算选择了声音克隆方案。用于克隆的真人录音来自 Ernesto Morales-Ramos 此前为 Anna 的音频冥想项目所做的录制,使用 MXL 770 电容麦克风。 在比较 FlexClip、ElevenLabs、Descript、DaVinci Resolve Studio 等方案后,作者为本项目选用 ElevenLabs Pro 计划。导入书籍的 ePUB 版本后,ElevenLabs 分析了全部 63,325 词,列出其无法确定读音的术语和人名,允许制作人员试听系统的初步发音,并在需要时以注音方式输入正确读法。文章作者将其称为“主动式配音词汇表”;该功能可为制作提供起点,但不能替代人工逐章、逐节试听,以及对生成语音进行必要的手动修改。 互动有声书采用支持章节和段落导航的 M4B 格式,主要通过 Remembering.info 直接销售,同时提供 ePUB 版本;网站另设 M4B 与 ePUB 使用说明页面,并将链接加入页脚及购买后的自动邮件收据。有声书也可通过 Spotify 获取,但作者所得版税较低。纸质书在文章发布时已面向阿根廷、澳大利亚、智利、哥伦比亚、厄瓜多尔、墨西哥、波多黎各、西班牙、乌拉圭、英国和美国销售,各地区页面以当地货币显示价格。

  2. TheWrap32

    创作者谈 AI:它代表未来,但使用时必须对受众保持透明

    在 TheWrap 于周二举行的首届 AI Creator Day 上,多位创作者认为,AI 已成为无法回避的行业趋势,其提高创意变现能力和扩大受众范围的潜力值得探索,但使用者必须向受众保持透明,并面对粉丝抵触与应用边界尚不清晰的问题。身兼创作者、喜剧演员和配音演员的 Vincent Marcus 表示,他已在为配音工作可能消失做准备,因此全面投入 AI;他参与为 AI 社交平台 Cantina 的生成式机器人角色配音,希望借此将创意转化为收入。YouTube 创作者及 MOLO Fertility 创始人 Rebecca Zamolo 则强调,应承认行业正在向 AI 发展,并坦诚告知受众如何使用它。 文章列举了 AI 进入创作者工作流的多种路径:通过 Cantina 等第三方公司,直接使用 ChatGPT、Claude,或采用社交平台内置工具。YouTube 的 AI 工具可对标题和缩略图进行 A/B 测试;Ask Studio 是熟悉创作者频道的专用 AI 智能体,可辅助数据分析。TikTok 的 Symphony Creative Studio 支持文本生成视频、图像转动画和数字化身;Instagram 的 Muse 则用于管理工作流、分析账号活动和规划内容。 Zamolo 与丈夫 Matt Slays 表示,AI 配音扩大了其 YouTube 频道的国际覆盖面:美国受众占比在一段未说明具体长度的短时间内由 65% 降至 35%,反映海外观众比重上升。Slays 认为,这使团队无需投入同等程度的工作便能显著拓展市场。不过,他们仍在测试哪些 AI 用法可以被接受;当应用越界时,观众通常会在评论区指出,这种反馈也构成学习正确使用 AI 的过程。 与会者对“AI 创作者”标签态度较为务实。Destorm Power 认为创作者无法决定外界如何称呼自己,Bernie Su 则表示规则正在改变,只能继续创作并观察观众反应。多名参与者同时反对“AI 必然扼杀创造力”的看法:Cantina 合作伙伴高级总监 Katherine Rundell 主张,技术让更多大胆构想得以实现,因此创意在 AI 时代反而更重要。上述观点来自会议讨论及个别创作者案例,并不构成对所有 AI 工作流或受众反应的普遍验证。

  3. TheWrap28

    Stability AI CEO:一年后,我们的 AI 工具将成为所有音乐制作的必需品

    Stability AI CEO Prem Akkaraju 在 TheWrap 首届 AI Creator Day 上表示,公司不会脱离专业创作者开发应用或 AI 模型。他认为,“没有创作者参与却去创造创作者工具”是不可理解的,并预计一年后,Stability AI 的音频平台将在音乐,以及游戏、创作者内容和电影的音频制作中变得不可或缺。这是 Akkaraju 对未来的判断,并非已经实现的行业现状。 Stability AI 以 Stable Diffusion 和 Stable Image 系列闻名,这些工具可让个人和企业通过文本提示词创建、编辑照片级真实感图像。公司试图凭借与媒体行业的直接联系拓展娱乐市场:Universal Music Group、Warner Music Group 和 Sony Music Group 作为战略合作伙伴及投资者参与了近期融资,导演 James Cameron 则担任公司董事。曾任 Weta Digital CEO 的 Akkaraju 表示,公司在开发工具时会借助 Cameron 等业内人士及相关合作关系;他以编码工具为例,认为这类模型之所以具有较高投资回报,是因为开发者清楚优秀代码与输出应达到何种标准,而同样的方法也可在合适专家参与下用于其他媒介。 文章同时指出,AI 正逐渐进入娱乐行业,一些制片公司和好莱坞从业者已低调采用相关技术,创作者也借此提高内容生产效率,但公众污名和粉丝抵触仍然存在,科学类 YouTuber Hank Green 等人曾遭遇反弹。Akkaraju 将时间与资金称为娱乐业的“两大祸害”,主张创作者在能够减少这两项成本、提高产出并增加用于故事创作时间的情况下使用 AI。

9月27日周日
  1. Production Expert43

    生成式 AI 与原创性:我们需要谈谈“房间里的大象”

    Production Expert 作者讨论生成式 AI 在音乐与音频创作中的原创性问题。作者并不反对所有 AI:清理原本不可用的音频、整理和分类大量音效,以及修补录音中的掉音,都可为专业音频工作带来实际价值。文章针对的是从提示词直接生成文字、音乐、图片或视频的生成式 AI,并暂时搁置大部分伦理争议,集中追问现有技术能否产生真正的原创性和偶然发现。 作者的核心判断是:生成式 AI 的输出在最初的“魔法感”消退后,往往会迅速显得雷同;这并非只因算法尚不成熟,而与其依据既有数据预测最可能后续内容的架构有关。人类创作中的突破常来自意外及对意外价值的判断。文章以 Townhouse Studios 的 Stone Room 中因 SSL 调音台 talkback 麦克风保持开启并经过 gate,而偶然形成 gated reverb 的故事为例:新声音并非预先规划,而是有人发现意外结果值得保留。作者认为,当前生成式 AI 虽会产生“幻觉”等错误,却不能自行区分值得发展的“快乐意外”与普通故障;调节 temperature 只能在较可预测的平庸输出和更失控的无用结果之间变化,并不会自然带来有意义的偶然性。 为验证这一点,作者用 Suno 尝试生成“从未有人听过的音乐”和“原创的东西”,得到的都是三首中庸流行歌曲;进一步要求创作带有 5/7、风笛和 50 年代鼓组的摇滚/流行抒情曲,结果在作者听来只是 80 年代 Whitesnake、《Braveheart》与 The Skids 的混合,既不原创也不好听。作者承认未来可能出现采用不同设计、真正突破现有局限的系统,但强调那并非当前技术,因此“以后算法会改善”不足以反驳其对现阶段生成式 AI 架构的批评。 文章也回应“人类同样从既有作品中学习”的观点。作者承认人的创造会受到书籍、音乐、电影、电视、经历与交流影响,文中还提到一些研究把这种影响估为约 70%;但他认为,将人的经验性创作与生成式 AI 的模式预测等同起来是错误类比:Suno 可以写一首关于失去的歌,却从未体验过失去。作者据此把当前生成式 AI 概括为“通过挪用进行迭代”,并指出 Suno 等公司承认使用受版权保护的材料,同时主张这属于“合理使用”。最后,他把部分 Suno 输出播放给妻子;对方认为音乐很糟,并在未受提示的情况下主动询问是否由 AI 生成。作者将这一有限的个人测试作为其观点的现实印证,而非普遍听众研究。

9月24日周四
  1. Variety19

    原版《Willy Wonka & the Chocolate Factory》Oompa-Loompa 演员 Rusty Goffe 听到 AI 重现 Gene Wilder 声音后落泪:“再次听到它很美好”

    据 Variety 标题,曾在 1971 年版《Willy Wonka & the Chocolate Factory》中与 Gene Wilder 合作、饰演 Oompa-Loompa 的 Rusty Goffe,听到 AI 重现的 Wilder 声音后“流下了一滴眼泪”,并表示再次听到这个声音“很美好”。 正文仅取得开头且在提到 Netflix 的收购事项时截断。已提供部分还写到,Goffe 本月早些时候接受 Zoom 采访,结束通话时以影片风格的用语“Have a scrumdiddlyumptious day!”道别;除此之外,材料未提供 AI 声音重现的制作方法、使用场景或 Netflix 所收购对象等完整信息。

  2. TheWrap53

    Netflix《Wonka’s The Golden Ticket》如何用实拍效果与魔术幻象还原巧克力工厂

    Netflix 竞赛节目《Wonka’s The Golden Ticket》邀请澳大利亚魔术师 Adam Mada 担任顾问,以实拍效果和真实魔术幻象完成部分挑战与淘汰环节,包括让不知情的参与者在同伴和摄影机前消失。制作方希望效果在摄影机内真实发生,尽量不依赖后期特效或剪辑;设计还必须同时骗过被消失者、坐在其对面的搭档以及镜头前的观众。 由于每位不知情的测试者只能被骗一次,Mada、场景设计师 Chris Batson 及团队在悉尼复制了整套场景,并使用不同测试者反复验证机关,以确保正式拍摄时的惊讶反应真实。真人秀无法像剧情片一样停机重拍,其中 Bubble Jeopardy 淘汰环节只有一次机会,并在其他参赛者现场观看时完成。 WonkaVision 2.0 是一座全白色的大型复杂场景,缺少魔术舞台常用的隐藏条件,最多需要同时让九个人消失并被传送进电视画面。团队还为 Oompa-Loompa 从屏幕中直接取出物体的幻象提出约四种方案,并通过实体模型和现场演示向各部门沟通,直至开拍前仍在调整。节目另经 Gene Wilder 遗产方同意,使用 AI 重现他的声音作为旁白。首批七集现已在 Netflix 上线,最后两集将于下周三推出。

9月22日周二
  1. RedShark News72

    Adobe Premiere 移动版免费登陆 Android

    Adobe Premiere 移动版现已在 Android 上免费提供,距离 iPhone 版推出已有一年。应用可从 Google Play Store 下载,要求设备运行 Android 13 或更高版本,并至少配备 5 GB RAM。 该应用提供逐帧精确剪辑和多轨时间线,可叠加视频、音乐、文字、旁白及效果;Enhance Audio 可一键降低背景噪声并改善采访、旁白等录音的清晰度。用户还可使用创作者模板或自定义模板,添加 Adobe Stock、自有文件或提取音频中的素材,并编辑和导出最高 4K 视频。应用无需强制登录,没有广告、水印或升级提示。 Firefly 驱动的生成式 AI 功能包括 Generative Fill、Image-to-Video 和 Generate Sound Effects。Android 版目前仍缺少 iOS 版的关键帧、节拍检测以及在 Premiere 桌面版继续编辑等功能,Adobe 表示这些功能后续会加入。免费版覆盖基本视频剪辑功能,额外的生成额度和存储空间需付费升级。