一句话摘要
用 Seedance 做播客日赚 300
如何用 seedance 2.5 做播客真正每天赚 $300 August 18, 2026 · 11 min read · View source ↗ AI Marketing Advertising Tiktok
关于用 AI 播客和 seedance 2.5 每天赚 300 美元这件事,那些卖课的人不会告诉你的核心是这样的。
这个玩法的表层版本现在到处都是。做一个 AI 播客,把片段发到 tiktok,通过创作者基金或赞助来变现。每个打着环形灯的导师都在教这个。而他们几乎全都在数字上撒谎,因为他们变现的是卖课,而不是他们正在教的那个播客玩法本身。
这个玩法的真实版本是行得通的。我们看着 AFNW 网络里的运营者把它跑得干干净净。但它行得通的原因,几乎跟那些表层指南告诉你的东西毫无关系。钱不在播客里。钱在你于管道四个节点上做出的具体技术决策里,而大多数运营者亏钱,是因为他们把四个全搞错了。
在我解释机制之前,先让我为那个真正能赚钱的版本辩护一下,因为大多数人不愿意接受的正是这个论证。
论证是这样的。AI 播客作为一种变现载体,不是一个内容玩法。它们是包裹在一个"载荷"(payload)外面的分发壳,而钱在载荷里。如果你做 AI 播客是为了娱乐别人,你将赚到 0 美元。如果你做 AI 播客,是把它当作一个可变现动作的投递工具,你会每天赚 300 到 1000 美元,取决于你的漏斗有多紧。区别不在播客。区别在于你用播客来做什么。
我观察过的每一个试图把 AI 播客当纯内容来变现的运营者,都失败了。每一个把播客当作"别的东西的漏斗顶部"来对待的运营者,都在印钞。娱乐派在追那每千次观看三美分的创作者基金,然后纳闷为什么什么都不灵。那些把播客当作一个 app CPA 报价或一笔 affiliate(联盟)佣金的包装壳的运营者,才是持续稳定每天做到 300 的人。
有了这个论证摆在桌面上,下面是这个玩法用 seedance 2.5 到底怎么跑的技术拆解,深到几乎没人公开发布过。
管道有四个节点,运营者要么在整场游戏里赢,要么全输。角色生成、脚本数学、seedance 生成本身,以及后期分发。每一个都有一个具体的技术要求,看起来无足轻重,实际承重。跳过任何一个,数字就不成立。
先从角色生成讲起,因为这里正是大多数运营者在还没渲染出一个片段之前就死掉的地方。
能跑通的播客格式,是两个 AI 角色在对话,每个片段大约九十秒,一个角色负责大部分说话,一个负责反应。这个格式之所以特别有效,是因为"反应角色"承载了拟社会关系(parasocial)的重量,而"说话角色"承载了载荷。观众看播客不是来听信息的。他们看,是为了感觉自己像是在偷听两个自己认识的人说话,而如果反应角色读起来像真的,观众就会把整场对话连带地当成真的。
这里的技术要求是,在你打开 seedance 之前,两个角色都需要先锁定好参考图(reference sheets)。这是 90% 的运营者会跳过的一步,也正是为什么他们的播客到第三个片段就变得诡异(uncanny)的原因。每个角色都需要先用一个照片级写实人像模型生成一张头像,再从那张头像作为参考生成一张全身图。这些参考图作为图像参考,随每一次后续的 seedance 生成一起跑。绝不要重新生成、绝不要重新裁剪、绝不要让模型在片段之间重新发明这张脸。
具体到播客场景,能跑通的构图是一个双人中近景,两个角色略微朝向彼此,两人都戴着耳机,说话角色能看到麦克风,中性影棚背景加上柔和的室内灯光。seedance 2.5 处理这种构图很好,因为它对模型来说读起来很熟悉。试图在刁钻的角度或灯光上玩花样,模型就会漂移。
身份锚点(identity anchors)在这里比在单人 UGC 里更重要。两个角色都至少需要一个小的固定瑕疵。雀斑、一颗痣、一个特定的发丝走向、眉毛的一点点不对称。没有锚点,模型会在多次生成里把它们平均掉,到第五个片段它们看起来就像是不同的人了。我们见过整个播客战役崩掉,就因为运营者没有锁锚点,观众到第三集就发现角色前后不一致了。
现在讲脚本数学,这是整个玩法里最技术性的部分,也是运营者最一致搞错的部分。
seedance 2.5 会拉伸说出来的台词,去填满你要求的任何片段长度。一个九十秒的播客片段,按自然的对话节奏,在每秒 3.5 个词的基线速率下大约是 315 个词。但播客里的对话节奏跟"单口对着镜头"的节奏不是一回事。真实的播客对话有停顿、有抢话、有笑点节拍、有语气填充词。如果你把脚本写成 315 个密集的词,模型就会用机关枪的速度把它们说出来,四秒之内就读起来很假。
修法是以更低的词密度写脚本,让 seedance 用呼吸和微行为去填满空间。我们已经定下来,九十秒片段大约用 240 到 260 个词,并在提示词里写明停顿和微行为的舞台指示。像"停顿一个节拍,思考一下,然后继续"或"轻轻点头,然后回应"这样的台词,会告诉模型在句子之间真正留出空间,而这正是让播客读起来真实的东西。
在那 250 个词里,载荷必须坐在一个特定位置。钩子活在前六秒,大约 20 个词。那个让观众停止滚动的扰动或主张。中间六十秒是内容所在,而这里正是运营者试图搞娱乐、从而输掉整场游戏的地方。中间应该朝着载荷构建,而不是分散它的注意力。最后十二到十五秒是载荷落地的位置,也就是 app 提及、联盟行动号召(call-to-action),或你希望观众采取的某个具体动作。
这个结构不容商量。我们把每一种变体都测过了。钩子在前,载荷在后,中间朝着它构建。任何别的安排都会让转化掉 50% 到 70%,即便观看数保持不变。观看不是那个指标。被转化为载荷动作的观看,才是那个指标,而每天赚 300 的运营者理解这一点的程度,是娱乐优先的运营者永远达不到的。
现在讲 seedance 2.5 生成本身,这里的技术拆解开始变得具体,因为 seedance 跟 seedance 2.0 是一个非常不同的模型,而互联网上的大多数指南还是为 2.0 写的。
2.5 里对播客生成重要的两个变化,是三十秒单镜头能力,以及扩大的参考预算。seedance 2.0 把片段封顶在 15 秒,所以一个九十秒的播客需要六个拼接片段,还带着拼接带来的所有身份漂移和音频接缝问题。seedance 2.5 用三个镜头做满九十秒。这对播客来说是巨大的质量升级,因为你可以在一个镜头里hold住一整段对话节拍,而不必试图在六个镜头之间保持身份一致。
参考预算的扩大是第二个大变化。2.5 最多接受 30 张图片、10 段视频和 10 段音频作为参考。对播客来说,真正有用的预算要小得多。我们跑的是两张角色参考图(每角色一张)、一张环境参考(一张影棚布置的照片)、以及一段音频参考(主说话者的声音锚点)。就这些。再多参考,就开始引入漂移,因为模型必须在太多信号之间取平均。
能跑通播客片段的具体提示词结构是:
以格式声明开头。"realistic authentic AI podcast clip, medium two-shot, 16:9, both characters visible, studio lighting.(逼真、真实的 AI 播客片段,中景双人镜头,16:9,两个角色可见,影棚灯光。)"
然后角色一致性行。"keep both characters consistent with the reference images. their voices match the reference audio exactly.(让两个角色与参考图像保持一致。他们的声音与参考音频完全匹配。)"
然后场景搭建。"seated across from each other at a podcast desk with microphones, both wearing headphones, subtle studio background with acoustic panels.(隔着一张带麦克风的播客桌相对而坐,两人都戴耳机,带有声学板的淡雅影棚背景。)"
然后用一个词给出播报方向。"delivery: casual, engaged, unrushed.(播报:随意、投入、不慌不忙。)"
然后带说话人归属的精确对话,用引号。"character A says exactly: [line]. character B reacts with a small nod, then says exactly: [line].(角色 A 一字不差地说:[台词]。角色 B 轻轻点头作为反应,然后一字不差地说:[台词]。)"有了"says exactly"这个前缀,seedance 就会逐字逐句给台词做口型同步。
然后是硬规则。"characters stay seated the entire clip. no on-screen text or captions. reference audio only, no music.(角色在整个片段里都保持坐着。没有屏幕文字或字幕。只用参考音频,不要音乐。)"
这个结构以大约 60% 的命中率产出可用片段。意思是十次生成里,六个好到能发,三个需要小幅重跑,一个带有需要完全重新生成的根本性伪影。这显著好于 seedance 2.0 上 20% 到 30% 的命中率。
在 2.5 播客生成上要盯的具体伪影有:反应角色的口型漂移(不说话的角色的嘴有时会在说话者说话时动起来,读起来像坏了)、麦克风位置不一致(麦克风在镜头之间漂移)、以及眼神接触循环(两个角色整个时长都不自然地互相盯着,而不是自然的"看开又看回"模式)。眼神接触循环的具体修法,是把扫视行为写进提示词:"around second thirty, character A glances down at their notes for a moment, then looks back up.(大约第三十秒,角色 A 低头看一眼笔记,然后重新抬头。)"
现在讲分发,这是真正赚钱的地方,也是这个玩法的论证站住或垮掉的地方。
每天赚 300 的运营者,不是从 tiktok 创作者基金赚的。那个数学在任何现实的播客内容观看量下都不成立。一个播客片段的一百万次观看,通过创作者基金大约只能付 30 到 60 美元,取决于你的地区和账户状态。即便每天一千万次观看——这对播客内容来说几乎不可能持续做到——你也就是每天 300 到 600 的创作者基金收入,而且你的账户会因推这么激进的量而在一个月内被去货币化。
每天 300 的真正收入,来自把载荷路由到一个可变现的动作。有三种模型能跑。
第一种是直接的 app CPA。播客片段的载荷,是对某个"按验证安装付费"的 app 的提及或屏幕提示。通过 AFNW 这样的网络,相关 app 品类的验证安装佣金,根据 app 的 LTV 和地区,大约在每个安装 $2 到 $5。按这个费率,每天 300 需要每天 60 到 150 个验证安装,这在一个扎实的播客账户上,每周两到三个爆款片段就能达到。
第二种是 affiliate CPM。载荷不路由到 app 安装,而是路由到一个按每千次合格观看付费的联盟报价。这个现在少见了,但对特定垂直领域(金融 app、教育 app、约会 app)依然有效。数学大约是每千次合格观看 $1 到 $3(合格指美国地区,而非创作者基金货币化的观看),所以你需要每天 10 万到 30 万合格观看才能做到 300。如果你的播客选了一个有高价值观众画像的品类,这是可行的。
第三种是赞助,单片段收入最高,但需要真实受众。播客片段的赞助,根据垂直领域和平均观看量,每次植入跑 $500 到 $2000。每周一个赞助,低端就是每天 300。这是大多数运营者瞄准的模型,也是最难真正拿到的,因为赞助商想看track record和稳定的受众指标。
每天做到 300 的运营者最常见的实际模型,是一个混合体。一些来自 app 安装的 CPA 收入,一些——
seedance 渲染片段 & 脚本写载荷。affiliatenetwork.com 是把观看量变成收入的东西。
加入 affiliatenetwork.com,用 RPM 交易做一个每天赚 $300 的剪片人。Tags: # X # AI # Marketing # Advertising # Tiktok # Growth # Guide # Affiliate Related articles How Li Jiaqi made $1.7B in 12 hours using TikTok farm. And how to set up one. Behind half the viral content on your feed isn't a person. Tiktok Marketing AI Advertising
原文参考:https://maxed.wiki/posts/how-to-actually-make-300-a-day-with-podcasts-using-seedance-2-5/ (Maxed.wiki,本页为站内中文整理)