一句话摘要
AI 虚拟人短视频获 47200 浏览
我们如何用 Claude 剪辑的一条 AI 虚拟形象 Reel 拿到 47,200 次播放 July 16, 2026 · 12 min read · View source ↗ AI Instagram Claude SEO
📢 我们品牌账号上一条 AI 生成的 Reel 有 47,200 次播放。我们团队里没人在里面。
↳ 没有相机。
↳ 没有影棚。
↳ 屏幕上没有脸。
↳ 没有需要预约、沟通简报或付费的演员。
我们唯一录制的东西,是一块屏幕。
下面讲讲是什么让那个数字有了意义。看看同一个账号上、发给了同一批受众、在同几周里,紧挨着它发布的那些 Reels。
— "Our AI avatar video in the Distribb.io instagram account"
那些数字再说一遍:607、1,933、2,188、2,365、2,969、3,547、6,379。
然后是 47,200。
在这里看实际视频:instagram.com/reel/DZrwttgT2ZC
先说清楚该给的功劳。Florian,我的联合创始人,用 Arcads 做了那一条。但我构建了一个开源 skill,达成了同样的效果。
在这里看开源 skill。
之后我也在 Distribb 内部重建了这套工作流,这样我们的 Accelerator 会员就能以"全程代做"的服务获得 AI 生成视频的创作和分发,而其他人都可以通过 Claude 自己跑同样的步骤。
我们试着复现它,只拿到 607 次播放
这就是为什么让虚拟形象的表情到位如此重要
我们用另一个虚拟形象重做了这条视频……
它只拿到 607 次播放
同样的脚本。触达少了 78 倍。
它的面部表情和所产生的动作,都稍微有点不对劲。不是坏掉,也不是卡通化。是"稍微"。那种在一张静止帧里抓不到、但在半秒视频里绝对漏不掉的错。
这些都不是新鲜事。Masahiro Mori 在 1970 年就预言了这一点,就在那篇给了我们"恐怖谷(uncanny valley)"这个词的文章里。
人人都知道那张图。几乎没人引用那段论证里在这里真正要紧的部分,它完全关于运动:
> "Its presence changes the shape of the uncanny valley graph by amplifying the peaks and valleys."
他的观点是,一个静止地待在谷底附近的人形,读起来只是"奇怪",而同样的人形一旦动起来,读起来就是"瘆人"。他的例子是一只假手:静止时过得去,一动起来就让人不安。
然后他说得更直白,拿一具尸体和一只僵尸做对比。同一样东西,其中一个在动。
我们的静止画面看起来没问题。它一动,就掉了进去。
Mori 在 1970 年写的是机器人。他提前 56 年描述了 AI 视频。
两道门,两道都必须打开
↳ 第一道门:虚拟形象必须有一秒钟动得像个人。
↳ 第二道门:脚本必须挣来另外那 33 秒。
错过任何一道,你就得到 607。
Instagram 自己会告诉你原因。打开任意一条 Reel,进入视频专属的数据分析。
— "Screenshot of Instagram engagement where they specifically list what impacts your views the most"
"各项比率按对触达的重要性排序。"
跳过率(Skip rate)排第一。在分享之上、在收藏之上、在评论之上。Instagram 在自己的仪表盘里告诉你,你的 Reel 能做的最重要的事,就是别被跳过。
一个动得不对的虚拟形象,会在第一秒就被跳过。一条跳过率高的 Reel 永远不会被分发。你花了那么多时间的脚本,永远没人听得到。这就是一条脚本已被验证的视频怎么会只做到 607 的原因。
现在说另一半,因为虚拟形象无法替你完成这部分:
答案引擎从来不看你的虚拟形象。
ChatGPT、Perplexity 和 Google AI Overviews 读的是你的字幕文本、你的文案和你屏幕上的文字。它们不看像素。在决定我们在自己的代做管线里该为虚拟形象花多少钱之前,我仔细研究过这一点,而它改变了答案。
所以虚拟形象的全部工作就是那第一秒。在那之后的一切——观看时长、评论、排名、一个月之后的发现——都是脚本的事。
我们的虚拟形象 Reel 在 6 月 17 日发布。一个月后我录制关于它的视频时,最新一条评论是 19 小时前的。它仍在被找到。没有任何虚拟形象能替你做到这一点。是脚本做到的。
Instagram 现在是一个搜索引擎,而且 Meta 允许 Google 和 Bing 索引来自成年用户专业账号的符合条件的公开 Reels,所以一条 Reel 能在信息流里、在 Instagram 搜索里、在 Google 里,以及在 ChatGPT 里被人发现——当有人问了一个你恰好回答过的问题时。
如果你还没读过脚本背后的那本手册,它在这里:Claude Helped me get 588,000 Views With Instagram Reels AI Can Cite (9-Step Playbook)
47,200 播放的脚本,逐字逐句
我把那条 Reel 的准确音频拉了出来。大约 34 秒,119 个词,没有一个是废话。
> "Claude can now get your customers from Google on autopilot. Instead of paying an agency $5,000 a month, you install one skill that turns your agent into an SEO lead machine. It researches what your buyers actually search for. It studies your competitors and finds the content gaps they're missing. It writes SEO articles built on original research, then publishes them straight to your site. It gets you backlinks from real businesses. And here's the part an agency can't touch. It gets you showing up in AI search too. So when someone asks ChatGPT what to use, you're the answer. If you want your agent to build your entire distribution engine, comment SEO and I'll send you the Distribb Skill."
再把它作为五个节拍(beat)读一遍,因为这才是真正的模板。
1. 趋势加结果。约 3 秒。
> "Claude can now get your customers from Google on autopilot."
2. 痛点与机制。约 6 秒。
> "Instead of paying an agency $5,000 a month, you install one skill."
一个点名的价格和一个点名的替代方案。观众确切知道自己正在被从什么里解救出来。
3. 证据堆叠。约 15 秒。
五个主张,每个一行。研究你的买家。研究你的竞品。写文章。发布它们。拿到外链。
每一行都是一次画面切换。这正是视频中段不下沉的全部原因。
4. 竞争对手说不出口的那件事。约 6 秒。
> "And here's the part an agency can't touch. It gets you showing up in AI search too."
5. 关键词 CTA。约 4 秒。
> "Comment SEO and I'll send you the Distribb Skill."
一句诚实的话:34 秒打破了我自己那条 15 到 30 秒的规则。是证据堆叠挣来了多出的那几秒。这是唯一一条我会允许虚拟形象视频打破的规则,而且我不会把它推到 45 秒。
还要记住:那条 607 的视频用的就是这个一模一样的脚本。
布局
三块叠起来的东西,顺序很重要:
↳ 屏幕录制在最上面。证据。
↳ 文案在中间。此刻正在提出的主张。
↳ 虚拟形象在最下面。说这话的人。
看看那张截图里的评论。florian.darroman: SEO. borja.obeso: Seo. mr.amarisoul: SEO. hockey_ice_time: SEO.
那就是关键词 CTA 在起作用。每一条都是一条自动发出的私信。
工作流
1️⃣ 从一张真实的脸开始
用一张你自己的照片,或者一个已征得同意的真人照片。
不是一个完全虚构出来的人。
这些模型是在真人上训练的,所以一张真实的参考图像会比凭空生成的东西动画得更自然。你在这里不只是挑一个长相。你是在给动画模型一些现实的东西去动。
如果你不想让自己的脸曝光,去问别人。拿到书面同意。
2️⃣ 用 GPT-Image-2 生成虚拟形象
把参考照片喂进去,生成你的出镜人。
你可以要求它把脸改到足以不再认出你起点的那个人的程度,同时看起来仍像一个真实的人类。
让构图保持无趣。头部和肩膀,素净的房间,合适的光线。你在做一个说话的头像(talking head),不是一张肖像。
别爱上那张静止画面。静止画面不是产品。
3️⃣ 在打开任何视频工具之前先写脚本
用上面那五个节拍,然后检查它:
↳ 第一行是否点明了一个趋势和一个结果?
↳ 前 10 秒里有没有一个数字?
↳ 每一个主张是否都有你能展示的画面?
↳ 是否只有一个带一个关键词的 CTA?
↳ 你能不能在不赶的前提下、35 秒内大声念完?
Claude 会替你写。把一条已经奏效的 Reel 的字幕文本给它,告诉它保持结构、改变角度。
一个好脚本救不了一个动得不对的虚拟形象。我们以 46,593 次播放的代价证明了这一点。但一个烂脚本会浪费一个好虚拟形象,而好虚拟形象是昂贵的那部分。
4️⃣ 用 Seedance 2.0 做动画,而这就是胜负所在
把虚拟形象图片喂进去,做动画,然后好好地看它。
不是拖进度条,不是暂停。是原速、在手机上、以它实际被消费的方式去看。单独看第一秒,看大约十遍。
AI 有各种怪癖。嘴会漂移。句子之间眼神会死掉。头会僵住太久,然后猛地一抽。眉毛会做出眉毛不该做的动作。这些在单帧截图里一样都看不到。
一直重新生成,直到动作不再让你难受。这是一个重试循环,不是一次成型,你应该为它留出预算。
这就是那 78 倍所在的一步。这篇文章里的其他一切相比之下都很便宜。
一个没人提醒你的坑:Seedance 通过 Replicate 和 fal 这样的第三方提供商运行,而它们可能对真人照片很敏感。如果你的生成一直被拒,通常就是这个原因,你得想办法绕过去。
5️⃣ 录制真实的屏幕画面
这是让它可信的那一半。
Florian 为那条 Reel 录了自己的屏幕。这就是它不让人觉得像广告的原因。
录得远远多于你需要的,用又长又干净的镜头录,这样代理之后可以剪:
↳ 产品页。
↳ 那个 Skill 的 GitHub 仓库。
↳ 一条正在运行的命令。
↳ 正在出现的输出。
↳ 一篇文章正在被发布。
你可以让 Claude 驱动浏览器并替你录下来。它不会像人手做的那样流畅。提示词给得好,它能接近。
6️⃣ 加字幕
大多数 Reel 是静音观看的。
如果你的话不在屏幕上,你刚花了那么多时间的脚本就等于不存在。
7️⃣ 在 Edits 应用里剪辑
虚拟形象在底部,字幕在中间,屏幕录制在顶部,每个主张切一次。
5 到 10 分钟。
我用 Edits 因为它是 Instagram 自家的应用,而我有个猜测:平台喜欢用它做的视频。那是个理论,我没有证据。
8️⃣ 以一个关键词 CTA 结尾
"Comment SEO and I'll send you the link."
Distribb 替我处理回复。ManyChat 也能做同样的活。
自动回复直接交付你刚刚演示的东西,而不是让观众在你 bio 里翻找它。
9️⃣ 披露这是 AI
给它打标签。Instagram 给了你这个开关。
你不可能比一个能大规模检测这个的平台更聪明,而且拿你的触达去换两秒钟的诚实,是一笔坏买卖。
🔟 把赢家变成系统
↳ 哪个角度带来了触达。
↳ 哪个钩子在最好的那些里反复出现。
↳ 哪个关键词带来了有购买意图的人。
↳ 哪条评论揭示了该做的下一条视频。
然后做赢家的另一个版本,而不是一个全新的概念。
而当一次生成的动作很顺时,留下它,复用它。这是我们用昂贵方式学到的部分。一个通过了第一道门的出镜人是一份资产,不是一个你随心情重新生成的设置。
整条工作流都住在 Distribb Skill 里的一个 markdown 手册里。带上你的 Seedance 和 OpenAI 密钥,Claude 会运行它。
这些视频在哪里会失败
我不会假装这个总能成功。
↳ 动画不是一个细节。同样的脚本,不同的生成,607 对 47,200。动作就是产品。
↳ 静止画面会骗你。你会看着一张图片批准它。你的受众是在运动中、在一秒内、拇指已经在动的情况下评判它。
↳ 近乎重复会被惩罚。从一个模板生成 50 条视频,就是你怎么被降权的方式。改角度,而不只是改字词。
↳ 虚拟形象仍然无法替你排名。它买下第一秒。字幕文本买下之后的一切。
这真正取代的是什么
不是你的脸。如果你能自己录,就自己录。它转化更好、免费,而且一个真实人类会自动通过第一道门。
它取代的是借口。
"我今天没时间拍。"
"我不喜欢上镜。"
"我的联合创始人在另一个国家。"
这些就是大多数人三个月什么都不发的原因。
Florian 和我身处不同国家。那条 Reel 还是发出去了,47,200 个人看到了它。
如果你想自动化这套系统背后的研究、SEO 关键词选择、脚本和消息投递,在这里试试 Distribb。
而如果你想让我们为你的公司做这些,给我发一个合作请求。
Thanks for reading!
Borja
P.S. 好奇 Distribb 如何成为你的 AI SEO 代理?这里是我的联合创始人 Florian 的解释:
Tags: # X # AI # Instagram # Claude # SEO # Marketing # Growth # Automation # Guide # Chatgpt Related articles Claude Helped me get 588,000 Views With Instagram Reels AI Can Cite (9-Step Playbook) I generated 588,000 views from Instagram Reels by spending about 15 minutes per day. And I only started posting 60 days ago.. Instagram Claude AI SEO
原文参考:https://maxed.wiki/posts/how-we-got-47-200-views-from-an-ai-avatar-reel-edited-with-claude/ (Maxed.wiki,本页为站内中文整理)