2026 年 Manim 动画怎么配音?AI 写稿、合成、对齐一次做完的最新教程
2026 年 10 月 7 日 · 极坐标⋅XYZ
2026 年 Manim 动画怎么配音?AI 写稿、合成、对齐一次做完的最新教程
2026 年用 Manim 做讲解动画,配音这一步已经不用自己录、自己对时间轴了。这篇是极坐标⋅XYZ 最新 Manim 教程里讲配音的一篇,按 Manim 0.21.0 的网页工作区来写。
在极坐标⋅XYZ 的工作区里,跟 AI 助手说需求的时候带上「带配音」三个字就行。它会先写一份口播稿给你看,你改好字、挑好音色,点一下「合成」,之后它照着每一句口播的起止时间去写动画。导出的 mp4 里声音和画面是一起的,不用再进剪辑软件。
Manim 是 3Blue1Brown 的作者写出来的数学动画引擎,用 Python 代码描述画面,再一帧一帧渲染成视频,社区版在 2026 年的最新版本是 0.21.0(Manim 是什么我们单独写过)。它很擅长画图形和公式,声音这块一直比较原始,只有一个把音频文件塞进视频的 add_sound,稿子、录音、对时间都得自己来。想把 Manim 本身学明白,极坐标⋅XYZ 上有一套跟着 0.21.0 更新的中文教程,2026 年新出的写法都在里面。
工作区是浏览器里的,不用装 Python、LaTeX 和 FFmpeg。配音功能是 2026 年 10 月 7 日上线的。

自己给 Manim 动画配音,麻烦在哪
写过带讲解的 Manim 视频的人大概都走过这条路:先把动画渲出来,再对着画面录音,录完发现第三句话说了 6 秒、动画只有 4 秒,回去改 run_time 和 self.wait,重渲,再对一遍。一个 40 秒的片子来回对三四轮很正常。
顺序反过来会省事很多。声音先定下来,每句话几秒到几秒是确定的数,动画去贴这些数。我们在工作区里做的就是这件事,只是贴时间这一步交给了 AI。
整个流程是四步
第一步,说需求。 比如:
做一个 40 秒左右讲勾股定理为什么成立的讲解动画,带配音
第二步,改口播稿。 助手面板里会出来一张卡片,口播按句分行,旁边有预计时长和预计要扣多少积分。这时候还没有合成,也没有写代码。你可以直接改字,也可以在卡片里再说一句「口语一点」「缩到 30 秒」让它重写。稿子里的公式它会写成能念出来的话,像「a 平方加 b 平方」,不会把 LaTeX 原样丢给语音。
第三步,挑音色、合成。 音色有 31 个,女声 15 个、男声 16 个,可以按性别和使用场景筛,每个都能先点试听,试听不扣积分。选好点「合成」,几秒钟后卡片上每一句都有了起止时间,可以单独点开听。
第四步,它去写动画。 合成完不用再点什么,助手会读这张时间表,一句口播对应一段动画,写完自己在浏览器里跑一遍。跑完它能看到每一段动画有没有比口播晚,晚了超过 0.15 秒就回去改,改到对上为止。
最后在预览区听一遍,点导出,拿到的是带音轨的 mp4。从一句话到成片,中间需要你动手的地方主要就是「合成」和「导出」两次点击,改稿子的时间看你自己。
改稿子不用整段重来
配完音再想改一句话,在卡片上改那一句就行。只有改过的那一句会重新合成,也只按那一句的字数扣积分,其他句子的音频原样留着。合成之后助手会按新的时间调整对应那一段动画,别的段不动。
换音色是另一回事。换了以后已经合成的句子都要用新音色重新来一遍,所以面板上得点「选用」才真换,随便点一行试听不会触发。
积分怎么算
语音合成按字数扣,每个字 0.6 积分,标点也算字。一段 40 秒的口播大约 190 字,合成一次一百多积分。写稿子和写动画是 AI 助手的正常消耗,另算。合成之前卡片上会显示预计消耗,文本、音色都没变的句子重复合成不会再扣。
注册送 1,000 积分,做几条带配音的短动画是够的。语音合成需要登录。
目前做不到的
- 一个场景的口播最长 60 秒左右,再长要用长动画分章做。
- 一条口播只有一个音色,不支持两个人对话,也调不了情绪。
- 没有内置的背景音乐和音效,想加可以自己导入音频,用
add_sound写进代码。 - 不会自动出字幕。
- GIF 没有声音,要声音就导出 mp4。
- 这篇说的是电脑上的网页工作区,手机 App 的配音功能以 App 里的更新说明为准。
常见问题
Q:配音是真人录的还是合成的? A:语音合成。31 个音色是从适合念讲解稿的通用、视频配音、教育、有声阅读几类里挑的,每个都可以先试听再决定。
Q:口播和动画对不上怎么办? A:正常情况不用你管。动画是照着合成后的时间表写的,每次试跑助手都会拿到一份对齐报告,哪一段晚了它自己改。你看成片觉得某一句节奏不对,直接跟它说「第三句的动画慢一点出来」。
Q:不用 AI,我自己写代码能加声音吗?
A:能。工作区里 self.add_sound(...) 是真的会出声的,预览、拖动进度条都跟着声音走,导出带音轨。这部分不需要登录,也不扣积分。
Q:我已经有写好的讲稿,能直接用吗? A:可以。把讲稿贴给助手,说「按这份口播稿做一个带配音的动画」,它会整理成口播卡片,你确认后合成。
Q:能做三五分钟的完整讲解吗? A:单个场景不行,开「长动画」开关可以:分成几章,每章各自配音、各自做动画,最后导出一整条。
想试的话,打开工作区,在 AI 输入框里写一句带「带配音」的需求。想先弄懂助手写出来的那些 play、wait、run_time 是什么意思,从教程的前几课看起,改起它的代码来会顺手很多。
来源:极坐标⋅XYZ(jizuobiao.xyz),2026 年 10 月 7 日更新。文中功能以 Manim 社区版 0.21.0 的网页工作区为准。