1Step 1: 上传歌曲
拖入 MP3、WAV、FLAC、AAC、OGG 或 M4A 音频文件(最大 100MB)。免费注册即送积分,也不需要手动输入歌词。你的歌词会成为后续所有画面的创意来源。
两者都从同一首歌开始,区别在于观众应该把注意力放在哪里。
| Detail | 歌词视频 | AI 音乐视频 |
|---|---|---|
| 主要画面 | 歌词文字是屏幕中心 | 生成场景承担更多视觉叙事 |
| 最适合 | 歌词频道、跟唱、粉丝剪辑和社媒歌词片段 | 官方视觉、艺人故事、发行 campaign 和没有拍摄素材的歌曲 |
| 歌曲输入 | 音频被转写、同步,并围绕可读歌词设计 | 歌词引导场景想法、情绪、节奏和视觉方向 |
| 观看结果 | 粉丝能跟住并唱出每一句 | 粉丝能感受到这首歌背后的世界和故事 |
LyricVideoMaker 会保留歌词层能力,所以当文字很重要时,AI 音乐视频也可以保持可读。
生成我的音乐视频
1拖入 MP3、WAV、FLAC、AAC、OGG 或 M4A 音频文件(最大 100MB)。免费注册即送积分,也不需要手动输入歌词。你的歌词会成为后续所有画面的创意来源。
2AI 自动从音频转写歌词,并逐行同步到节拍 — 支持 50 多种语言。然后读取歌曲的情绪、主题和情感走向,生成匹配的视觉场景。点击任意歌词行即可编辑。
3发布前先看完整预览。确认画面匹配歌曲的能量和情绪,然后选择导出:16:9 适配 YouTube,9:16 适配 TikTok、Reels 和 Shorts,1:1 适配信息流。免费导出带水印版本,无需订阅。
通用 AI 视频工具让你在文本框里描述场景。LyricVideoMaker 从你的真实歌曲出发 — AI 读取歌词内容,生成匹配情绪的画面,让音乐视频真正属于这首歌。
AI 根据歌词的含义、情绪和情感走向驱动场景生成。你不需要写视频提示词 — 你只需要上传一首歌。

视觉方向来自歌词含义、情绪和情感推进,而不是让你重新想一段独立的视频提示词。
AI 读取歌曲的内容和情绪,生成匹配的场景 — 不是随机素材,不是通用动效。画面像是属于这首歌的。
AI 场景在背后播放时,歌词仍然可以显示在屏幕上,方便粉丝跟住歌曲。
从歌词生成 AI 音乐视频,是用歌曲内容规划视觉场景,而不是只把歌词当屏幕文字。LyricVideoMaker 从音频开始,自动转写并同步歌词,读取情绪和故事,生成场景图,并让你预览视觉叙事和歌词可读性如何共存。
输入
只接受音频上传:MP3、WAV、FLAC、AAC、OGG、M4A,单个文件最大 100MB。
歌词
AI 从人声自动转写,支持 50 多种语言自动识别,导出前每一行都能修改。
同步
按节拍和演唱节奏做逐行时间轴,不是把字幕粗暴贴到固定位置。
画面
先做分镜规划,再生成匹配歌曲情绪的 AI 场景图,歌词始终是主角。
导出
保留原始音频导出 MP4,支持 16:9、9:16、1:1,适配 YouTube、Shorts、TikTok、Reels 和信息流。
开始
免费积分起步,可以先跑完整预览,再决定要不要继续投入这首歌。
最重要的判断是:文字是主视觉,还是场景是主视觉。两者都可以使用 AI,但解决的是不同发行需求。
| 判断点 | 实用建议 |
|---|---|
| 歌词视频 | 文字是主视觉,场景服务可读性和节奏。 |
| AI 音乐视频 | 场景是主视觉,歌词可以引导故事或选择性出现。 |
| 适合歌词频道 | 歌词视频,因为粉丝是来读和跟唱的。 |
| 适合故事叙事 | AI 音乐视频,因为画面能承载角色、象征和情绪。 |
| 主要风险 | 歌词视频怕文字难读;音乐视频怕场景随机。 |
| 混合方案 | hook 用歌词清晰度,器乐或叙事段落用 AI 音乐视频场景。 |
渲染前可以按这些点检查,尤其是同一个项目要导出多个平台画幅时。
AI 音乐视频生成器把一首歌变成场景驱动的画面,同时让歌词清晰可读。真正重要的判断发生在渲染之前 —— 下面是值得记住的几条原则。
场景生成能给一首歌建出完整世界,但让角色每个镜头都一模一样,比保持情绪、色调和符号一致更难 —— 所以要在预览里逐场检查。
歌词是观众跟着走的主线,不是最后才贴的字幕。顺序永远是先转写、再对节拍对轴、再设计画面。
AI 负责转写、对时间、生成场景;风格对不对、断句改不改、要不要竖屏方屏导出,仍由你判断。
观众不该在「读词」和「看画面」之间二选一。对比度要强、行要短、动效要克制,让画面帮歌词而不是抢戏。
第一遍看文字抓转写错误,第二遍听节奏抓提前或滞后的行,第三遍看平台适配,确保手机信息流里也读得清。
一个项目同时产出 16:9 完整版、9:16 竖屏和 1:1 方形,不用重打歌词、不用重做时间轴,多平台保持一致。
歌还在耳朵里时就做歌词视频:更快听出别扭断句、更早发现听错的词,也更容易判断哪里该加视觉能量。
导出前做一次快速复查,很多质量问题还没变成返工就能处理掉。
| 检查项 | 怎么确认 |
|---|---|
| 音频准备 | 支持 MP3、WAV、FLAC、AAC、OGG、M4A,文件保持在 100MB 以内。 |
| 语言检查 | 系统能自动识别 50 多种语言,但双语 hook 和专名仍建议人工看一遍。 |
| 时间检查 | 节拍同步会给出稳定基础;如果某句比人声早或晚,要手动微调。 |
| 画面检查 | AI 场景图要匹配情绪,同时不能让歌词变难读。 |
| 画幅检查 | 16:9、9:16、1:1 要分别看,因为每种画幅的可读字号都不同。 |
你的歌词本身就在讲故事 — 把它变成每个平台和发行节点都能用的视觉内容。

将整首歌变成 AI 生成的音乐视频,16:9 横屏导出。

把副歌或 hook 剪成竖屏 AI 音乐视频片段,适合短视频传播。

从一首单曲生成多个视觉片段 — 发歌周每天都有新鲜内容。

有成品歌曲但没有拍摄预算时,AI 直接从歌词生成画面。