它会替你做这些
拆开看,其实就是这几件事
每一步都会显示在时间线上。需要你拿主意的地方,它会停下来问你。
- 1
理解用途与情绪,定风格、乐器与人声
- 2
需要歌词就先写好词,分好主歌副歌
- 3
一次生成两版不同演绎
- 4
交付音频与歌词,需要的话混进你的视频里
怎么用
说一句话、看它做、拿走成品
- 01
有素材就丢进来
文档、表格、图片、视频、音频都行,一次最多 10 个。画图、写歌、做视频、写代码这类从零开始的活,不传文件直接说也行。
- 02
用一句话说清要求
像跟同事交代工作一样说就行。信息不够时它会主动列几个选项让你点,不用你猜它要什么。
- 03
看着它一步步做
读了哪个文件、画了哪张图、跑了什么命令,全都实时显示。要你拿主意时它会停下来问。
- 04
拿走成品
文档、图片、音乐、视频、代码直接下载,音视频能在线播放。不满意接着说「背景再暗一点」「这段再学术一点」,上下文都留在同一个工作区。
顺手一起做了
做AI 写歌与配乐的人,通常还会用到
都在同一个工作区里,文件不用重传,接着说下一句就行。
AI 生成视频:文生视频、图生视频
一句描述或一张图,生成 4–15 秒、自带音效的视频片段。
你只要说「用这张产品图当第一帧,镜头缓慢环绕产品,背景是城市夜景霓虹,10 秒,竖屏 9:16。」
- MP4 视频(网页和手机都能直接播)
- 768P 或 2K,多种画幅可选
- 自带音效与环境声
分镜编排与短片成片
从一句创意到一支配好音乐和字幕的短片,中间每一步它自己串起来。
你只要说「给我们的咖啡新品做一支 30 秒宣传短片:先出分镜脚本给我确认,再逐镜生成,配旁白、背景音乐和字幕。」
- 分镜脚本表(镜号、画面、运镜、台词、时长)
- 角色 / 场景定妆图与逐镜画面
- 剪好的成片 MP4(配乐、旁白、字幕)
AI 配音与有声朗读
几百种音色,能调语气和语速,顺手出一份对齐好的字幕。
你只要说「把这篇课件讲稿配成音频,用沉稳的男声,语速稍慢,每页单独一段,顺便出 SRT 字幕。」
- 配音音频(MP3)
- 对齐时间轴的 SRT 字幕
- 叠加背景音乐的混音版
常见问题
关于AI 写歌与配乐
一轮对话就能完成。文档、图片、代码通常几分钟内出结果;音乐要半分钟到几分钟,视频一段要几分钟到十几分钟,多镜头短片按镜头数累加。完成后可以继续追问调整,比如「背景再暗一点」「换一种曲风」「这段再学术一点」,文件和上下文都留在同一个工作区。