Dev Spec v2 · ← 返回文档首页
06 视频与工具箱
1. 竖屏歌词视频(media/video)
| 项 | 规格 |
|---|---|
| 尺寸 | 1080×1920(付费)/ 720×1280(免费),30fps,H.264 + AAC |
| 画面 | 模板三选一:①用户上传的封面图 + 背景虚化 ②动态波形 ③纯色渐变 + 大字歌词 |
| 歌词 | 当前句高亮,逐字或逐句(取决于对齐精度);字体用开源可商用字体(思源黑体 / Noto Sans CJK,OFL 许可),随镜像打包 |
| 信息 | 曲名、演唱者昵称(用户填写) |
| 适用范围 | 只对授权伴奏(用户勾选有权使用)、清唱或原创作品生成;原曲伴奏的作品不生成视频,改为导出发布安全版人声(见第 2.1 节) |
| 水印(免费) | 右下角"Made with ..."角标 + 结尾 1.5 秒品牌画面;角标不能被裁掉(位于安全区内) |
| AI 披露 | 视频描述模板里自带"AI 修音"说明;文件写入隐式标识 |
| 渲染 | ffmpeg + ASS 字幕(libass);模板参数化;≤ 60 秒 |
2. 水印传播循环
免费用户导出带水印的视频 → 发到 TikTok / 抖音 / 小红书
→ 观众看到角标 → 搜索或点击主页链接 → 落地页(带"你也试试"按钮)
→ 注册 → 免费额度 → 付费去水印
- 水印链接统一带来源参数;统计"通过水印进站的新用户占比"(PRD 目标 ≥ 20%)
- 付费用户可以选择自愿保留水印,换取每月额外 3 首额度
- 水印只出现在授权伴奏、清唱或原创作品上,不会出现在使用原曲伴奏的内容里
2.1 原曲伴奏的作品:发布安全版人声
站内:完整混音可以试听(不可下载)
导出:处理后的人声 + 对齐偏移
指引:在抖音 / TikTok 里选这首歌的官方音源 → 叠加导入的人声 → 按提示调整起点
- 平台曲库里的官方音源由平台负责授权,我们的导出文件里不含任何伴奏成分
- 这类作品发布后不带我们的水印,回流靠导出页的"分享作品链接"和音准评分分享图
- 各平台"导入音频 + 官方音源叠加"的具体操作以平台当期功能为准;上线前逐个平台实测并写成图文指引
3. 免费工具箱
| 工具 | 输入 | 输出 | 限制 | 引导 |
|---|---|---|---|---|
| 你唱得准吗 | 一段清唱(≤ 60 秒)+ 原曲(或选择调性) | 总分(0~100)、音准曲线(用户 vs 原唱)、跑调位置、分享图 | 匿名每天 3 次 | "一键帮我修好"→ 用同样的文件直接创建修音作品 |
| 人声分离 | 一首歌 | 人声 / 伴奏(128kbps) | 匿名每天 3 首 | 付费得到无损和 4 轨 |
| 升降调、变速 | 一段音频 | 处理后的音频 | 每天 5 次 | — |
| 调性和 BPM 检测 | 一段音频 | 调性、BPM | 不限 | — |
人声分离工具的边界:与业内同类工具一样,它面向个人练习(扒谱、跟唱)。输出文件不带品牌水印,不提供分享入口,也不和修音作品的视频功能打通;页面和文件名旁固定提示"仅供个人学习练习,公开发布或商用需自行获得授权"。收到权利人投诉时,按投诉删除相关文件。
音准评分算法:
对每个用户音符:误差 = |用户中心音高 − 原唱中心音高|(八度折叠后,音分)
单个音符得分 = max(0, 100 − 误差 × 0.8)(50 音分以内几乎不扣分,可调)
总分 = 按音符时长加权平均
另外给出:最大的 3 处跑调(时间点 + 偏差多少)
4. SEO 页面(接入底座增长组件)
- 维度:工具(vocal remover、auto tune online、pitch checker、key finder……)× 场景(for TikTok covers、for karaoke……)× 语言
- 每页都嵌入对应的工具(可以直接使用),而不是只有文字
- 首批 ≤ 100 页
5. 分享图
- 音准评分:分数、音准曲线缩略图、"来挑战我"的链接
- 作品:封面 + 前后对比的二维码或链接(海外为链接)