viccy
|
a9e17d0e36
|
Merge pull request #275 from cindyxu1030/feat/sonilo-sfx
feat(sfx): 新增 Sonilo AI 音效模式(可选,默认关闭)
|
2026-07-23 11:57:43 +08:00 |
|
Cindy Xu
|
14828256de
|
feat(sfx): 新增 Sonilo AI 音效模式(可选,默认关闭)
在 #270 配乐模式基础上新增可选的 "AI 音效(Sonilo)":将合并后的成片
上传到 Sonilo API(POST /v1/video-to-sfx,异步任务管线),根据画面内容
生成音效,再用 ffmpeg 混在成片现有音轨之下(视频流直接复制,不重编码
画面)。解说配音在后续合成步骤中单独混入,音量策略不受影响。生成的
音效为免版税素材。
- 复用 #270 的 sonilo_api_key 配置与 app/services/sonilo.py 模块,
新增音效任务管线(提交 / 轮询 / 预签名 URL 下载)
- 上传前 ffprobe 本地校验时长(音效接口上限 3 分钟),避免白传计费
- 轮询是免费幂等 GET:网络抖动与 5xx 在截止时间内重试,不报废已计费任务
- 任何失败(超时、HTTP 错误、任务失败、混音失败)只记录日志并沿用
原视频,绝不中断成片任务
- WebUI 音频设置新增独立开关面板(默认关闭),选项处提示视频将上传至
Sonilo API
- 现有 BGM / 合成逻辑不做任何改动,未勾选时行为与 main 完全一致
|
2026-07-22 13:17:14 -07:00 |
|
linyq-laien
|
d46d2ca2a5
|
docs: restore original README content
|
2026-07-22 11:57:46 +08:00 |
|
linyq-laien
|
5ac4488fa3
|
docs: optimize AI narration search visibility
|
2026-07-22 11:23:59 +08:00 |
|
linyq-laien
|
7c2bfbe233
|
docs: link NarratoAI project distinction guide
|
2026-07-21 20:32:33 +08:00 |
|
linyq-laien
|
0a5dcf5f21
|
功能: 新增字幕任务专用高效模型支持
新增高推理模型和高效模型的中英文国际化配置字符串
新增高效文本模型配置项,支持空值时自动回退到高推理模型
添加resolve_text_model_name工具函数用于根据偏好解析对应文本模型
更新字幕校对和翻译服务,默认使用高效模型处理批量字幕任务
优化OpenAI兼容提供商的模型参数处理逻辑,支持通过参数覆盖模型名称
更新WebUI基础设置页面,新增高效模型配置项并支持测试两个模型的连接
同步更新示例配置文件、默认配置项与相关测试用例
|
2026-07-19 14:53:06 +08:00 |
|
linyq-laien
|
022b8bbea3
|
feat(webui, llm, i18n): 添加可自定义的解说文案字数配置
在WebUI脚本设置页面新增字数输入控件,支持100-5000区间的目标字数设置
更新LLM提示词模板,使用用户指定字数作为目标(±10%浮动)替代原固定范围
补充中英文国际化翻译文案
升级项目版本至0.8.7
更新相关服务函数与单元测试适配新参数
v0.8.7
|
2026-07-18 04:26:44 +08:00 |
|
linyq-laien
|
7639c9d289
|
feat(audio): 新增voxcpm-0.5b和voxcpm-2b本地语音合成支持
新增完整的voxcpm系列本地语音合成功能,包括:
- 新增配置常量、加载逻辑与示例配置项
- 集成webui界面:引擎选型、参数配置与语音预览
- 实现核心调用逻辑,包含API地址标准化、重试机制与文件处理
- 新增两套单元测试覆盖核心流程
- 在字幕转录设置页面补充转录工具包的下载提示文本
|
2026-07-16 19:11:51 +08:00 |
|
viccy
|
15af56cbd3
|
docs: 更新文档
|
2026-07-16 11:35:31 +08:00 |
|
viccy
|
0c9579c56a
|
docs: update README for v0.8.5 and v0.8.6
|
2026-07-16 11:33:08 +08:00 |
|
viccy
|
c09566ae16
|
更新版本号
v0.8.6
|
2026-07-16 11:25:57 +08:00 |
|
viccy
|
445feb14ae
|
Merge remote-tracking branch 'origin/main'
|
2026-07-16 11:24:39 +08:00 |
|
viccy
|
d0216fcb04
|
Merge pull request #270 from cindyxu1030/feat/sonilo-bgm
feat(bgm): 新增 Sonilo AI 配乐模式(可选,默认关闭)
|
2026-07-16 10:26:42 +08:00 |
|
Cindy Xu
|
d29874a163
|
feat(bgm): 新增 Sonilo AI 配乐模式(可选,默认关闭)
背景音乐来源新增 "AI 生成配乐(Sonilo)":将合成完成的视频(未加 BGM)
上传到 Sonilo API,根据画面内容与剪辑节奏生成配乐,音频文件交还给现有
合成流程混音,解说配音音量策略保持不变。
- 独立模块 app/services/sonilo.py,仅在配置 sonilo_api_key 后可用
- 上传前 ffprobe 本地校验时长(接口上限 6 分钟),避免白传计费
- 任何失败只记录日志并回退到随机背景音乐,绝不中断成片任务
- WebUI 选项处提示:视频将上传至 Sonilo API,生成的音乐已获授权、
可商用(以条款为准)
- 现有 resource/upload/none 的 BGM 逻辑不做任何改动
Closes #269
|
2026-07-13 21:00:03 -07:00 |
|
viccy
|
b56222725d
|
feat: add IndexTTS 1.5 macOS engine
|
2026-07-13 06:19:56 +08:00 |
|
viccy
|
f80ae97679
|
docs: add OmniVoice download links
|
2026-07-13 05:23:31 +08:00 |
|
viccy
|
79c89e64a3
|
fix: format IndexTTS download links
|
2026-07-13 05:15:27 +08:00 |
|
viccy
|
8b3812fbea
|
docs: update IndexTTS download links
|
2026-07-13 04:59:12 +08:00 |
|
viccy
|
39eae0d511
|
fix: adapt IndexTTS-2 MLX Pack API
|
2026-07-13 04:41:09 +08:00 |
|
viccy
|
cd20aebacf
|
更新版本号
v0.8.5
|
2026-07-13 03:48:31 +08:00 |
|
viccy
|
990fb36e98
|
fix(webui, tests): 修复硬编码路径与组件默认值问题并新增测试
替换音频设置模块的硬编码本地路径为资源目录工具函数,提升跨平台兼容性
修正字幕预览方向选择组件的默认值处理逻辑,移除冗余的默认参数
新增Streamlit组件会话状态合规性测试,确保带key的组件不会同时声明default参数
更新.gitignore以允许提交新增的测试文件
|
2026-07-13 03:48:05 +08:00 |
|
viccy
|
2fbd3d0c25
|
更新文档
|
2026-07-13 02:41:24 +08:00 |
|
viccy
|
4a5b699b11
|
Fix reference audio source pill state
|
2026-07-13 02:33:06 +08:00 |
|
viccy
|
f7be8aafb3
|
更新文档 Speclip 暂时属于内测阶段
|
2026-07-05 02:13:42 +08:00 |
|
viccy
|
0733bb9528
|
Merge pull request #265 from leoz9/codex/add-clear-cache-button
Add system cache clearing action
|
2026-07-02 16:07:42 +08:00 |
|
viccy
|
f0753cc6e8
|
Merge pull request #266 from leoz9/codex/parse-short-script-json
Use tolerant JSON parsing for short script output
|
2026-07-02 16:03:52 +08:00 |
|
viccy
|
ec1a1a4c52
|
Merge pull request #263 from leoz9/codex/normalize-pills-state
Normalize audio source pill state
|
2026-07-02 15:46:35 +08:00 |
|
zhanglei
|
2d0adcfdec
|
Use tolerant JSON parsing for short scripts
|
2026-07-02 15:46:20 +08:00 |
|
viccy
|
8944db7620
|
Merge pull request #262 from leoz9/codex/fix-subtitle-preview-orientation
Fix subtitle preview orientation state
|
2026-07-02 15:46:07 +08:00 |
|
viccy
|
0407873eff
|
Merge pull request #261 from leoz9/codex/add-uv-support
Add uv-based dependency management
|
2026-07-02 15:45:39 +08:00 |
|
zhanglei
|
4666190181
|
Add system cache clearing action
|
2026-07-02 15:43:34 +08:00 |
|
zhanglei
|
207900a59a
|
Normalize audio pills source state
|
2026-07-02 14:34:54 +08:00 |
|
zhanglei
|
3eaf61c3f8
|
Fix subtitle preview orientation state
|
2026-07-02 14:33:15 +08:00 |
|
zhanglei
|
fd43bf7c0b
|
Add uv-based dependency management
|
2026-07-02 14:14:55 +08:00 |
|
viccy
|
40b91d25b7
|
chore: remove unused docs assets
|
2026-07-02 12:13:24 +08:00 |
|
viccy
|
a6b029a613
|
chore: switch license to MIT
|
2026-07-02 12:03:42 +08:00 |
|
viccy
|
c288a76ff8
|
Merge pull request #255 from hamizan-azman/codex/validate-openai-base-url
Validate OpenAI-compatible base URLs
|
2026-07-02 11:58:37 +08:00 |
|
viccy
|
0774ac5385
|
Warn for custom OpenAI base URLs
|
2026-07-02 11:57:31 +08:00 |
|
viccy
|
23591defb1
|
Merge pull request #260 from linyqh/codex/doubao-tts-v084
feat: support Doubao TTS API key auth
v0.8.4
|
2026-07-02 11:41:48 +08:00 |
|
viccy
|
1b7bd79654
|
feat: support Doubao TTS API key auth
|
2026-07-02 11:35:23 +08:00 |
|
viccy
|
d02c848977
|
Merge pull request #259 from LauraGPT/codex/funasr-openai-transcriptions
Support FunASR OpenAI-compatible transcription endpoint
|
2026-06-30 10:15:45 +08:00 |
|
zhifu gao
|
b15f5807c1
|
Support FunASR OpenAI transcription endpoint
|
2026-06-30 06:15:18 +08:00 |
|
viccy
|
18c9ff81d2
|
Merge pull request #258 from mohit-twelvelabs/feat/twelvelabs-integration
feat(llm): 新增 TwelveLabs Pegasus 视频理解视觉提供商(可选) / add optional TwelveLabs Pegasus vision provider
|
2026-06-27 17:26:18 +08:00 |
|
mohit
|
056521a743
|
feat(llm): 新增 TwelveLabs Pegasus 视频理解视觉提供商(可选)
将每批关键帧拼接为短视频片段并交由 Pegasus 原生理解,更擅长把握镜头内
动作与时序,从而生成更贴合画面的解说。仅当 vision_llm_provider 设为
twelvelabs 时启用,默认行为不变;包含无网络单测与凭据门控的 live 测试。
|
2026-06-27 00:29:27 -07:00 |
|
viccy
|
d017f3ac75
|
Merge pull request #256 from kiritoxjf/main
腾讯云TTS音色列表更新
|
2026-06-22 13:43:02 +08:00 |
|
Kirito
|
acd27aedc7
|
腾讯云TTS音色列表更新
|
2026-06-21 21:10:56 +08:00 |
|
Hamizan Azman
|
5f7eed9f85
|
Validate OpenAI-compatible base URLs
|
2026-06-19 15:08:17 +08:00 |
|
viccy
|
fede336592
|
更新版本号
v0.8.3
|
2026-06-15 01:33:56 +08:00 |
|
viccy
|
ed4a5d07e5
|
feat(short_drama_editing): 添加强短剧混剪剪辑脚本生成完整功能
- 新增短剧混剪脚本生成专用提示词类并完成注册
- 优化merge_script工具函数,支持多视频路径输入、自动填充视频信息
- 扩展SDP处理流水线,新增直接基于剧情分析和字幕生成剪辑脚本的逻辑
- 更新WebUI相关组件与工具函数,适配新的短剧混剪脚本生成流程
- 添加字幕时间戳校验与路径规范化工具,确保生成脚本合法性
|
2026-06-15 01:16:30 +08:00 |
|
viccy
|
8b1fcbafa5
|
chore(app/utils): 移除两个废弃的Gemini视觉分析工具文件
|
2026-06-14 00:28:33 +08:00 |
|