feat: 调度器+并发管线+GPU优化+日志分级+前端修复
- scheduler: ffmpeg 异步线程 + GPU 串行调度 + 模型复用(2N→2 次加载) - pipeline: 阶段拆分(extract/asr/translate),中间数据存 Task 字段 - translate_service: 长度排序批处理,padding 浪费减少 91% - model_manager: ASR/翻译不共驻,BatchedInferencePipeline 批量解码 - 日志分级: INFO=任务流转里程碑,DEBUG=进度详情;默认 INFO - 前端: 日志最新在上+滚动感知+退避轮询;24h 时间;上传中状态显示 - /health: 返回完整 Whisper/NLLB 配置 - upload_service: 单事务 complete + 扩展名白名单 - task_router: 合并 UploadSession 虚拟任务到列表 - Dockerfile: CPU/GPU 独立构建链,deps 缓存稳定 - prefetch_models: 安装时预下载模型权重
This commit is contained in:
@@ -29,14 +29,16 @@ asr:
|
||||
language: en
|
||||
word_timestamps: true
|
||||
vad_filter: true
|
||||
batch_size: 16 # BatchedInferencePipeline:每批解码 16 个 30s 音频块,填充 GPU
|
||||
|
||||
translation:
|
||||
model: facebook/nllb-200-distilled-1.3B # 质量最好
|
||||
device: cuda
|
||||
src_lang: eng_Latn
|
||||
tgt_lang: zho_Hans
|
||||
batch_size: 16 # 不共驻时显存独占,大 batch
|
||||
batch_size: 32 # 不共驻时显存独占,大 batch 填充 GPU
|
||||
max_length: 256
|
||||
sort_by_length: true # 按句子长度排序后分批,减少批内 padding 浪费
|
||||
|
||||
segmentation:
|
||||
max_words_per_line: 14
|
||||
@@ -46,7 +48,7 @@ segmentation:
|
||||
|
||||
|
||||
logging:
|
||||
level: info # debug=详细子步骤, info=仅阶段转换, error=完整 traceback
|
||||
level: info # debug | info | warning | error(控制台最低级别)
|
||||
buffer_size: 2000
|
||||
|
||||
docs:
|
||||
|
||||
Reference in New Issue
Block a user