Skip to content

关于时间戳音频转录质量 #30

Description

@wumaster

你好,我测试带时间戳asr,prompt为"请将音频逐句转写,每个句子单独一行。每一行需以起始时间戳(精确到0.01秒)、说话人编号([S01]、[S02]…)和内容类型([广告口播]/[背景音乐]/[背景歌声]/[人声对话]/[静音]/[其他])开头," "正文为该句语音内容,行末标注结束时间戳。每句话一个时间戳,不要合并多个句子。\n\n" "输出格式:[起始时间][说话人编号][内容类型]该句内容[结束时间]\n\n" 发现出现多次多个句子划分为同一段输出的情况,但您这边moss的转录模型输出就能正确划分语句,请问moss audio这个模型需要怎么调整参数或者配置prompt效果能对齐到专用的转录模型

Metadata

Metadata

Assignees

No one assigned

    Labels

    No labels
    No labels

    Type

    No type

    Projects

    No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions