说话人功能用于为逐字稿段落分配人物标签,适合访谈、会议和播客。自动识别需要先在“本地模型”下载 WeSpeaker;处理完成后仍建议人工检查边界和姓名。
自动识别
- 打开已索引的媒体,点击“本地转录”。
- 开启“识别说话人”。不知道人数时开启自动识别;已知人数时可关闭自动识别并填写人数。
- 执行转录并在任务队列等待完成。
- 在逐字稿中检查每个段落的说话人标签,必要时手动修改。
手动分配与注册声纹
点击段落上的说话人名称,选择已有标签或输入新名称。可仅改当前句,或批量更新同名标签。选择“注册说话人”会把当前样本保存为本机声纹,以便后续素材识别;请使用清晰、单一讲话者的样本,避免背景音乐和多人重叠讲话。
管理列表
在左侧“说话人”页面可查看当前工作区已注册的说话人,试听样本、重命名或删除。删除声纹或工作区说话人标签会影响后续识别与筛选,但不会修改原始音视频。