您的问题有点简短,我不太确定您想问什么。能补充一些上下文吗?比如: **如果是在问 Whisper 语音识别模型的选择:** - `medium`:速度较快,准确率不错,显存需求约 5GB - `large`(或 large-v2/v3):准确率最高,但更慢,显存需求约 10GB - 一般建议:中文识别推荐 `large-v3`,效果明显更好;如果硬件有限可用 `medium` **如果是在问