← 工具雷达modelOverlapping Speaker Transcription Model小众的多人重叠语音转录模型,适用场景有限5.6综合我在用0想试试0踩过坑0实用性5上手速度6完成度6不可替代7生命力45 维独立打分,综合分为加权平均。分数只对同一套标准内部可比。适合谁需要处理多人同时说话场景的研究者不适合谁需要高精度通用语音识别的生产环境项目自述huggingface.co替代品WhisperNvidia NeMo访问官网 ↗★ 1 · 评测时 Stars评测于 2026-04-20同类工具6.5Qwen3.6-27B强大的中文多模态模型,但面临激烈竞争6.5Qwen3.6-27B: Flagship-Level Coding in a 27B Dense Model强大的27B参数编码模型,但面临激烈竞争6.5DeepSeek v4有潜力的中文LLM,但API生态和文档仍需完善6.5Mistral-Medium-3.5-128B强大的大模型但面临激烈竞争,性价比存疑6.5Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16强大的30B参数多模态模型,但推理成本高且生态支持有限6.5百度正式发布文心大模型 5.1百度文心5.1是国产大模型的追赶者,但相比国际顶尖仍有差距