NEW 为 ASR 评测团队打造的质量工作台

把 ASR 评测,
变成可追溯的质量闭环

上传 CSV,自动完成字段校验与样本清洗;用统一标签归因 Bad Case,生成抽检任务与批次报告。

✓ 无需部署✓ 支持 CSV 批量导入✓ 10 分钟完成首批配置
EchoLens / 批次评测● 数据已同步
批次 / 2026-08-20

普通话远场 · V4.2

样本总数3,042已完成导入
字段完整率96.8%↑ 18.4%
Bad Case37待复核 8
整理耗时35m节省 71%
错误根因分布本批次 ▾
37Bad Case

口音偏差 32%

吞音漏字 24%

情感边界 19%

其他问题 25%

待处理任务查看全部 →
!

字段异常复核12 条 · 高优先级

处理中

Bad Case 抽检已完成 29 / 37

78%
系统已按风险分层生成 3 个抽检任务
01

HISTORICAL BATCHES3 个历史批次已验证

71%

TIME SAVED2 小时降至 35 分钟

−60%

MISSING FIELDS字段缺失显著减少

生态兼容与客户展示 · 原型占位,正式上线前需替换为真实授权品牌

字节跳动
智谱 AI
Langfuse
Zeabur
Google
ONE WORKSPACE, FULL LOOP

从一份 CSV,到一份
能推动算法改进的报告

每一步都有状态、责任人和操作留痕。问题不再散落在表格、群聊和个人经验里。

01

导入样本

拖入 CSV,自动识别批次、模型版本与必填字段。

了解更多 →
02

校验清洗

用 6 类复核规则发现缺失、格式、重复与边界异常。

了解更多 →
04

抽检复核

按风险自动生成任务,分派、复核、留痕一步完成。

了解更多 →
05

看板与报告

查看趋势与根因,导出可直接评审的批次报告。

了解更多 →
VOICE OF THE TEAM

团队用过之后,
评测开始真正跑起来

以下为版式与文案示意。正式上线前,替换为经过授权、脱敏处理的真实客户评价截图。

•••语音算法组 · 项目群
老师 团队成员
以前整理一批评测数据要两小时,现在清洗、抽检到报告一套走完,35 分钟就能交付。

10:24 · 已由产品团队脱敏

示意评价截图
•••数据运营 · 质量复盘
老师 团队成员
字段异常在导入时就被拦住,复核时不用再追着补数据。标签口径统一后,跨团队对齐快多了。

16:08 · 已由产品团队脱敏

示意评价截图
•••ASR 评测周会
老师 团队成员
现在能直接看到 Bad Case 的根因分布,算法同学知道先改什么,下一批也能验证问题有没有收敛。

09:41 · 已由产品团队脱敏

示意评价截图
START YOUR FIRST BATCH

下一批评测,
从 35 分钟完成开始。

上传一份 CSV,立即查看字段健康度、Bad Case 分布和建议抽检范围。

创建首个评测批次
1 上传 CSV2 自动校验3 查看报告