核心信息

TypeSafe AI 的 Jev 模型在实时生产流量影子测试中以更低成本超越前沿大模型,实现最高 4 倍提速,并在重复问题匹配、费用分类等任务上取得更高准确率。

要点

  • 重复问题匹配准确率从 70% 提升至 97%。
  • 费用分类准确率(对比人工审核)从 50% 提升至 86%。
  • 升级决策能识别同样问题且误报更少。
  • 影子测试实时生产流量时速度提升最高 4 倍;离线测试为 2 至 3 倍。
  • 用例包括从已知集合中选择:将重复分析问题匹配到已批准答案、从 36 个指标中选取 1 个、拦截 PII 请求、判断客服聊天是否需要人工介入、按 3 级分类体系标记工单,以及将费用归入约 55 个类别。