核心信息
一位实践者将 TypeSafe AI 的 Jev 模型与标准 LLM 评委在商业风险监控智能体中对比,发现两者报告质量相当,但 Jev 在稳定性、覆盖率、成本与速度上显著占优。
要点
- 与 LLM 评委的整体报告质量相同
- LLM 评委对同一威胁的评分反复摇摆:0.35 -> 0.68 -> 0.50
- LLM 评委漏掉 11 项调查中的 5 项;Jev 一项未漏
- Jev 成本约低 250 倍,速度快 3-6 倍
- 架构使用 you.com 搜索、Jev 进行类型化判断、Qwen 进行综合、MCP 进行集成(每次扫描 $0.02)