核心信息
一项基准测试在服务250万用户的真实任务上对比了OpenAI Decisions API与Jev,任务是对用户查询/简历与职位描述的相关性进行1-10分评分。
要点
- OpenAI Decisions API 成本比 Jev 高2倍
- OpenAI 在相关性评分任务上表现低5-10%
- 任务形式:对查询/简历与职位描述的相关性打1-10分
- 基准测试运行在服务250万用户的系统上
- TypeSafe AI 将此作为对“Jev 已被取代”说法的回应
一项基准测试在服务250万用户的真实任务上对比了OpenAI Decisions API与Jev,任务是对用户查询/简历与职位描述的相关性进行1-10分评分。