ExplorationBench:衡量 AI 系统探索能力的新基准 Tencent Hy Tencent Hy @TencentHunyuan Tencent's foundation model for text, image, video, and 3D generation. 2 小时前 核心信息 团队发布 ExplorationBench,一个专注于衡量 AI 系统如何在已知问题之外进行探索的新基准。 要点 科学发现需要提出假设、设计实验并从结果中学习 评估真正的新颖性很困难,因为全新的答案缺乏直接的核验方式 该基准关注 AI 系统的探索能力,而非标准任务表现 本篇整理自 1 条推文 more 🔛 https://t.co/XsFS9gaRpQ #基准测试#AI 探索#研究评估 ← 上一篇 GMI Cloud 延长 Qwen3.8-Max、Qwen3.8-Flash 与 Wan3.0 免费试用并提升速率上限 下一篇 → B.AI 平台累计注册用户突破 290 万 点赞 0 分享