AI 日报 · 10月6日:Mistral Large 4 开源发布:1T 参数原生多模态,OpenRouter 前两周五折
Mistral 发布 1T 参数、49B 激活的原生多模态开源模型 Large 4(Le Chonk),OpenRouter 公开预览前两周五折,输入 $0.68/M、输出 $2.09/M。Reflection AI 宣布 501B 参数 Beam 智能体模型,本月开源权重。
-
Mistral Large 4 在 OpenRouter 公开预览,前两周五折
Mistral Large 4 已在 OpenRouter 公开预览:1T 参数(49B 激活)、原生多模态、512K 上下文、最高 256K 输出,前两周五折,输入 $0.68/M、输出 $2.09/M、缓存 $0.07/M。
-
Reflection AI 推出 501B 参数开放模型 Beam
Reflection AI 发布 Beam 高效智能体开放模型,总参数 501B、激活 23B,端到端从零训练,专注编码与智能体任务,完整权重将于本月开源,Ollama 将上架。
-
OpenAI 将 GPT-6 Astra 与 6.1 Sol 默认速度提升约 50%
OpenAI 表示 GPT-6 Astra 与 GPT-6.1 Sol 在订阅通道及使用 Sign in With ChatGPT 的合作伙伴产品中的默认速度已优化提升约 50%,两小时内生效且无需用户操作。
-
Codex 自动审查功能对所有用户免费开放
OpenAI 向所有通过 ChatGPT 账号登录的用户免费开放 Auto-review,可在设置的权限项中开启。它改善了默认沙箱中凡事需手动批准的设定,避免用户反复配置细粒度规则。
-
Command Code 发布 Agr 开放决策模型系列
Command Code 发布 Agr 开放决策模型系列,含 Agr (31B) 与 Agr-flash (360M),在 Decision Index 0.2.1 上得分 58.15,专注工具调用与路由,已在 Hugging Face 和 GitHub 开放。
-
Cline 上线 Pareto 路由模型,成本降 56 倍
Cline 新增 Pareto 26.10 Preview 模型,会在多个前沿与开源模型间路由并挑选最优答案,同时保留提示缓存;同一 DeepSWE 分数下每任务成本为 0.24 美元,对比 Fable 的 13.41 美元便宜约 56 倍。
-
OpenAI 因欧盟要求扩展文本溯源
OpenAI 因欧盟监管要求将内容溯源扩展到文本,在生成文本中嵌入不可见统计信号。检测器目前仅向获批研究人员开放,因为改写或翻译即可去除水印,短文本中也常检测不到。
-
Requesty 评测 Clef 与 Opus 5.5 路由成本
Requesty 在 2.2 万条决策上测试 3 个决策模型和 8 个 LLM:Clef (27B) 在人工标注任务上达 83.2% 准确率,每千条 $0.13;Opus 5.5 达 86.6%,每千条 $3.80。
-
腾讯开源多用户 AI 工作区 Octop
腾讯开源了 Octop 多用户 AI 工作区,每个账号独立登录、数据彼此隔离,用户可创建多个 agent。每个 agent 自带浏览器与终端,模型、存储、记忆、插件均可替换。
-
GMI Cloud 上线 GPT-6.1 Sol
GMI Cloud 宣布 GPT-6.1 Sol 已向全部用户开放,宣称提供接近 Astra Intelligence 的智能水平,价格仅为五分之一。