腾讯混元发布 Hy4 Preview:770B 稀疏 MoE 模型已上线 API
腾讯混元最新推出的 Hy4 Preview 是 770B 参数的稀疏 MoE 开源权重模型,每个 Token 激活 49B 参数,现已在官方 API 上线。该模型在 203 项工程任务的内部专家评估中获得 2.99/4.00 的成绩。
腾讯混元最新推出的 Hy4 Preview 是 770B 参数的稀疏 MoE 开源权重模型,每个 Token 激活 49B 参数,现已在官方 API 上线。该模型在 203 项工程任务的内部专家评估中获得 2.99/4.00 的成绩。
腾讯混元最新开源的 770B 稀疏 MoE 大模型 Hy4 Preview 现已通过官方 API 全面开放接入。该模型每 Token 激活 49B 参数,并在腾讯内部 203 项实际工程任务盲测中表现优异。
萨姆·奥特曼转述了一篇观点:前沿AI模型的深度相比GPT-4仅增长约两倍以内,并提醒外界不要因混乱报道而推动模型走向无法监控的境地。
MiniMax分享了H3-World,一种仅用8K样本和约0.199%可训练参数将MiniMax-H3语言模型改造成世界模型的新方法。
自2026年9月3日17:00(SGT)起,DeepSeek V4 Flash 与 V4 Flash Vision Exp 将结束免费体验,改为折扣计费:高峰时段官方标准价5折,非高峰时段官方标准价75折,与DeepSeek官方定价对齐。
B.AI 宣布 DeepSeek V4 Flash 与 V4 Flash Vision Exp 将于 2026 年 9 月 3 日结束免费体验并转为折扣计费;神秘模型 Ox Alpha 正式揭晓为 GLM 5.3 Flash,继续免费开放。
Command Code CEO Ahmad Awais 宣布,该平台将于明早推出一款新的免费 AI 模型,此前他曾暗示将上线阿里巴巴通义千问模型。
CommandCodeAI 预告明天早上发布更新,此前动态涉及阿里巴巴 Qwen、Claude AI 以及 Fable 5.1 缓存读取成本降低 75%。
OpenRouter的供应商运营团队通过自动化流程在8月新增了727个端点(日均约23个),并支持75多家供应商自助接入,且须通过质量与功能测试。
LiteLLM 即将在其平台引入 Fusion Models,据称在 Terminal-Bench 上比前沿模型性能最高提升 55.6%,同时提供微调预设和自定义构建选项。