Fable 5.1 发布:缓存读取成本降低 75%
Fable 5.1 已发布,AI 编程工作流中的缓存读取成本降低 75%。
Fable 5.1 已发布,AI 编程工作流中的缓存读取成本降低 75%。
Claude AI 宣布在 CommandCodeAI 中缓存读取价格下调 75%,让 AI 编码工作流更省钱。
MiniMax H3 实现超实时视频生成:借助 vLLM-Omni 与 FastVideo 的 FastH3,一段 10.1 秒的 MP4(含同步音频)仅需 8.7 秒渲染完成。
有人用Fal的H3 Max模型搭建了一个生成式视频课堂,可在几秒内把任意概念变成由虚拟老师讲解的动画教学视频。
Claude Fable 5.1 和 Claude Mythos 5.1 已发布,官方称其为全球最先进的编程与知识工作模型。
OpenAI 确认正在积极开发 Prism 这一科学/技术写作工具,由小团队负责,改进即将到来,并建议用户通过 Discord 获取最新动态。
Render Workflows 现在支持以托管任务方式运行 LLM 提示词批处理,并通过 OpenRouter 自动路由为每个提示词选择模型。可使用 Node 或 Python 搭建项目、本地运行,再通过简单 CLI 命令部署。
OpenRouter 的 Auto Router 会在每次调用中记录 completion.model,让模型选择透明可见;重试可能重复计费,因此需使用幂等性。
OpenRouter 现已集成到 Render Workflows 中,开发者可将 LLM 提示从 Web 服务卸载为可排队、重试和扇出的任务运行。
Meta Superintelligence Labs 推出 Muse Voice Transcribe,这是一款实时音频感知模型,集流式语音转文本、20+ 说话人分离和端点检测于一体。