DeepSeek-V4.1-Flash 向 Ollama Pro 订阅用户开放
Ollama 正在其云平台扩大 DeepSeek-V4.1-Flash 的开放范围,在最初面向 Max 和 Team 账号推出后,现已开始向 Pro 订阅用户开放。
Ollama 正在其云平台扩大 DeepSeek-V4.1-Flash 的开放范围,在最初面向 Max 和 Team 账号推出后,现已开始向 Pro 订阅用户开放。
一位开发者指出,目前只有 AI 实验室能提供真正的按 token 计费,其他服务商因需预留 GPU 容量,导致基于 Kimi K3 等开源模型自由伸缩开发变得困难。
了解如何下载Ollama并在应用中启用ChatGPT,包括自定义模型选择器以及让ChatGPT桌面版使用Ollama模型的方法。
Ollama 宣布,用户现在可以在 ChatGPT 的模型选择器中自定义显示哪些模型,在设置中同时选用本地模型和云端模型。
OpenAI 的 ChatGPT 桌面应用(即 Codex 应用)现在可以配置使用 Ollama 模型。下载或更新到 Ollama 0.34 即可开始使用。
Command Code AI 首席执行官 Ahmad Awais 表示,其依赖的“Meta Muse Spark”推理服务已完全停止,影响了公司业务和客户,他正公开寻求快速解决方案。
MiniMax 现已加入 Nebius AI Builder 计划,让开发者可以在同一平台上使用其模型、合作伙伴基础设施、积分及工程师答疑服务。
OpenRouter 推出 beta 版有状态服务端工具 openrouter:shell,允许任意模型在托管的 Linux 容器中运行命令,并通过新的 Files API 传入传出文件,同时提供每次生成的逐项成本明细。
LiteLLM 宣布 AutoRouter 四项更新:自定义路由维度、自动配置路由器、按模型设置输出限制以防截断,以及为最新模型更新的预设。
LiteLLM 展示了如何将 Cursor AI 接入其网关,并在单一控制台上查看模型用量、成本和 Token 数。