Prime Intellect推理平台上线:内部每天已跑近1万亿Token
相关推荐
MiniMax把OpenAI新Agents API做成开源版,Codex、Claude Code都能接
动察 Beating AI 快讯,MiniMax 开源 OpenAgentCore,做了一套兼容 OpenAI Agents API 的自托管实现。开发者可以继续使用 OpenAI 官方 SDK,只需要换掉 API 地址,后台运行的 Agent 可以选择 Codex、Claude Code 或 MiniMax Code。 Agents API 可以理解成一套「调用 Agent 的统一接口」。普通模型 API 主要负责一问一答。Agent 要连续干几个小时甚至几天,还要管理上下文、调用工具、协调子 Agent、保存任务进度。OpenAI 的 Agents API 把这些能力放到一个长期运行的 Session 里统一管理。 OpenAI 官方版本使用 OpenAI 托管的 Codex 执行框架。开发者可以自己选择代码在哪运行,但 Agent 的任务编排、上下文管理和运行状态仍由 OpenAI 负责。OpenAgentCore 则把这套后端也交给开发者自己部署。
Jev爆火两周,OpenAI也做了个「只负责判断」的API
动察 Beating AI 快讯,OpenAI 在 DevDay 推出了 Decisions API。它不负责写长篇回答,专门解决程序里那些需要快速做选择的任务。 开发者先给它几个明确的选项,再丢进去文字或图片。底层的 GPT-6 Luna 会在几百毫秒内做出判断。比如判断一条消息该交给销售还是客服,或者让 Agent 决定下一步该调用哪个工具。 这类任务以前也能交给普通大模型,但往往要先生成一段文字,再让程序解析结果。Decisions API 直接把 Luna 限制在几个候选答案里,目标就是把这些高频的小判断做得更快。 它很容易让人想到最近爆火的 Jev。TypeSafe 也是把 AI 从「生成文字」改成「直接做选择」。不过两者并不完全一样,Jev 是专门训练的决策模型;OpenAI 目前是在 Luna 上做受限决策,而且额外支持图片输入。 Decisions API 目前还在限量预览,OpenAI 计划未来几天扩大开放。
OpenAI重开200美元Pro:价格不变,API等值用量减半
动察 Beating AI 快讯,OpenAI 将重新开放每月 200 美元的 Pro 20x,但套餐用量算法也一起改。Tibo Sottiaux 明确表示,新方案折算成同等 API 花费后,只有旧版约一半。价格没变,最确定的变化就是 API 等值额度缩水。20x 之后到底变成多少,OpenAI 还没公布。 OpenAI 的解释是,Sol 和 Luna 的 API 价格刚降了约 50%,模型也会越来越高效,所以更少的「美元额度」仍可能完成差不多甚至更多工作。这个逻辑在价格同步腰斩的模型上可能成立,但不代表所有模型都能持平。所谓「能做更多工作」,目前也没有新旧套餐的实测数据支撑。 此外,Pro 20x 的用量一直不够透明。过去几周,GitHub 和 OpenAI 社区已经出现大量用户反馈:周额度会突然大幅下降、重置时间变化,或者长上下文和多 Agent 任务消耗远超预期。还有用户称,一次 Astra Ultra 任务 5.2 小时就消耗了约 2.4 个 Pro 20x 周额度。
OpenAI 发布 GPT-6 Sol 与 Luna,API 价格下调 50%
ChainCatcher 消息,OpenAI 于 9 月 22 日发布 GPT-6 Sol 与 GPT-6 Luna 两款新模型,发布时间距 Anthropic 推出 Claude Opus 5.5 仅数分钟。两款模型定位低于 GPT-6 Astra,是面向日常工作的更便宜、更快速选项。OpenAI 同时将两款模型的 API 价格较 GPT-5.6 促销价下调 50%,Sol 输入与输出价格分别为每百万 token 2 美元与 10 美元,Luna 则降至 0.1 美元与 0.5 美元。性能方面,OpenAI 援引 Zapier 的 AutomationBench 基准称,GPT-6 Sol 在最高推理设置下得分为 33.2%,每任务成本 0.27 美元,而 Claude Opus 5 最高设置为 26.9%,每任务成本高出逾 11 倍。在 Agents' Last Exam 测试中,GPT-6 Sol 最高得分 56.4%。在 OSWorld 2 计算机使用测试中,GPT-6 Sol 以 60.5% 对 60.3% 几乎追平 Claude Opus 5 的中等努力得分,成本低约 80%。
TypeSafe AI 决策模型 Jev 正式登陆 B.AI API,输入低至 $0.042/百万 Token
ChainCatcher 消息,B.AI 平台宣布 TypeSafe AI 推出的首款 System One 模型 Jev 正式上线 API。 Jev 专为软件内的高速结构化决策打造,不生成任何文本:开发者输入应用状态与类型化问题后,模型直接返回带概率与置信度的决策结果,无需 JSON Prompt,也无需解析输出。模型支持 Choice / Score / Noul 三类原语并行评估,端到端延迟约 70–500ms,输入仅 $0.042/百万 Token,输出免费,适用于工单路由、内容审核、风险评分及 Agent 分支判断等场景。 目前 Jev 已在 B.AI API 的“官方”→“全量接入”列表中开放,可通过 Jev-1.13.0 或 Jev-Latest 调用。
AI模型聚合平台OpenRouter上线批量API,多数模型Token价格减半
PANews 9月23日消息,据OpenRouter在X平台发文称,其批量API(Batch API)已正式上线,面向无需即时返回结果的任务,大多数模型的每Token价格减半,所有结果将在24小时内返回。五折优惠同时适用于输入和输出Token,目前支持70余种模型。OpenRouter称,两周测试期间共完成逾23万个批次任务,完成时间中位数为7分钟,90%在1小时内完成。