B.AI Responses API 重磅升级,全面兼容上游标准协议
相关推荐
B.AI 宣布 API Key 支持通过 Codex 调用 DeepSeek 模型
火星财经消息,9 月 2 日,B.AI 宣布其 Responses API 现已接入 DeepSeek 系列模型。开发者使用 B.AI API Key,即可在 Codex 客户端中调用 B.AI 平台支持的 DeepSeek 系列模型。此前,B.AI 已支持通过 Codex 调用 GPT 系列模型。完成 API Key 与 Base URL 配置后,开发者可在 DeepSeek 与 GPT 之间切换,用于代码生成、理解、调试、重构及开发协作等场景。
B.AI API现已兼容Codex,支持调用GPT系列模型
Odaily星球日报讯 8 月 26 日,B.AI 宣布 API 已全面兼容 OpenAI Responses API,开发者仅需使用 B.AI API Key 完成 Base URL 配置,即可在 Codex 开发环境中直接调用 B.AI 已支持的 GPT 系列模型,将前沿大模型能力无缝融入日常编码工作流。这意味着无论是代码生成、逻辑理解、智能调试、架构重构还是团队开发协作,开发者在 Codex 环境下均可获得 GPT 系列模型的实时智能辅助,全面覆盖从个人开发到团队协作的多种场景需求。 B.AI 始终致力于降低顶尖 AI 能力的使用门槛,以更开放的生态兼容、更灵活的调用方式,为全球开发者提供高效、便捷的编程辅助体验,助力开发者更专注于创造本身。
小米MiMo 系列模型正式登陆 B.AI API
ChainCatcher 消息,B.AI 平台宣布小米自研 MiMo 系列模型正式上线 API 服务,首批开放 MiMo-V2.5 与 MiMo-V2.5-Pro 两款模型。 其中 MiMo-V2.5 为 310B 稀疏 MoE 原生全模态模型,支持图文音视频全模态输入与 1M 超长上下文,专为多模态 Agent 与通用编程场景打造;MiMo-V2.5-Pro 则达到 1.02T 稀疏 MoE 参数规模,定位旗舰文本模型,主攻复杂推理与长周期软件工程,SWE-Bench Verified 基准测试取得 78.9 分的高分表现。 即日起,开发者可通过 B.AI API 调用两款模型,支持官方组接入与自选服务商双重模式,并享低至 4 折优惠。
OpenAI 回应 Codex 用量限制差异,称因 sub2api 滥用
火星财经消息,8 月 21 日,OpenAI 回应 Codex 用量限制差异,表示在未与社区沟通前不会擅自更改相关规则。官方调查发现,受影响用户多通过 sub2api 将订阅转化为 API 流量并再分发共享,此类行为会被欺诈预防系统标记。OpenAI 指出,通过 Sign in With ChatGPT 在官方或 OSS 客户端(如 Pi、OpenCode)正常使用订阅,则完全没有问题。
小米发布MiMo-V2.6模型,称其为当前最强开源模型
动察 Beating AI 快讯,小米今日凌晨正式发布并开源了全新的 Xiaomi MiMo-V2.6 系列。团队表示,MiMo-V2.6 系列包含 Pro 和 Flash 两个原生全模态模型。得益于 RL 算力的扩展,MiMo-V2.6-Pro 在 Artificial Analysis Intelligence Index(AA 综合智能指数)中取得 46 分,超过 Kimi K3 和 Qwen3.8 Max,成为当前最强的开源模型;但与最强的闭源模型 Claude Fable5.1 和 GPT-6 Astra 相比,仍有差距。 团队称,MiMo-V2.6 系列沿用 V2.5 系列的 API 定价,MiMo-V2.6-Pro 刷新了中国国产模型的性价比纪录:在同等智能水平下,价格仅为海外模型的 1/20 至 1/60。
Qwen3.8-Omni-Flash上线:自己看视频、调工具、交成片
动察 Beating AI 快讯,阿里千问上线原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图片、音频、视频和 1M 上下文。 这代明显加强了音视频 Agent 能力。模型可以自己从视频里找信息、规划任务,再调用外部工具完成剪辑、配音和渲染。官方展示了长会议处理、短剧翻译、电影解说、MV 制作和视频转图文笔记等场景。 面对几小时的长视频,它也不用从头到尾全部处理。模型会先判断答案可能在哪,再逐步定位关键片段。OmniVideoBench 上,准确率从 63.4 提到 67.8,Token 消耗从 145,736 降到 79,117,少了 45.7%。 千问称,Qwen3.8-Omni-Flash 在 30 项评测上的平均成绩比 Qwen3.5-Omni-Plus 提升超过 26%,音视频能力接近 Gemini 3.8 Flash,音频能力整体超过后者。音频输入成本下降超过 98%,音视频输入下降超过 93%。 目前 Qwen3.8-Omni-Flash 模型权重尚未公开,只开放了 API。千问同时开源了 Qwen-MM-Plugins,可以装进 Claude Code、Codex、Gemini CLI、Qwen Code 等 Agent,给它们补上图片、音频、长视频处理和视频剪辑能力。 另一套 Qwen-Live Harness 更像实时调度层。用户可以直接和实时全模态模型说话,再把复杂任务交给 Gemini CLI、Claude Code、Codex 等后台 Agent 持续执行。它会跟踪任务进度,做完后再主动回来告诉你结果。