网信办通报江苏公司 API 中转站未做安全评估被警告
相关推荐
OpenAI把GPT-5.6 Sol提速14倍:750 token/s先上API
据动察 Beating 监测,OpenAI 开始预览 GPT-5.6 Sol 的 Ultrafast 模式。它由 Cerebras 提供算力,最高输出速度达到 750 token/s,最高是 Standard 模式的 14 倍。目前只向少量 API 客户开放。 OpenAI 已在故障排查、研究、客服、金融分析和开发 Agent 等场景中测试 Ultrafast。对于需要连续多次调用模型的 Agent,单次响应提速也能直接缩短整个任务的执行时间。 这比 OpenAI 7 月底推出的 Fast 模式又快了一档。Fast 模式最高是 Standard 的 2.5 倍,Ultrafast 则把上限推到 14 倍。OpenAI 暂未公布 Ultrafast 的价格,也没有宣布何时进入 ChatGPT。
Ondo Finance 将于 Korea Blockchain Week 与 TOKEN2049 期间举办闭门论坛
Foresight News 消息,Ondo Finance 宣布加速布局亚太市场,将于 Korea Blockchain Week 首尔站与 TOKEN2049 新加坡站期间,分别举办闭门论坛,集结区域内最具影响力的机构与行业声音,进一步巩固其在亚太机构市场的领先地位。 在新加坡,Ondo 将于 10 月 6 日 TOKEN2049 期间举办闭门论坛「Open Interest」,由 Ondo Perps 首席执行官及战略团队分享产品方向与行业趋势判断,随后展开机构专家 panel 讨论。已确认出席的嘉宾包括富兰克林邓普顿(Franklin Templeton)、新加坡交易所(SGX Group)、暹罗商业银行(Siam Commercial Bank)及 Ericsenz Capital,Ondo 现有合作伙伴 SBI Holdings 也将同台出席。 此外,Ondo 亦将于 Korea Blockchain Week 期间举办闭门论坛,现有合作伙伴 Mirae Asset Global Investments 确认出席,同时邀请到 Hanwha Asset Management、Meritz Securities 等机构嘉宾,以及加密行业知名声音 Fireant 与 WeCryptoTogether。
AI编程代理Amp取消BYOK月费与Token费用,用户可用自有算力免费运行
PANews 9月13日消息,据Amp官方公告,AI编程代理Amp现已允许用户在自备算力以及模型订阅或API密钥的情况下免费使用。用户通过ChatGPT订阅接入Amp不再需要月度套餐,BYOK模式也不再收取Amp Token费用或设置额度限制(企业版除外)。用户可在自有电脑上通过Runner免费运行Amp代理,也可按量付费使用远程计算环境Orbs。
英伟达给Pi加外挂:Agent自己研究找出4种优化,Token最高省64%
动察 Beating AI 快讯,英伟达 NVLabs 开源 SoL-Pi,给 Coding Agent Harness「Pi」加了一层效率优化。研究团队搭了一套自动研究流程,让多个 Agent 分析 Pi 的运行轨迹、提出优化方案、改代码并自动验证。最初有 152 个候选方向,最后只留下 4 个。 这 4 个优化都在减少重复开销。比如改完代码后直接接着跑测试,少一次模型调用;读过的大文件和长输出先存到本地,需要时再取;子任务结束后判断要不要压缩上下文;超长日志先交给便宜模型筛重点,再核对内容确实来自原日志。 在 EdgeBench 上,SoL-Pi 相比原版 Pi 少用 45%–49% Token,成本低约三分之一;相比 Codex、Claude Code 的原生 Harness,Token 少 35%–64%,按 API 标价计算成本低 50%–54%。 不过省钱会损失一点能力,SoL-Pi 保留了 Pi 约 94% 的平均得分;在 Terminal-Bench 4 的 63 个 CPU 任务里,它解出 15 个,Codex 和 Pi 都是 18 个。
四川首笔“Token算力场景”贷款落地成都
PANews 9月8日消息,据新华财经报道,工商银行成都分行为成都高新区一家高新技术企业发放四川首笔“Token算力场景”贷款,首次将企业AI算力消耗、Token采购成本等“算力账单”纳入授信评价体系。该企业主要从事软件开发、小程序和App研发及AI智能体落地,因缺乏传统抵押物难以获贷。工行此次以真实算力账单、词元调用日志、算力服务合同、AI业务订单及应收账款作为核心依据,贷款资金定向用于大模型API调用费和算力租赁费,以缓解“算力先付费、项目后回款”的账期错配压力。
B.AI 宣布 Gemini 3.8 Flash 正式接入 API
火星财经消息,9 月 4 日,B.AI 平台宣布 Google DeepMind 最新 Gemini 3.8 Flash 模型正式接入 API。该模型为 Gemini 3 家族最新一代主力模型,支持 1M Token 上下文窗口与原生多模态输入。据该平台介绍,Gemini 3.8 Flash 在保持 Flash 系列低延迟特点的同时,于软件工程、智能体任务及专业领域多步推理等方面有所提升,在金融和法律等专业领域同样有所表现,面向复杂推理与长期 Agent 工作流。官方 API 接入现已开放。