我国启动人工智能大模型IPv6能力提升专项行动
相关推荐
OpenAI把GPT-5.6 Sol提速14倍:750 token/s先上API
据动察 Beating 监测,OpenAI 开始预览 GPT-5.6 Sol 的 Ultrafast 模式。它由 Cerebras 提供算力,最高输出速度达到 750 token/s,最高是 Standard 模式的 14 倍。目前只向少量 API 客户开放。 OpenAI 已在故障排查、研究、客服、金融分析和开发 Agent 等场景中测试 Ultrafast。对于需要连续多次调用模型的 Agent,单次响应提速也能直接缩短整个任务的执行时间。 这比 OpenAI 7 月底推出的 Fast 模式又快了一档。Fast 模式最高是 Standard 的 2.5 倍,Ultrafast 则把上限推到 14 倍。OpenAI 暂未公布 Ultrafast 的价格,也没有宣布何时进入 ChatGPT。
DeepSeek连调休补班也算低谷,今天API仍是半价
动察 Beating AI 快讯,DeepSeek 补充 API 峰谷计费规则。调休上班的周末,以及中国法定节假日,全天都按空闲时段收费。今天 9 月 20 日虽然是国庆调休工作日,但 API 依旧执行低谷价。 DeepSeek 8 月 17 日开始实行峰谷定价,空闲时段价格为高峰的一半。不到一周后,它又把周六、周日全部改成低谷价。这次进一步把调休补班和法定节假日的计费口径说清楚。 以 deepseek-flash 为例,每百万 token 缓存未命中输入,空闲时段是 1 元,高峰 2 元;输出分别是 4 元和 8 元。国庆另一个补班日 10 月 10 日是周六,同样按低谷价算。
网信办通报江苏公司 API 中转站未做安全评估被警告
火星财经消息,X 用户 MaxForAI 称,国家网信办近日通报一起 API 中转站违法案例。9 月 15 日,网信中国公布一批网络执法案例,江苏某科技股份有限公司运营的 2 个网站以 API 中转站方式调用多个大模型产品接口,对外提供对话、问答等服务,未按规定开展安全评估,存在内容安全风险,违反《生成式人工智能服务管理暂行办法》等规定。属地网信办责令整改、从严处理责任人,并予以警告处罚。该用户称,上述描述与今年 7 月苏宁易购旗下江苏碧英科技上线的大模型中转平台智新 Token 细节相符,当时该平台通过两个服务域名对外聚合多个主流大模型提供统一 API 服务。
Ondo Finance 将于 Korea Blockchain Week 与 TOKEN2049 期间举办闭门论坛
Foresight News 消息,Ondo Finance 宣布加速布局亚太市场,将于 Korea Blockchain Week 首尔站与 TOKEN2049 新加坡站期间,分别举办闭门论坛,集结区域内最具影响力的机构与行业声音,进一步巩固其在亚太机构市场的领先地位。 在新加坡,Ondo 将于 10 月 6 日 TOKEN2049 期间举办闭门论坛「Open Interest」,由 Ondo Perps 首席执行官及战略团队分享产品方向与行业趋势判断,随后展开机构专家 panel 讨论。已确认出席的嘉宾包括富兰克林邓普顿(Franklin Templeton)、新加坡交易所(SGX Group)、暹罗商业银行(Siam Commercial Bank)及 Ericsenz Capital,Ondo 现有合作伙伴 SBI Holdings 也将同台出席。 此外,Ondo 亦将于 Korea Blockchain Week 期间举办闭门论坛,现有合作伙伴 Mirae Asset Global Investments 确认出席,同时邀请到 Hanwha Asset Management、Meritz Securities 等机构嘉宾,以及加密行业知名声音 Fireant 与 WeCryptoTogether。
AI编程代理Amp取消BYOK月费与Token费用,用户可用自有算力免费运行
PANews 9月13日消息,据Amp官方公告,AI编程代理Amp现已允许用户在自备算力以及模型订阅或API密钥的情况下免费使用。用户通过ChatGPT订阅接入Amp不再需要月度套餐,BYOK模式也不再收取Amp Token费用或设置额度限制(企业版除外)。用户可在自有电脑上通过Runner免费运行Amp代理,也可按量付费使用远程计算环境Orbs。
英伟达给Pi加外挂:Agent自己研究找出4种优化,Token最高省64%
动察 Beating AI 快讯,英伟达 NVLabs 开源 SoL-Pi,给 Coding Agent Harness「Pi」加了一层效率优化。研究团队搭了一套自动研究流程,让多个 Agent 分析 Pi 的运行轨迹、提出优化方案、改代码并自动验证。最初有 152 个候选方向,最后只留下 4 个。 这 4 个优化都在减少重复开销。比如改完代码后直接接着跑测试,少一次模型调用;读过的大文件和长输出先存到本地,需要时再取;子任务结束后判断要不要压缩上下文;超长日志先交给便宜模型筛重点,再核对内容确实来自原日志。 在 EdgeBench 上,SoL-Pi 相比原版 Pi 少用 45%–49% Token,成本低约三分之一;相比 Codex、Claude Code 的原生 Harness,Token 少 35%–64%,按 API 标价计算成本低 50%–54%。 不过省钱会损失一点能力,SoL-Pi 保留了 Pi 约 94% 的平均得分;在 Terminal-Bench 4 的 63 个 CPU 任务里,它解出 15 个,Codex 和 Pi 都是 18 个。