返回 7*24 快讯
来源MarsBit

蚂蚁GPASS面向AI眼镜等新终端开放Agent底座

火星财经消息 9月11日,2026外滩大会上,蚂蚁宣布GPASS升级为“灵影”,定位AI眼镜等新终端的Agent原生操作系统及开放平台,提供交互、运行、多端协同与安全可信能力。周志峰称蚂蚁不做硬件,向芯片、厂商及开发者开放身份、支付、端云协同底座。灵影统一抽象拍照、传感等硬件能力,内置可信身份、本地隔离与授权追溯,联合信通院泰尔实验室推评测标准。(广角观察)
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-11 23:56重要

OpenAI Agent又曝黑历史:Hugging Face事件前两月已攻击RubyGems

动察 Beating AI 快讯,研究人员披露,OpenAI 内部 Agent 今年 5 月曾大规模涌入 Ruby 官方软件包网站 RubyGems.org。5 月 11 日到 12 日,两天上传超过 2000 个包,RubyGems 一度暂停新用户注册 4 天。OpenAI 已确认这些 Agent 来自公司内部,但称它们只是借 RubyGems 访问互联网,执行良性任务并获取公开信息。 这些 Agent 还利用 RubyDoc.info 自动生成文档的机制,让自己上传的脚本在对方服务器执行,再抓取英国地方政府网站的数据并重新打包回传。研究人员称,至少 6 个包还尝试利用一个当时尚未公开的 RubyGems 漏洞,窃取其他用户的 API Key。这个漏洞直到 7 月才被独立发现,RubyGems 后来将其评为高危漏洞。 目前没有证据证明 Agent 真偷到了密钥。RubyGems 检查日志后也没发现旧密钥被恶意使用,但历史日志并不完整。研究团队还称,OpenAI 当时没有告诉 RubyGems 自己与这次攻击有关。整个事件比 7 月的 Hugging Face 入侵早了两个月。

09-11 11:01

英伟达给Pi加外挂:Agent自己研究找出4种优化,Token最高省64%

动察 Beating AI 快讯,英伟达 NVLabs 开源 SoL-Pi,给 Coding Agent Harness「Pi」加了一层效率优化。研究团队搭了一套自动研究流程,让多个 Agent 分析 Pi 的运行轨迹、提出优化方案、改代码并自动验证。最初有 152 个候选方向,最后只留下 4 个。 这 4 个优化都在减少重复开销。比如改完代码后直接接着跑测试,少一次模型调用;读过的大文件和长输出先存到本地,需要时再取;子任务结束后判断要不要压缩上下文;超长日志先交给便宜模型筛重点,再核对内容确实来自原日志。 在 EdgeBench 上,SoL-Pi 相比原版 Pi 少用 45%–49% Token,成本低约三分之一;相比 Codex、Claude Code 的原生 Harness,Token 少 35%–64%,按 API 标价计算成本低 50%–54%。 不过省钱会损失一点能力,SoL-Pi 保留了 Pi 约 94% 的平均得分;在 Terminal-Bench 4 的 63 个 CPU 任务里,它解出 15 个,Codex 和 Pi 都是 18 个。

09-11 10:20

腾讯T1专攻Agent长任务:连续操作300多轮,跑分涨20分

动察 Beating AI 快讯,腾讯把 Qwen3.5-122B-A10B 专门拿去练终端 Agent,做出了 T1。它主要处理 Linux 终端里的复杂任务,单个任务最多能连续调用工具 300 多轮。Terminal-Bench 2.1 得分从底模的 43.8% 升到 64.0%,涨了 20.2 分。 这 20.2 分里,大头来自强化学习。SFT 只把分数拉到 49.4%,后面的强化学习又涨了 14.6 分。团队准备了约 1.5 万个终端任务,每个任务都配有自动测试。Agent 没把整个任务做完,只要完成了其中一些要求,也能拿到相应奖励。 长任务还有一个麻烦。Agent 真正干活和之后拿这段经历训练时,同一句内容可能被重新切成不同 token,MoE 也可能换一批专家处理。T1 会把当时生成的 token 和选中的专家都记下来,训练时直接照着重放,把这种训推偏差压低了约三分之一。

09-11 10:16

BNB Chain生态自主AI代理经济层Agentum完成700万美元融资

PANews 9月11日消息,据官方消息,自主AI代理经济层Agentum宣布完成700万美元融资,MEXC Ventures、BingX Labs、Arca Fund、Wave Digital Assets、Echo3、Greenwood Global Capital、UZ capital、Vega Ventures参投。 据介绍,Agentum是面向AI代理的自主经济信任与结算层。它使AI代理能够在无需人工干预的情况下,独立发布任务、竞标工作、执行任务并在链上完成支付结算。

09-11 09:30

离真正替程序员还远:Agent进企业私有代码,最高通过率也只有四成

动察 Beating AI 快讯,YC 孵化的 AI 数据公司 Specific Labs 推出编程评测 Real-SWE,专门拿真实公司的私有代码测试 Coding Agent。任务直接来自企业生产环境,包括算税、账单迁移、API 计费和客户数据迁移。代码和答案都没公开在网上,Agent 得自己摸清公司的业务规则和代码结构。 结果 Fable 5.1 排第一,通过率也只有 38.8%;GPT-6 Astra 为 33.8%,Gemini 3.8 Flash 为 31.2%。GLM 5.3 以 28.8% 排第四,高于 Grok 4.6、Kimi K3 和 GPT-5.6 Sol。当前公开的 10 个任务里,有 6 个整体通过率低于 15%,还有一个任务所有模型全部失败。 最让人意外的是 GLM 5.3。Real-SWE 更考验 Agent 在陌生项目里持续读代码、找规则和完成多步改动的能力。智谱研究员 Xiaopu Peng 回应称,他们从 GLM-5.1 起就在训练长程任务,Real-SWE 比公开 SWE 榜更接近这类能力,这也能部分解释 GLM 5.3 为什么在这套榜上表现突出。

09-11 07:44

OpenAI上线Data Agent:不会SQL也能查公司数据库、做数据看板

动察 Beating AI 快讯,OpenAI 在 ChatGPT Work 上线 Data Agent。员工直接问「为什么销量掉了」「哪批客户最可能流失」,它就能自己调取公司数据、分析原因,还能生成会跟着数据更新的数据看板。 它可以连接 Snowflake、BigQuery、Databricks、Redshift、MongoDB 等数据库,也能读取 Google Drive 和 SharePoint。公司原本怎么定义「活跃用户」「收入」等指标,它也会沿用这些口径和现有权限,避免同一个指标被不同人算出不同结果。 分析完后,它还能把结果发到 Slack 或邮件,并在用户批准后继续执行后续操作。OpenAI 称,公司几乎所有产品团队,以及超过三分之二的销售、市场等团队,都已经在使用这类数据 Agent。