加密货币价格波动剧烈,本站内容仅供参考,不构成投资建议。投资有风险,可能导致全部损失。

查看完整免责声明
返回 7*24 快讯
来源Blockbeats

GPT-6 Astra直接接管机器人「大脑」,模拟成绩超过专用VLA

动察 Beating AI 快讯,由香港大学 MMLab 牵头的机器人操作评测项目团队 RoboDojo 做了个反常规实验。他们没有给 GPT-6 Astra 再配一个训练好的机器人策略,而是让这个通用多模态模型直接看相机、读取机器人状态、理解任务,再自己决定下一步怎么动。中间只有一套固定控制工具,把 Astra 给出的目标位置转成机械臂动作。 在 42 项模拟任务里,Astra 拿到 28.97 分、22.48% 平均成功率,超过原公开榜首 DM0.5 的 24.90 分、19.34%。同一套控制方式换成 GPT-5.5,只有 1.13 分、0.88%。 RoboDojo 公开榜过去主要是 VLA、WAM 这类专门训练的机器人策略。现在,原本需要专用模型完成的一部分动作决策,通用大模型已经可以直接接手,而且整体成绩还超过了原榜首。机器人是否还需要单独训练一颗「大脑」,这个问题第一次变得很具体。 但 Astra 还替不了机器人的「小脑」。插入、倒液体、精细接触这些依赖真实物理控制的任务,它明显更弱。真机测试还因为多次出现危险动作并损坏硬件,被团队提前叫停。 随着通用模型能力变强,机器人模型的分工可能会被重新划分:大模型负责看懂环境、判断和规划,专用 VLA 与传统控制器负责把动作做准、做稳。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-16 06:08

GPT-6 Astra把Minecraft玩到AI从未到过的进度,最后栽在苦力怕手里

动察 Beating AI 快讯,在 AI 模型评测公司 Vals AI 的 Minecraft 长时程测试中,GPT-6 Astra 推进到了此前任何 AI 系统都没达到过的进度。它搭出了半自动烈焰人农场,拿到 6 根烈焰棒,又找到诡异森林,击杀 6 只以上末影人并收集到 3 颗末影珍珠。 但 Astra 随后把重要物资全放进一个箱子。一只苦力怕突然出现,把箱子和床一起炸掉,关键物资几乎全部丢失。 此后 Astra 连续几个小时几乎只在种土豆,还开始反复警惕苦力怕。它甚至会看到绿色物体就提醒自己「这是甘蔗,不是苦力怕」。

09-07 11:04

OpenAI CEO:GPT-6 Astra让每个人拥有天才级员工,AI时代迎来「创意人士的复仇」

动察 Beating AI 快讯,据 AXIOS 报道,OpenAI 首席执行官 Sam Altman 表示,当前时代正迎来「创意人士」的复仇——那些曾经令人厌烦、空有创业想法却缺乏技术能力去实现的有志创业者。 这就像说「我有一个很好的歌曲创意,只需要那个拿吉他的人帮我做出来」一样。「我以前确实觉得这很可笑,」Altman 在北卡罗来纳州教堂山表示,「但现在我们看到整整一代人以前所未有的速度迭代创意。创办小型或大型企业的经济逻辑已经被重新定义。」 民调显示多数美国人认为 AI 风险大于收益,数据中心问题已成为中期选举中两党共同的争议焦点。正试图在强烈反对声中推广 AI 的 Altman 希望提醒美国人,在诸多现实风险之中,AI 也意味着机会。「这将是世界上创办初创公司最好的时代,」Altman 近期表示。 Altman 表示,借助 OpenAI 强大的新模型 GPT-6 Astra,你可以有效地创办和运营一家小企业……任何想拥有公司的人,现在在每个专业领域都拥有天才级的员工。

09-05 02:34

GPT-6 Astra全量上线:OpenAI连送两次额度重置

动察 Beating AI 快讯,OpenAI 已将 GPT-6 Astra 向 Plus、Pro 和 Business 用户全量开放。昨天 Astra 还处在分批推送阶段,很多 Pro 用户也用不了;今天 Plus 和 Pro 用户都已经可以在 ChatGPT Work 和 Codex 中使用。核心产品负责人 Thibault Sottiaux 称,团队的系统扩展能力比预想更强,因此很快完成了这轮全量上线。 Astra 首发时只给少量企业客户。OpenAI 原本预计要用几天逐步开放。大量付费用户迟迟拿不到后,Sam Altman 还为这次「混乱的发布」道歉。现在团队称系统扩展能力比预想更好,因此提前把 Plus 也发完了。 原本承诺的补偿也照发。符合条件的现有 Plus、Pro 和 Business 用户,9 月 3 日和 4 日各能拿一次 banked reset。它相当于一张可以以后手动使用的 Codex 满额重置券,会刷新 5 小时和周额度。北京时间 9 月 5 日 11:00 前新开账号或升级套餐,也能拿到这次重置。 Plus 虽然能用 Astra,但额度不算宽裕。OpenAI 当前估算,Plus 每 5 小时大约可跑 5–45 条 Astra 本地消息,GPT-5.6 Sol 则是 10–100 条。实际消耗取决于任务长度、推理强度和工具调用。

09-04 09:08

GPT-6 Astra不是无限聊:100美元会员每周50条,200美元会员每周200条

动察 Beating AI 快讯,OpenAI 公布 GPT-6 Astra 在 ChatGPT 里的用量限制。Astra 在普通聊天里叫 GPT-6 Pro。100 美元 Pro 每周 50 条,而且要和 GPT-5.6 Sol Pro 共用;200 美元 Pro 则有 200 条 Astra / 周。 200 美元 Pro 的 GPT-5.6 Sol Pro 另外有每天 170 条,但两个 Pro 模型合计每天最多 200 条。Business Standard 每月 15 条,Business Premium 每周 50 条,也要和 Sol Pro 共用额度。 Plus 用户在普通 Chat 里没有 GPT-6 Pro,但不是完全用不上 Astra。等模型开放到账号后,Plus 可以在 Work 和 Codex 里使用有限额度的 Astra,超出后还能购买 credits。Chat、Work 和 Codex 的额度分别计算。 Astra 目前仍在分批开放,所以符合套餐也不代表现在就能看到。

09-04 07:36

GPT-6 Astra拿下Perplexity研究Agent榜首:比Fable 5.1高13.5%,还便宜6.1%

动察 Beating AI 快讯,Perplexity 用自家的 Agent 基准 WANDR 测了 GPT-6 Astra,得分 0.682,是目前测过的模型里最高。平均每个任务成本 11.98 美元。相比 Claude Fable 5.1,分数高 13.5%,成本反而低 6.1%;相比 Opus 5,分数高 27%,成本只高 3.3%。 WANDR 专门测「又广又深」的研究任务。它有 500 个真实研究任务,要求 Agent 不只是找到几个答案,而是尽量找全符合条件的对象,再逐个查资料、核身份,并给每条结果配上可验证的来源。典型任务包括竞品研究、尽调、文献检索、市场分析和人才搜寻。 此前 Fable 5.1 以 0.601、每任务 12.76 美元排第一,Opus 5 为 0.537、11.60 美元。Astra 这次把分数明显往上推了一截,而且不是用更高成本硬堆出来的。

09-03 08:18

GPT-6 Astra即将发布:OpenAI官方仓库已出现GPT-6

动察 Beating AI 快讯,OpenAI 官方的 GitHub 仓库里,已经直接出现了 GPT-6。一名 OpenAI 开发者向 Computer Use 示例项目提交 PR,新增 gpt6-js-image 和 gpt6-py-image 两套环境,分支名也直接叫 codex/gpt6-computer-use-images。 这两套环境分别面向 JavaScript 和 Python。前者装好 Playwright 和 Chromium,后者则用 PyAutoGUI、Chromium 和 Linux 桌面环境,让 Agent 可以看屏幕、操作浏览器和桌面。PR 目前还没有合并,而且里面没有 GPT-6 的 API 调用,只是在准备 Computer Use 的运行环境。 Sam Altman 最近在采访中称,过去的模型操作电脑一直太慢或者不好用,但 Astra 让他第一次感觉「已经达到和人类差不多的水平」。他现在会直接让模型去不同应用里找消息,而不是自己一个个打开搜索。