OpenAI将允许外部机构在更早期阶段评估人工智能模型
相关推荐
市场消息:英伟达、Palantir、博思艾伦将限制使用OpenAI模型
BlockBeats 消息,9 月 14 日,据市场消息,英伟达、Palantir、博思艾伦将限制使用 OpenAI 模型。 另有报道称,微软为未来人工智能模型设定限制。
Ziff Davis CEO质疑OpenAI:若能为数据中心投入7500亿美元,为何没钱给出版商?
BlockBeats 消息,9 月 14 日,数字媒体和互联网公司 Ziff Davis CEO Vivek Shah 表示,如果 OpenAI 到 2030 年能够为算力投入 7500 亿美元,就有能力向新闻出版商支付内容授权费用。 Shah 近日就美国司法部在纽约南区版权诉讼中的立场发表评论称,政府认为 AI 公司与出版商签订授权协议可能增加行业负担、限制 AI 发展,但事实上已有大量出版商与 OpenAI 等前沿 AI 公司达成授权合作,Cloudflare、Tollbit 等平台也在降低授权和版税支付的操作成本。 他指出,OpenAI 此前向投资者透露,到 2030 年预计将在算力方面投入约 7500 亿美元,而内容授权费用相较之下只是「小数目」。以美国音乐行业为例,其每年版税和授权支付规模不足 200 亿美元;如果新闻出版行业获得类似规模的费用,对 LLM 公司的整体支出影响有限,却能为各类内容生产者带来重要收入。 Shah 还警告,如果缺乏合理的授权机制,出版商可能通过付费墙和技术限制阻止 AI 抓取内容,最终导致消费者获取免费信息的成本上升,并压缩创作者的收入渠道。
ARK Invest周度报告:AI代理将继续推动Anthropic和OpenAI发展,Grok 4.6或使前沿AI成本曲线下降
BlockBeats 消息,8 月 23 日,「木头姐」Cathie Wood 旗下 ARK Invest 发布周度市场报告,涵盖三大主题,分别为: 人工智能代理将继续推动 Anthropic 和 OpenAI 的发展:Anthropic 已于 6 月 1 日向 SEC 提交 S-1 草稿准备潜在 IPO,并与投资者接触测试市场情绪。截至 5 月底 Anthropic 年化经常性收入(ARR)已达 470 亿美元,从 2026 年初约 90 亿美元起步,仅 5 个月增长超过 5 倍;数据提供商 TickerTrends 估计其当前 ARR 可能超过 740 亿美元。OpenAI ARR 约 410 亿美元,约为年初 200 亿美元的两倍。两家合计 ARR 已超 1150 亿美元,超过 SAP、Salesforce 和 Adobe 合并的 12 个月营收并接近微软生产力与业务流程部门约 1500 亿美元的年化运行率。两家公司均计划通过公开市场融资支持大规模算力建设。 Grok 4.6 可能进一步推动前沿 AI 成本曲线下降:SpaceXAI 发布的 Grok 4.6 专为编程、智能体任务和知识工作设计,关键参数为 50 万 token 上下文窗口,输入 2 美元/百万 token、输出 6 美元/百万 token,显著低于 OpenAI GPT-5.6 Sol(5/30 美元)和 Anthropic Claude Fable 5(10/50 美元)。Artificial Analysis 评估其 Intelligence Index 得分 61,与 GPT-5.6 Sol 持平,仅落后 Claude Opus 5 和 Fable 5 约 1 至 2 分,但价格大幅更低。在任务成本上,Grok 4.6 约 0.84 美元/任务,处于智能-成本 Pareto 前沿;AA-Briefcase 长期智能体知识工作 Elo 得分 1577,与 Claude Fable 5 的 1574 基本持平。SpaceXAI 还推出 Grok Bot,将竞争从模型性能扩展到可长时间运行任务的 Agent 软件层。模型能力提升后成本衡量应从「每 token 价格」转向「每完成任务价格」,若训练和推理成本继续每年分别下降 85% 和 99.9%,企业将在更多工作流中部署智能体,大幅加速 AI 采用。 微小残留病(MRD)检测证明其效用并持
OpenAI 发布 GPT-6 Sol 与 Luna,API 价格下调 50%
ChainCatcher 消息,OpenAI 于 9 月 22 日发布 GPT-6 Sol 与 GPT-6 Luna 两款新模型,发布时间距 Anthropic 推出 Claude Opus 5.5 仅数分钟。两款模型定位低于 GPT-6 Astra,是面向日常工作的更便宜、更快速选项。OpenAI 同时将两款模型的 API 价格较 GPT-5.6 促销价下调 50%,Sol 输入与输出价格分别为每百万 token 2 美元与 10 美元,Luna 则降至 0.1 美元与 0.5 美元。性能方面,OpenAI 援引 Zapier 的 AutomationBench 基准称,GPT-6 Sol 在最高推理设置下得分为 33.2%,每任务成本 0.27 美元,而 Claude Opus 5 最高设置为 26.9%,每任务成本高出逾 11 倍。在 Agents' Last Exam 测试中,GPT-6 Sol 最高得分 56.4%。在 OSWorld 2 计算机使用测试中,GPT-6 Sol 以 60.5% 对 60.3% 几乎追平 Claude Opus 5 的中等努力得分,成本低约 80%。
分析师:个人智能体护城河远超聊天机器人 OpenAI和Anthropic恐承压
火星财经消息,Stratechery分析师本·汤普森表示,Meta的Muse对OpenAI和Anthropic等前沿AI实验室构成的战略威胁,可能比之前估计的更大。汤普森认为,个人智能体的护城河可能比聊天机器人强得多,一旦用户把个人信息喂给智能体并将其融入日常生活,转向其他服务就会变得困难得多。(财联社)
英国议会将邀Meta、谷歌、OpenAI和Anthropic讨论AI安全
9月22日,英国议会商业、创新、科学与贸易委员会宣布,已向Meta、谷歌、OpenAI和Anthropic发出邀请,要求四家公司参加10月13日举行的AI安全问题听证会。委员会将询问AI企业是否应被强制进行发布前安全测试、是否应强制报告重大安全事故,以及如何防止企业和国家间的竞争导致AI安全标准下降。英国政府人工智能安全研究所也获邀参加。(界面)