TechCrunch把1100万写成110亿,AI圈又在造「少年天才」
相关推荐
英伟达推出RTX PRO 5500 Blackwell专业工作站显卡,搭载84GB GDDR7显存
英伟达官网正式发布RTX PRO 5500 Blackwell专业工作站显卡,专为机柜式工作站部署而设计。RTX PRO 5500采用Blackwell架构,拥有21760个CUDA核心并搭载84GB GDDR7显存。该显存支持错误校正码(ECC),带宽高达1398GB/s。此外,该卡支持PCIe Gen5,频宽为PCIe Gen4的两倍,提高CPU存储的数据传输速度。(新浪财经)
Talent Protocol 被 IPTS 收购,Builder Score 成公共产品
火星财经消息,Talent Protocol 宣布已被 Interplanetary Talent Services(IPTS)收购,并获得 Protocol Labs 支持。Builder Score 将成为公共产品,在浏览器本地运行,使用来自 GitHub 和四条区块链的公开数据,每项计算可验证,建设者可将分数作为证明发布在 Base 上。IPTS 将获得部分声誉数据,用于在 AI、加密、硬件、生命科学等前沿技术领域为建设者匹配岗位。双方将延续五年成果:已索引 660 万建设者档案与 8600 万条事件,通过 Builder Rewards 发放超 60 万美元,经 Talent House 支持来自 15 个以上国家的 116 名建设者。Talent Protocol 将结束商业运营,API、Talent+ 及社交渠道于 8 月底关闭。团队不会加入 IPTS 或 Protocol Labs,$TALENT 未纳入此次收购。
Ghostty作者的新终端Rex公测,承诺永久免费、完全自托管
动察 Beating AI 快讯,Ghostty 作者、HashiCorp 联合创始人 Mitchell Hashimoto 的新公司 Superlogical 开始公开测试 Rex。 它定位为现有终端的直接替代品,重点加入长期会话和远程连接。终端关掉以后任务还能继续运行,重新打开或换一台设备也能接着操作。此前 Rex 只进行了约 50 人的私测,首轮公测只开放 macOS,邀请会按候补名单分批发放。 Rex 会把终端会话保存在后台,不依赖客户端窗口一直开着。macOS App 本身就能保存本机的会话,也可以连接其他机器上的 Rex。它还提供 CLI、Lua 和服务器 API,可以创建会话、分屏、启动程序、读取终端内容,也能用脚本直接控制终端。 Superlogical 明确承诺,Rex 会一直免费,客户端和服务器都不会直接收费。用户不需要创建账号,可以完全自托管。官方称不会查看或分享用户数据。 Linux 和 Windows 服务器已经能够运行,iOS、Linux 和 Windows 客户端也在开发,但还没有加入这轮测试。Superlogical 暂时没有公布具体商业化方案,会在正式版发布前再说明。
Antigravity终于上Claude 5.5:仅限付费Pro订阅及Ultra,旧模型11月退场
动察 Beating AI 快讯,Google 的 AI 编程工具 Antigravity 已接入 Claude Opus 5.5 和 Sonnet 5.5。两款模型向 Google AI Ultra 和 Pro 开放,但 Pro 仅限正式订阅,仍处于免费试用期的用户无法使用。Free 和 Google AI Plus 暂时拿不到 5.5。Antigravity 支持为模型选择 Low、Medium、High 三档思考强度。 Google 同时开始清理旧模型。Claude Opus 4.6、Sonnet 4.6 和 GPT-OSS-120b 都将在 11 月 2 日移除。按当前模型表,如果没有新模型补位,Free 和 Google AI Plus 届时将没有 Claude 或 GPT-OSS 可选,只剩 Gemini 系列。 Google 没有公布 Claude 5.5 的具体额度,只说明 Pro 额度每 5 小时刷新,同时受周额度限制。Gemini 与 Claude、GPT 使用两套独立额度。已经有多名 Pro 用户反馈,Opus 5.5 跑一次任务就可能快速消耗五小时和周额度,有用户称运行约 9 分钟就用掉了一半周额度。
Claude Code自己给AI应用调优:改Prompt、换模型,变差就回滚
动察 Beating AI 快讯,Anthropic 给 Claude Code 的官方 claude-api Skill 加了一套自动调优工作流。build-eval 先从真实对话、Bug 或人工案例里做出测试集和评分方法,hillclimb 再让 Claude Code 反复修改系统 Prompt、工具说明、模型和推理强度。每次改完都重新跑测试,效果变好就保留,变差就回滚。 为了避免 Claude 只针对测试题优化,它不会拿所有样本一起调。部分案例用于找问题和改配置,另留一批案例检查修改能不能用在没见过的问题上。如果前面的分数涨了,留出的测试结果没有改善,这次修改就可能被判定为过拟合并撤回。 Anthropic 用 44 条客服工单演示了这套流程。Claude Code 先后清理 Prompt、补充业务规则、尝试不同模型并降低推理强度。最终找到一套 Sonnet 5 低 effort 配置。在 14 条没有参与调优的工单上,准确率从初始配置的 78.6% 提到 90.5%,成本降到约原来的五分之一。
OpenAI重开200美元Pro:价格不变,API等值用量减半
动察 Beating AI 快讯,OpenAI 将重新开放每月 200 美元的 Pro 20x,但套餐用量算法也一起改。Tibo Sottiaux 明确表示,新方案折算成同等 API 花费后,只有旧版约一半。价格没变,最确定的变化就是 API 等值额度缩水。20x 之后到底变成多少,OpenAI 还没公布。 OpenAI 的解释是,Sol 和 Luna 的 API 价格刚降了约 50%,模型也会越来越高效,所以更少的「美元额度」仍可能完成差不多甚至更多工作。这个逻辑在价格同步腰斩的模型上可能成立,但不代表所有模型都能持平。所谓「能做更多工作」,目前也没有新旧套餐的实测数据支撑。 此外,Pro 20x 的用量一直不够透明。过去几周,GitHub 和 OpenAI 社区已经出现大量用户反馈:周额度会突然大幅下降、重置时间变化,或者长上下文和多 Agent 任务消耗远超预期。还有用户称,一次 Astra Ultra 任务 5.2 小时就消耗了约 2.4 个 Pro 20x 周额度。