Analysis: Stablecoins continue to see outflows, putting Bitcoin under liquidity pressure.
相关推荐
Artificial Analysis新AI评测显示Claude比DeepSeek贵44倍
据动察 Beating 监测,评测机构 Artificial Analysis 调整了 AI 智能指数的评测标准,不再只让 AI 做单项选择题,而是全面考验 AI 能否自主规划、使用工具并解决复杂任务。新评测取消了考验听懂简单指令的旧项目,转而引入模拟银行客服真实对话等高难度场景,并首次将跑完一次任务要花多少钱、耗时多长作为核心考核指标。 在最新的评测结果中,已被美国政府管制下线的 Claude Fable 5 拿到了 60 分的最高成绩。而在目前市面上买得到的 AI 中,最贵的 Claude Opus 4.8 拿到了 56 分的第一名,以微弱优势领先拿到 55 分的 GPT-5.5。国产模型表现也相当亮眼,开源的 DeepSeek V4 Pro 与 MiniMax M3 都拿到了 44 分,紧随其后的是 43 分的 Kimi K2.6。 模型在费用上的差距十分巨大。同样运行一次任务,使用最先进的 Claude Opus 4.8 需要花费 1.78 美元(约合 13 元人民币),而使用国产开源的 DeepSeek V4 Pro 跑一次仅需 0.04 美元(约合 0.3 元人民币)。这意味着 Claude 的调用成本是 DeepSeek 的 44 倍。完成一次任务的等待时间也天差地别,最快的 xAI Grok 4.3 仅需 1.5 分钟,而最慢的 Claude Sonnet 4.6 却需要 13.5 分钟。 作为这次改制中权重最高的单一测试,考核真实世界知识工作的 GDPval-AA 升级到了第二版,占比提升至 20%。新版测试将人类的表现基准分设为 1000 分,并引入多个前沿模型轮换担任裁判,同时将单次对话的回合上限放宽到了 250 次。
「韩模之光」Solar Pro4智能指数冲到42分,但还是打不过DeepSeek V4Flash
据动察 Beating 监测,韩国 AI 公司 Upstage 发布旗舰推理模型 Solar Pro 4。Artificial Analysis 最新评测中,它的智能指数从上一代 Solar Pro 3 的 14 分冲到 42 分,主要提升来自 Agent 和长上下文能力。 其中 Terminal-Bench v2.1 从 12% 升到 57%,长上下文推理从 31 升到 71。GDPval-AA v2 也从 498 Elo 升到 1277,超过 1000 的人类基线。Solar Pro 4 已经是韩国模型冲击全球前列的一张代表牌。 但放到 DeepSeek V4 Flash 0731 面前,还是不够看。同一套 Artificial Analysis 智能指数里,DeepSeek 拿到 52 分,比 Solar Pro 4 高 10 分。DeepSeek 每秒输出约 122 个 Token,Solar Pro 4 约 65 个,前者接近快一倍。 价格差距更大。Solar Pro 4 每百万 Token 输入、输出分别要 0.30 和 1.20 美元,DeepSeek 只要 0.14 和 0.28 美元。Solar 的输出价格超过 DeepSeek 的 4 倍。 至少按这套综合评测和 API 性价比,「韩模之光」还没追上 DeepSeek。
QuailSeed利用鹌鹑蛋纹理生成24词BIP-39比特币助记词
Odaily星球日报讯 Bitcoin News 在 X 平台发文表示,一款名为 QuailSeed 的新型实验性开源工具利用鹌鹑蛋天然形成的色素纹理,作为生成 24 词 BIP-39 比特币助记词的物理输入。该过程从四个角度拍摄 12 枚鹌鹑蛋,分析并测量蛋壳纹理,将结果转换为确定性记录,再通过密码学处理生成 256 位熵。开发者强调,QuailSeed 属于实验性研究软件,尚未经过独立审计或形式化验证,也未获批准作为安全随机数生成器或生产级托管系统使用。
SemiAnalysis创始人:AI推理市场规模或超越石油,成为全球最大市场之一
BlockBeats 消息,7 月 1 日,SemiAnalysis 创始人 Dylan Patel 近日接受红杉资本播客《Training Data》采访时表示,AI 推理将成为全球最大市场之一,规模可能超过石油,并占全球 GDP 的若干个百分点。他认为,模型每次迭代升级后,可完成任务的数量和价值扩张速度持续快于算力增长,因此算力短缺或将长期存在。 Patel 预计,到 2030 年,仅 OpenAI 和 Anthropic 两家公司合计算力需求就将超过 100 吉瓦;未来 3 至 5 年,太空数据中心影响仍可忽略不计,但到 2040 年,超过一半新增算力可能进入太空。他表示,核心制约在于地面能源成本和建电能力,一旦太空部署经济性超过地面,算力向太空迁移将成为必然。 在硬件和软件协同设计方面,Patel 表示,过去三年 AI 效率提升并非主要来自硬件,而是来自模型层和跨层协同优化。他以 DeepSeek 为例称,其专家模型形状专门为英伟达 Hopper 架构优化,因此在 Hopper 上运行表现出色,但在 TPU 上表现不佳;Anthropic 模型更适合 TPU,OpenAI 模型则更偏向 GPU 路线。他认为,所谓 CUDA 护城河,本质上并不只是 CUDA 本身,而是开源模型生态普遍围绕 GPU 协同优化。 Patel 还表示,英伟达 CEO 黄仁勋大力扶持新兴云计算商,是为了避免超大规模云厂商垄断算力格局,并推动形成多极化市场。此外,SemiAnalysis 团队搭建的实时推理基准系统 InferenceX 显示,在等效质量下,推理成本每年下降约 60 倍,每瓦智能改善约 40 倍。
DeepSeek 正布局情感 AI 方向,招聘情感智能数据产品经理
ChainCatcher 消息,据智能纪元 AGI 独家获悉,DeepSeek 正在大量招聘情感智能数据产品经理职位,日薪 510 元,负责优化 DeepSeek 模型在情感场景下的能力表现,提升角色扮演与情感交互的真实感与沉浸度,深入挖掘情感场景中的 Badcase 并进行归因分析。 该招聘信息表明 DeepSeek 正在从编程等基础能力向更接近人类语言的情感交互方向拓展,产品定位类似豆包,旨在打造更具“人格化”特征的 AI 模型体系,而非局限于编程场景。此前 DeepSeek 已于 8 月 13 日面向开发者推出 Harness 预览版,据花旗研报及易观数据,当前市场同类产品 WorkBuddy 跨平台 MAU 已突破 2000 万,PC 端月访问量 2097 万次。DeepSeek 尚未就情感 AI 方向的具体产品规划作出说明。
发现大量严重及高危漏洞,Bitcoin Red Team完成比特币开源生态基础扫描
Odaily星球日报讯 Bitcoin News 在 X 平台发文表示,经过两周使用前沿 AI 扫描几乎整个比特币开源生态的漏洞,Bitcoin Red Team 成员@callebtc 表示,“容易发现的漏洞已经处理完毕”,维护者正在验证“大量”严重及高危漏洞。 @callebtc 表示,主要发现包括:数十年积累的开源技术债务,正与能够以人类研究人员无法达到的速度和规模发现漏洞的 AI 能力同时暴露;Lightning 似乎尤其容易受到影响,其复杂性意味着其安全状况“比平均水平更差”;在得到证实安全之前,未维护的比特币项目或应被视为存在漏洞。 数月前就开始构建 AI 安全和审计流程的项目,与那些等待至今的项目相比,目前处于完全不同的位置。 Bitcoin Red Team 现已完成对几乎整个比特币开源生态的基础扫描。容易发现的漏洞已基本处理完毕,但随着 AI 能力提升,外部红队测试可能需要无限期持续。 尽管发现并报告了“大量”真实的严重及高危漏洞,@callebtc 认为这一过程最终将使比特币更加强大。同样的 AI 安全审查很快也将扩展至远超比特币的领域。