Tailwind收入暴跌80%后,团队加入Shopify
相关推荐
蚂蚁百灵金融模型正式开源:MIT许可,123道金融搜索题也放出
动察 Beating AI 快讯,蚂蚁百灵正式开源金融模型 Ling-3.0-flash-Fin。模型拥有 1240 亿总参数、51 亿激活参数,支持 256K 上下文。官方放出的 BF16 权重约 255GB,采用 MIT 许可证,可以用 vLLM 和 SGLang 自行部署。 一起开源的还有金融搜索基准 FinFIRST。它由蚂蚁集团开发,中金公司投行团队提供专业支持,50 多名金融专业人士参与出题和验证。最终只有 9.78% 的候选题通过筛选,留下 123 道题。其中 61.8% 需要计算,32.5% 需要同时查多个来源。 每道题会拆成多个评分点,分别检查 AI 有没有找对数据、用对信源、核准时间和统计口径,以及计算结果是否正确。整套数据共有 701 个细分评分点。现在题目、参考答案和评分标准全部公开,采用 Apache 2.0 许可证。
智谱GLM-5.3正式开源:换掉MIT,百亿美元模型服务商要过安全审查
动察 Beating AI 快讯,智谱正式开源 744B 参数的旗舰模型 GLM-5.3,FP8 与 BF16 权重已在 Hugging Face 放出。与上一代 GLM-5.2 不同,这次没有继续使用 MIT,而是换成了新的「GLM-5.3 License」。 新许可证对普通开发者依然比较宽松,可以使用、修改、分发、部署、微调甚至销售模型和衍生版本。但智谱专门给大型「模型即服务」公司加了一条限制:如果公司及关联方任意连续 12 个月总收入超过 100 亿美元,商业使用 GLM-5.3 前必须先通过智谱的安全审查。普通产品把模型嵌入具体功能,不受这一条限制。 GLM-5.3 两周前就已经发布,但智谱当时因为模型的网络安全能力增长超出预期,决定先做额外安全评估和加固,再开放权重。现在模型也已经支持 SGLang、vLLM、Transformers、KTransformers 等框架自行部署。
给 Agent 克隆 Slack 和 GitHub,Arga Labs 融资 1000 万美元
动察 Beating AI 快讯,Arga Labs 完成 1000 万美元种子轮融资,由 General Catalyst 领投,BoxGroup、Emergence、Gradient 和 SV Angel 等参投。这家只有 4 人的 YC 创业公司,专门给 AI Agent 搭测试沙盒(与真实系统隔开的测试环境)。它会复制 Slack、GitHub、Salesforce、Stripe 等软件,让 Agent 上线前先在里面反复操作。 传统测试通常只是伪造几个 API 返回结果,很多意外情况覆盖不到。Arga 则会连软件里的数据状态、账号权限、Webhook 和报错情况一起复制。比如销售 Agent 可以同时操作测试版 Salesforce 和 HubSpot,看它会不会认出两个联系人来自同一家公司,避免重复发邮件。 目前 Arga 已支持 30 多种软件。官方称,现在最快不到 12 小时就能复制一个 SaaS 的后端行为。过去 16 周,客户已经启动超过 10 万个测试环境,Slash、Monaco、Y Combinator 等团队都在使用。 新融资会继续砸在自动造环境上。Arga 正在开发新的生成系统,想把复制一个 SaaS 的时间从几小时压到几分钟。最终它希望做到,Agent 自己发现一个新 API 后,系统就能自动生成对应的测试环境,让 Agent 先在里面反复试错,再真正接触生产系统。
谷歌最强语音转写模型来了:准确率进前五,但还没打过ElevenLabs
动察 Beating AI 快讯,谷歌发布 Gemini 3.5 Transcribe,这是目前最准确的谷歌语音转写模型,也是谷歌首次在专用转写模型中加入 Smart 模式。模型分实时和录音转写两版,目前已开放 Gemini API 公测。Artificial Analysis 评测中,非流式 WER(词错误率,越低越好)为 2.6%,实时版为 4.0%。最终转写延迟相比上一代 Chirp 3 缩短 70%。 Smart 模式不再只是把声音逐字变成文字。比如你说「周二开会,不,周三」,它会直接留下「周三」;「嗯、啊」等口头禅也会自动删除,还能把口语整理成段落、列表、日期和数字。需要会议记录原话时,也可以继续使用默认的逐字转录模式。 模型支持 85 种以上语言和中途切换语言,还能加入自定义专业词汇。录音转写约每分钟 0.005 美元,也就是每 1000 分钟 5 美元;实时版约每分钟 0.009 美元。独立榜单上,它比 OpenAI GPT Transcribe 的 3.3% 更准,但还没超过 ElevenLabs Scribe v2:后者 WER 为 2.2%,每 1000 分钟约 3.67 美元。 这套模型已经用于 Android 的 Rambler 和 macOS 版 Gemini,接下来还会进入 Chrome。届时可以直接在网页输入框里说话打字。
亚马逊 AWS:将收购 DuckLabs,开源数据库 DuckDB 团队加入云计算业务
火星财经消息,亚马逊官方宣布已签署最终协议,计划收购数据基础设施公司 DuckLabs。交易预计将在满足惯例交割条件后完成,收购完成后,DuckLabs 团队将加入亚马逊云科技(AWS)。DuckLabs 是开源分析数据库 DuckDB 背后的开发公司。AWS 表示,双方自 2024 年以来已展开合作,此次收购旨在结合 DuckLabs 在数据库工程领域的技术能力,进一步提升 AWS 数据分析服务的速度、易用性和成本效率。DuckDB 联合创始人 Hannes Mühleisen 和 Mark Raasveldt 将在加入 AWS 后继续领导团队,并负责开源项目的技术发展方向。亚马逊强调,此次交易并不包括收购 DuckDB 开源项目本身,DuckDB 仍将由独立的 DuckDB 基金会负责维护,并继续以 MIT 许可证免费开放。亚马逊表示,在交易完成前后,DuckDB 用户体验不会发生变化,项目仍将保持开源运行。未来 AWS 将进一步公布 DuckLabs 与 AWS 业务融合后的具体规划。
Shopify CEO向Anthropic施压:若Claude Code拒绝支持AGENTS.md,或考虑内部禁用
动察 Beating AI 快讯,Shopify CEO Tobi Lütke 公开表示,如果 Claude Code 继续拒绝读取 AGENTS.md 及.agents/skills,他正在考虑在 Shopify 内部禁用 Claude Code。 Tobi 指出,随着 Codex、Cursor、Claude Code 等 AI 编程工具被企业团队同时使用,越来越多 Coding Agent 开始支持通过统一的 AGENTS.md 配置项目规范、测试流程及 Agent 指令。但 Claude Code 目前主要依赖 CLAUDE.md 和.claude/skills,可能导致同一代码仓库被不同 Agent 读取到不同规则,形成所谓的「脑裂」(split brain)。 他认为,对于个人开发者而言维护多套配置文件影响有限,但对于 Shopify 这类拥有大量工程师的企业,多套 Agent Context 需要持续同步,一旦出现差异,就可能导致 Agent 执行行为偏离团队规范。 此次争议表面上是配置文件格式之争,背后则涉及 AI Coding Agent 进入企业后,项目规范、Skills 和 Context 究竟应采用厂商专属标准,还是形成跨 Agent 通用标准的问题。