返回 7*24 快讯
来源MarsBit

AI开始影响考勤:有公司为省Token让程序员倒班,以降低高峰时段额度消耗

动察 Beating AI 快讯,一家十来人的创业公司开始让程序员倒班,原因不是服务器要 24 小时值守,而是想省 AI Token。员工在 V2EX 发帖称,公司大量使用 DeepSeek、智谱等 Coding 服务,模型在部分高峰时段收费或额度消耗更高,公司索性开始跟着便宜时段排班。 新考勤要求员工每周工作日休一天、周末再休一天,可以自由组合,但要提前排班。工作日午休也被推迟到 14:00 以后。发帖人随后透露,公司只有十来个人,目前同时购买了 MiniMax、GLM、DeepSeek 和火山引擎等多套 Coding Plan。 DeepSeek 新一轮 API 定价把工作日高峰价定为低谷价的两倍,8 月 23 日又把周末改成全天低谷价。智谱的 Coding Plan 也按时间算额度,非高峰时段内,模型调用按基础积分消耗的 50% 抵扣。 原帖下面有人吐槽,人类居然开始主动配合 AI 的价格时段工作;也有网友称,自己公司的老板已经听说类似做法,还在考虑要不要跟。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-11 05:14

DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一

动察 Beating AI 快讯,Artificial Analysis 完成 DeepSeek V4.1 Flash 独立测试,综合智能指数拿到 40 分。它已经超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这套第三方榜单,DeepSeek 还没夺回国产模型第一。 但价格差距非常夸张。V4.1 Flash 跑完一个 Intelligence Index 任务平均只花 0.27 美元,Kimi K3 和 GLM-5.3 都在 2 美元左右,相差约 7 倍。输出速度达到 197 Token/s,也远高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。 Agent 依然是它最强的部分。AutomationBench-AA 上,V4.1 Flash 拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;长上下文测试 AA-LCR 也拿到 84%。缺点是它特别能说,AA 测试中单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,吃掉了一部分价格优势。

09-03 06:26

天猫上线Token充值中心,首批接入阿里云、智谱、Kimi、MiniMax

火星财经消息,9月3日,天猫正式上线AI 空间站( Token充值中心)。页面显示,该充值中心集合了阿里云、智谱、Kimi、MiniMax等国内大模型厂商的订阅服务,在售商品包括按周期订阅的Token Plan、Coding Plan以及按用量付费的充值方案,支持卡密或直充两种交付方式。

09-01 07:37

FreeToken开源:一张5090跑DeepSeek-V4-Flash,最高25 Token/s

动察 Beating AI 快讯,伯克利、MIT 等研究者开源 FreeToken。这是一个专门为本地设备设计的 MoE(混合专家模型)推理引擎,主要解决超大模型显存装不下的问题。它会把部分权重放在系统内存,并让 CPU 和 GPU 一起参与推理。 FreeToken 会把模型的大量专家权重放在系统内存,只把一部分缓存在显存。遇到显存里没有的专家时,它会根据 PCIe 和 CPU 内存带宽,动态决定是把权重搬到 GPU,还是直接交给 CPU 计算。这样 CPU、GPU、系统内存和 PCIe 可以一起参与推理。 论文实测,一台配备 RTX 5090 的游戏台式机运行 284B 参数的 DeepSeek-V4-Flash,可以达到 22–25 Token/s。这款模型每生成一个 Token 实际只激活约 13B 参数,因此特别适合这种 CPU、GPU 混合推理。 FreeToken 还在 8GB 显存的 RTX 4060 笔记本上把 35B 模型跑到 39.3 Token/s;单张 96GB RTX PRO 6000 则可以运行 753B 参数的 GLM-5.2,速度达到 llama.cpp 的约两倍。项目目前支持超过 20 款 MoE 模型,并已采用 Apache 2.0 许可证开源。

08-31 11:42重要

智谱API涨价一倍还越用越猛:调用量涨40倍,大客户涨98倍

动察 Beating AI 快讯,智谱这半年不只是 API 收入暴涨,调用量和商业效率也一起上去了。截至财报发布,MaaS 平台 Token 调用量较年初增长超过 40 倍,付费日活增长 603%。其中前十大客户的日均调用量更是增长 98 倍。 而且,这轮增长并不是靠降价换来的。上半年智谱 API 平均售价同比上涨约 101%,Coding Plan 也提高了订阅价格。量价同时上涨,最终把开放平台和 API 收入推到 8.25 亿元,同比增长 2735.7%。 智谱还在财报里披露了一个自定义指标「算力乘数」,用来衡量每投入 1 元算力成本能带来多少 API 收入。上半年这个指标同比提高约 14 倍。简单说,智谱不仅卖出了更多 Token,每单位算力能换回的收入也比一年前高得多。

08-27 03:40重要

智谱旗舰模型GLM 5.3将于8月28日上午10点开源

动察 Beating AI 快讯,智谱旗舰模型 GLM-5.3 将在北京时间 8 月 28 日上午 10 点开源。 GLM-5.3 其实早在 8 月 14 日就已上线 Coding Plan,随后开放 API。明天模型权重终于下载,这次晚了整整两周,原因有点特殊。智谱称,GLM-5.3 在后训练过程中,网络安全能力增长速度「超出预期」,不仅更会找漏洞,还开始学会跨多个步骤规划完整的漏洞利用链。官方因此先做安全评估和加固,再开放权重。 官方评测中,GLM-5.3 在漏洞发现测试 CyberGym 拿到 84.5%,略高于 Mythos 5 的 83.8% 和 GPT-5.6 Sol 的 83.6%。更偏攻击利用的 ExploitBench 则从 GLM-5.2 的 24.4% 翻到 54.4%,不过仍明显落后 Mythos 5 的 78.0%。智谱还称,模型已在 269 个开源项目中发现 2436 个漏洞,其中 1097 个属于严重或高危级别。 GLM-5.3 沿用 GLM-5.2 的同一基础模型,这些提升全部来自后训练。

08-26 07:24

DeepSeek API毛利率高达82.9%,公司整体毛利率达44.6%

动察 Beating AI 快讯,据 The Information 报道,DeepSeek 正寻求以约 5000 亿元人民币估值进行第二轮融资,计划再融资 500 亿元人民币。数据显示,2026 年 1 月至 7 月,DeepSeek 营收达到 4.75 亿元人民币(约 7070 万美元),约为其 2025 年全年营收的 10 倍;同期净亏损收窄至 7.15 亿元人民币,低于 2025 年全年的 9.35 亿元人民币。 盈利能力方面,DeepSeek 整体毛利率达 44.6%,其中 API 业务毛利率高达 82.9%,主要得益于 AI 基础设施优化,使其能够以更少芯片运行模型并维持较低推理成本。随着 V4 系列,尤其是 V4-Flash 获得全球开发者广泛采用,公司营收增长加速,上月年化营收据称已达到 4 亿至 5 亿美元。 此外,DeepSeek 近期上调 API 价格以强化商业化,V4-Pro 高峰期输出价格从 0.87 美元升至 3.96 美元,非高峰期为 1.98 美元,但仍低于 Kimi K3 的 15 美元和 Claude Opus 5 的 25 美元。与此同时,公司 AI 基础设施投入从 2025 年的 12 亿元人民币大幅增至今年前 7 个月的 110 亿元人民币,主要用于服务器租赁及 AI 芯片、算力设备采购。 DeepSeek 此前今年 6 月完成首轮外部融资,融资规模约 500 亿元人民币,目前已聘请投行筹备明年在上海 IPO。