加密货币价格波动剧烈,本站内容仅供参考,不构成投资建议。投资有风险,可能导致全部损失。

查看完整免责声明
返回 7*24 快讯
来源MarsBit

观点:AI 应用层不应按 Token 定价,应锚定“可识别的工作价值”

火星财经消息,a16z 合伙人 Sarah Wang 近日发文指出,AI 应用层产品不应模仿模型层按 Token 定价,而应定价在“可识别的工作单元”上。文章认为,Token 定价将应用产品价值锚定在一个成本持续下降的单元上,客户难以预测上下文长度、检索量或推理时间,且会将应用与原始算力进行不恰当比较。文章建议按价值层级分层定价:模型层按 Token 定价;应用层按客户可识别的工作单元定价(如账户调研简报、代码修改、已完成查询),可通过 Credits 封装;可归因且价值清晰的场景直接按结果定价(如已解决的客服对话、合格线索)。Credits 设计应映射不同难度的工作,以保护毛利率并区分“工作价值”与“交付成本”。文中以 Clay 为例,其新定价将 Data Credits(第三方数据)与 Actions(编排工作)分离,对成本波动较大的推理模型仅做成本传导而不加价。作者认为定价锚定价值而非算力成本,既能让客户理解花费与价值,也有利于产品方守住利润空间。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-27 09:21

TokenPocket 旗下 Transit Finance 深度接入 RootData 数据并升级代币信息页

ChainCatcher 消息,TokenPocket 旗下跨链聚合交易产品 Transit Finance 宣布升级代币信息页,并深度接入 Web3 数据平台 RootData 的项目与代币数据。用户可在交易前于同一页面核验交易数据、流动性、安全风险、持仓结构及项目背景。据悉,此次接入的 RootData 数据覆盖项目详细介绍、融资信息、新闻报道、日历事件等超过 20 项字段,用于充实 Transit 代币信息页中的项目画像与动态信息,为用户交易决策提供结构化数据支持。目前,RootData 累计的合作伙伴数量已经超过 245 家。

09-17 03:39

Meta给Muse上裂变拉新:邀1人送10亿Token,最多拿200亿

动察 Beating AI 快讯,Meta 的个人 AI Agent Muse 上线邀请码。Alexandr Wang 宣布,朋友注册时使用你的邀请码,双方各得 10 亿 Muse Token,最多可以邀请 20 人。拉满后,邀请者还能提前体验电话等新功能。 这个奖励相当大。Muse 免费版目前每周提供 1 亿 Token,成功邀请 1 人拿到的奖励,数量上等于 10 周免费额度;拉满 20 人就是 200 亿 Token,相当于 200 周的基础免费额度。 Muse 上周刚在美国上线,可以自己浏览网页、连接 App,并代用户发邮件、购物和订行程。上线后一直稳居美国 App Store 总榜前几名。Meta 现在直接用大额 Token 奖励,把首批用户变成拉新渠道。

09-02 08:18重要

AI Token 价格创历史新低,较 5 月高点腰斩

火星财经消息,据韩联社报道,美国市场信息机构 Silicon Data 发布的 LLM Token 支出指数(LLM Token Expenditure Index)于 8 月 31 日跌至每百万 Token 97 美分,创下该指数自去年底成立以来的历史最低值,较 5 月高点(2.05 美元)下跌逾 50%。分析认为,中国 AI 企业月之暗面推出的开源模型 “Kimi K3”、OpenAI 于 7 月下调 ChatGPT-5.6 系列模型定价,以及头部厂商推行动态定价机制,共同构成此轮价格下行的主要驱动因素。Token 价格下跌虽有助于降低用户使用成本,但对 OpenAI、Anthropic、Google 等模型开发商而言将形成营收压力。投资机构 Seez Group 投资负责人指出,基础模型企业受冲击最为直接,建议转向强化分发渠道、内存及上下文能力,以提升用户迁移成本,应对开源模型的竞争侵蚀。

08-13 16:16重要

Databricks完成50亿美元战略融资,Coatue领投,黑石、MGX和T.Rowe Price参投

BlockBeats 消息,8 月 14 日,AI 数据平台 Databricks 宣布以 1900 亿美元投后估值完成 50 亿美元战略融资,此前 7 月 16 日公布的条款清单估值为 1880 亿美元,最终金额因融资规模扩大和额外股份发行而提高。本轮由老股东 Coatue 领投,黑石、MGX 和 T. Rowe Price 参投,Sixth Street Growth 作为新投资者加入。公司收入运行率已突破 70 亿美元,同比增长超 80%。联合创始人兼 CEO Ali Ghodsi 表示,按照 2022 年前行业使用的定义,AGI 已经到来——真正的瓶颈已转移至企业上下文、AI token 成本和 Agent 基础设施。 新增资金将投向三个核心方向:Unity AI Gateway(跨模型路由与支出控制)、Lakebase(无服务器 Postgres 数据库,收入运行率已破 1 亿美元)以及 Genie(为 AI 提供企业上下文的访问能力)。Ghodsi 还透露公司在 Anthropic 或 OpenAI 之前 IPO 的可能性「非常低」,此前他曾多次否认夏季融资传闻,最终决定融资是基于扩张 AI 业务的成本及加大招聘与并购投入的考量。

09-19 08:22

DFlash团队进军Mac,27B模型跑到144Token/s

动察 Beating AI 快讯,Inco AI 开源本地推理引擎 Splash,把 Qwen3.8-27B 在 M5 Max MacBook Pro 上跑到了最高 144 Token/s。LM Studio 随即接入,0.4.25 版本已经可以直接使用。 Inco 此前做出的 DFlash 已经进入 SGLang、vLLM、TensorRT-LLM 和 llama.cpp。Meta、NVIDIA、小米、Poolside 等也给自家模型配了 DFlash 加速小模型。DFlash 会先让小模型并行猜出多个 Token,再交给大模型批量验证,减少逐 Token 生成的计算。 Splash 把这种优化扩到了整个本地推理引擎。它目前只支持 Qwen3.8-27B 和 Qwen3.6-35B-A3B,每个模型都单独配了 GPU kernel、内存方案和 DFlash 2 小模型。覆盖的模型少,但换来了更激进的性能优化。 144 Token/s 是 M5 Max 上的最高演示值。换到 Inco 用来做横向测试的 48GB M5 Pro,Qwen3.8-27B 单路短上下文达到 74 Token/s;4 路并发时总吞吐达到 170 Token/s,是第二名的 3.9 倍。这也是 Splash 更适合 Agent 场景的地方。一个 Agent 同时拉起多个子任务时,并发总吞吐往往比单条对话速度更重要。 Splash 本身开源,不绑定 LM Studio。目前需要 M3 或更新的 Mac、macOS 26.4 以上、至少 36GB 统一内存。

09-19 03:00重要

RootData:ALT 将于一周后解锁价值约 176 万美元的代币

ChainCatcher 消息,据Web3资产数据平台 RootData 代币解锁数据,AltLayer(ALT)将于北京时间 09 月 26 日 8 时解锁约 24659 万枚代币,价值约 176 万美元。