返回 7*24 快讯
来源ChainCatcher

B.AI 宣布 DeepSeek-V4.1-Flash 多模态模型上线

ChainCatcher 消息,B.AI 平台宣布 DeepSeek 原生多模态 MoE 大模型 DeepSeek-V4.1-Flash 正式上线。该模型采用 5520 亿参数主干与 Causal Encoder-Decoder 架构,输入与输出采用非对称计算规模。模型支持 100 万 Token 上下文与 384K Output,面向长周期编程 Agent、多模态工作流与高并发 Agent 系统。目前 Web Chat 与 API 双端接入均已开放。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

09-01 07:37

FreeToken开源:一张5090跑DeepSeek-V4-Flash,最高25 Token/s

动察 Beating AI 快讯,伯克利、MIT 等研究者开源 FreeToken。这是一个专门为本地设备设计的 MoE(混合专家模型)推理引擎,主要解决超大模型显存装不下的问题。它会把部分权重放在系统内存,并让 CPU 和 GPU 一起参与推理。 FreeToken 会把模型的大量专家权重放在系统内存,只把一部分缓存在显存。遇到显存里没有的专家时,它会根据 PCIe 和 CPU 内存带宽,动态决定是把权重搬到 GPU,还是直接交给 CPU 计算。这样 CPU、GPU、系统内存和 PCIe 可以一起参与推理。 论文实测,一台配备 RTX 5090 的游戏台式机运行 284B 参数的 DeepSeek-V4-Flash,可以达到 22–25 Token/s。这款模型每生成一个 Token 实际只激活约 13B 参数,因此特别适合这种 CPU、GPU 混合推理。 FreeToken 还在 8GB 显存的 RTX 4060 笔记本上把 35B 模型跑到 39.3 Token/s;单张 96GB RTX PRO 6000 则可以运行 753B 参数的 GLM-5.2,速度达到 llama.cpp 的约两倍。项目目前支持超过 20 款 MoE 模型,并已采用 Apache 2.0 许可证开源。

08-18 14:49重要

B.AI 平台免费开放 DeepSeek V4 Flash,Token 吞吐量突破 769 亿

ChainCatcher 消息,B.AI 平台自开放 DeepSeek V4 Flash 免费访问以来,最新 24 小时数据出炉:Token 吞吐量突破 769 亿,累计新增注册用户达 206 万,单日新注册峰值录得 5468 人。B.AI 平台凭借稳定高并发基础设施,开发者可零成本调用顶级 LLM 聚合服务,支撑生产级 AI 工作流。 目前,网页聊天与 API 接口已同步解锁,开发者即日起即可零门槛接入,开启从原型验证到大规模部署的全链路 AI 开发体验。B.AI 正以“免费+高性能”的组合拳,加速重构大模型服务市场格局。

08-21 03:45

DeepSeek Flash 涨价后流量腰斩,留下近 10 万亿 Token 日缺口

火星财经消息,OpenCode CEO Jay V 表示,DeepSeek V4 Flash 自 8 月 1 日上线后,在 OpenCode 上的日 Token 消耗量从约 3 万亿飙升至 18 万亿,两周内增长 6 倍,接近 OpenRouter 全平台日处理量。其定价约为 Fable 的 1/350、GPT-5.6 Sol 的 1/175、Claude Sonnet 的 1/70,被用户视为“便宜到无需计量的 AI”。8 月 16 日 DeepSeek 将高峰时段价格上调 5 倍(非高峰时段 2.5 倍)后,模型日 Token 消耗量从峰值回落超过 50%。Jay V 认为涨价系应对 GPU 成本上升的被动之举。目前 OpenCode 正寻找能以原价承接流量的供应商,约需 1000 块 B300 才能支撑当前需求。DeepSeek Flash 暴露了 AI 模型市场的“不可能三角”——便宜、强大、大规模稳定供应难以兼得。涨价后,OpenCode Go 已将配额从 60 美元降至 15 美元后又恢复至 30 美元,并引入峰谷费率机制。

08-03 08:36

DeepSeek V4Flash在OpenCode爆量:单日跑掉8万亿Token

据动察 Beating 监测,AI 编程工具 OpenCode 披露,接入 DeepSeek V4 Flash 当天,OpenCode 用户跑了 8 万亿个 Token,其中 5 万亿来自免费计划,3 万亿来自付费订阅 OpenCode Go。 过去一周,它已占 OpenCode 全部 Token 用量的 55%,排名第一。

08-23 14:42重要

DeepSeek-V4-Flash-Vision-Exp 登陆 B.AI,全量免费开放

ChainCatcher 消息,B.AI 平台上线 DeepSeek 全新多模态实验旗舰模型 DeepSeek-V4-Flash-Vision-Exp,目前 API 官方组已率先完成全量接入并面向所有用户免费开放。 该模型在延续 V4-Flash 顶尖纯文本与代码 Agent 能力的基础上,正式解锁原生图像理解能力,多模态 Agent 综合表现已接近 Claude Opus-4.8 旗舰水平。 新模型支持图文混合输入与 1M 超长上下文,可轻松驾驭多模态 PPT 生成、复杂 UI 重构及前端特效等硬核场景,图片输入按 token 计费,单张图片最高仅 384 tokens。现所有用户登录 B.AI 平台即可零门槛免费调用这一最新多模态模型能力,让顶尖算力为创意与生产力加速落地。

08-21 12:26重要

DeepSeek-V4-Flash 免费活动持续升温,B.AI 累计吞吐突破 6415 亿

ChainCatcher 消息,B.AI 平台 DeepSeek-V4-Flash 零门槛免费畅用活动持续升温,全平台累计 Token 吞吐量已突破 6,415.24 亿,其中 8月 20 日单日最高吞吐达 2,859.63 亿 Token,较活动首日激增近 4 倍,连续刷新历史纪录。 这组数据的背后,不仅是平台高并发处理能力的硬核验证,更折射出 AI 普惠需求的真实爆发。B.AI 将持续降低 AI 使用成本,为开发者与 Web3 用户提供低门槛、不限量的 Agentic 应用构建与体验环境,让顶尖算力真正触手可及。