返回 7*24 快讯
来源PANews

Gonka 上线 DeepSeek v4 Flash,全网等效算力接近2000张 H100

PANews 8月17日消息,去中心化 AI 算力网络 Gonka 正式上线 DeepSeek v4 Flash 0731,目前支持该模型、Kimi-K2.6 和 MiniMax M2.7。Gonka 通过聚合全球GPU资源,提供 OpenAI 和 Anthropic 兼容的模型调用服务,现全网等效算力接近2000张 H100。过去24小时处理196亿个 AI Token,其中 DeepSeek 超过120亿,占比逾六成。用户可通过社区 Broker 接入,目前 https://gonkarouter.io/ 提供20美金免费 Credits,近乎零成本使用主流AI模型。
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

07-31 14:03

DeepSeek:DeepSeek-V4-Flash正式版API上线公测,DeepSeek-V4-Pro正式版将会尽快发布

PANews 7月31日消息,DeepSeek发布更新日志,DeepSeek-V4-Flash 正式版 API 上线公测。DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练。DeepSeek-V4-Pro 正式版将会尽快发布。

08-17 16:36

B.AI 宣布 DeepSeek-V4-Flash 限时全免费开放,叠加多重福利激励生态

ChainCatcher 消息,B.AI 平台正式宣布,DeepSeek-V4-Flash 模型已在 Web Chat 与 API 双端同步开启限时免费、无限制畅用服务,开发者及普通用户均可零成本调用顶级算力。与此同时,平台加码推出多重福利:新用户通过 Binance Wallet、BitgetWallet 或 imToken 登录,可领取 100 万 Credits,填写邀请码额外再得 30 万,累计最高享 130 万免费额度;充值还可获最高 $100 积分返赠,邀请好友注册更能长期享有返利权益。B.AI 未来将持续释放优惠红利,降低 AI 应用创新门槛。

08-16 22:20重要

B.AI 宣布 DeepSeek-V4-Flash 将于 8 月 17 日全量免费开放

ChainCatcher 消息,距离 DeepSeek-V4-Flash 于 8 月 17 日在 B.AI 平台全量免费开放仅剩最后 1 天。届时 Web 端与 API 将同步上线,用户可免费畅享代码运行、复杂 Agent 任务及长文本处理等全场景体验。 为助力开发者无惧成本使用 DeepSeek,B.AI 同步推出三重福利:新用户通过 Binance Wallet、Bitget Wallet 或 imToken 钱包登录,即可领取 100 万免费 Credits;填写邀请码可再叠加 30 万,累计最高达 130 万;新老用户充值均可享受最高 100 美元的额外 Bonus Credits。 需注意,账户须保留少量 Credits 用于身份验证,请提前准备。具体开放时间将于近期公布,敬请锁定 B.AI 官方动态。

08-13 15:14

「韩模之光」Solar Pro4智能指数冲到42分,但还是打不过DeepSeek V4Flash

据动察 Beating 监测,韩国 AI 公司 Upstage 发布旗舰推理模型 Solar Pro 4。Artificial Analysis 最新评测中,它的智能指数从上一代 Solar Pro 3 的 14 分冲到 42 分,主要提升来自 Agent 和长上下文能力。 其中 Terminal-Bench v2.1 从 12% 升到 57%,长上下文推理从 31 升到 71。GDPval-AA v2 也从 498 Elo 升到 1277,超过 1000 的人类基线。Solar Pro 4 已经是韩国模型冲击全球前列的一张代表牌。 但放到 DeepSeek V4 Flash 0731 面前,还是不够看。同一套 Artificial Analysis 智能指数里,DeepSeek 拿到 52 分,比 Solar Pro 4 高 10 分。DeepSeek 每秒输出约 122 个 Token,Solar Pro 4 约 65 个,前者接近快一倍。 价格差距更大。Solar Pro 4 每百万 Token 输入、输出分别要 0.30 和 1.20 美元,DeepSeek 只要 0.14 和 0.28 美元。Solar 的输出价格超过 DeepSeek 的 4 倍。 至少按这套综合评测和 API 性价比,「韩模之光」还没追上 DeepSeek。

08-10 12:17

DeepSeek、Kimi都在拼命砍缓存,英伟达开始让缓存跨模型复用

据动察 Beating 监测,过去两年,大模型推理优化一直在拿 KV Cache 开刀。它是模型读完上下文后留下的中间计算结果,内容越长,越吃显存和带宽。DeepSeek-V2 借助 MLA,相比 DeepSeek 67B 将 KV Cache 减少 93.3%;Kimi Linear 相比全 MLA 又最多减少 75%。大家都在让长上下文更便宜。 但这些方案都有一道墙:缓存通常只能在同一个模型内部复用。Agent 从小模型切到大模型后,目标模型还得把前面几万甚至几十万 Token 重新计算一遍。模型路由越频繁,这笔重复计算越难忽略。 英伟达最新论文开始拆这堵墙。团队发现,在同一家族、KV 结构匹配的不同大小模型之间,缓存存在明显的线性关系。用 500 段、每段 1024 Token 的文本校准一次,就能拟合出一套映射,把一个模型算好的 KV Cache 转给另一个模型继续用。 Qwen3-14B 切到 32B 时,32K 上下文重新计算约需 7 秒,转换缓存只要约 0.28 秒,快约 25 倍。换句话说,以后甚至可以先让小模型负责「读」:把长上下文算成 KV Cache;真正需要更强能力时,再把缓存转给大模型,让大模型直接开始「想」和生成。 这会让模型路由省下更多算力。现在让简单任务跑小模型,主要省的是生成成本;一旦切到大模型,长上下文往往还得由大模型重新算一遍。跨模型 KV Cache 如果做成熟,连这部分 prefill 都能交给小模型完成。Agent 可以长期用便宜模型维护上下文,碰到难题才叫醒大模型,而且不用每次都从头「读档」。

08-10 10:33

中国AI大模型调用量连续十五周领跑:环比增长570% DeepSeek-V4-Flash正式版登顶

火星财经消息,根据OpenRouter最新数据测算,上周(8月3日至8月9日)全球AI大模型总调用量为69万亿Token,环比增长21.48%。其中,上榜的AI大模型中,中国AI大模型周调用量达34.25万亿Token,环比增长21.76%;同期美国AI大模型周调用量为9.17万亿Token,环比增长109.36%。中国大模型周调用量连续十五周超过美国,稳居全球首位。记者注意到,上周,全球调用量排名前四均为中国AI大模型。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第一,周调用量达8.83万亿Token,环比增长570%;腾讯Hy3位居第二,周调用量达8.05万亿Token,环比增长67%;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)排名第三,周调用量达5.88万亿Token,环比下滑19%。 (每日经济新闻)