返回 7*24 快讯
来源MarsBit

国家超算互联网上线Kimi K3 API服务,3万亿参数大模型一键调用

火星财经消息 7月21日,国家超算互联网近日上线Kimi K3模型API调用服务,企业与开发者无需繁琐环境配置,即可快速调用这一2.8万亿参数开源大模型能力。目前,该API兼容OpenAI与Anthropic接口规范,支持快速、低成本搭建多元化AI应用。当前,超算互联网模型API服务已汇聚MiniMax、DeepSeek、Qwen、GLM、Kimi等开源大模型,涵盖文本生成、图片生成、视频生成、语音合成、多模态等全维度AI能力。(广角观察)
免责声明:以上内容仅为作者观点,不代表 711BTC 的任何立场,不构成与 711BTC 相关的任何投资建议。

相关推荐

08-13 19:45

Harbor Capital推出5只AI生态主题ETF,覆盖OpenAI、Anthropic等

Odaily星球日报讯 彭博 ETF 分析师 James Seyffart 表示,资产管理公司 Harbor Capital 今日推出 5 只主动管理型 ETF,分别聚焦人工智能领域不同公司的“生态系统”投资机会,这 5 只 ETF 分别为:ANTW:聚焦 Anthropic 生态公司;DEPW:聚焦 Google DeepMind 生态公司;MTAW:聚焦 Meta AI 生态公司;OAIW:聚焦 OpenAI 生态公司;XAIW:聚焦 xAI 生态公司。 Seyffart 表示,这些 ETF 将围绕 Anthropic、Google DeepMind、Meta、OpenAI 以及 xAI 等 AI 企业构建投资组合,通过投资与相关企业供应链、合作伙伴及生态体系相关的公司,捕捉 AI 产业扩张机会。

08-03 17:54

值得买科技OpenHubs首批上线Qwen3.8-Max

火星财经消息 8月3日,阿里云正式发布Qwen3.8-Max大模型,值得买科技一站式大模型服务平台OpenHubs同步上线Qwen3.8-Max。OpenHubs平台通过统一账号体系、标准化API接口和集中化管理能力,实现主流大模型的统一接入、调用、监控、统计与账单管理。据了解,此前OpenHubs已率先上线月之暗面最新旗舰模型Kimi K3,并已汇聚Qwen、Kimi、DeepSeek、智谱GLM、MiniMax、豆包Seed等主流大模型。(广角观察)

08-12 21:46

Lightspeed 拟通过约 6 亿美元二级交易延长持有 OpenAI 等资产,并加码 Anthropic

火星财经消息,据彭博社援引知情人士报道,Lightspeed Venture Partners 正寻求通过一项约 6 亿美元的二级交易,延长对 OpenAI 及另外四项资产的持有期限,并新增对 Anthropic 的投资承诺。该交易内部代号为 “Project Mercury”,涉及 Lightspeed 旗下 Select V、Opportunity II 两只基金及一个独立管理账户,将相关投资转入延续基金,同时向现有投资者返还现金。除 OpenAI 外,拟转入资产还包括安全科技公司 Verkada、劳动力管理公司 Rippling、AI 初创公司 Reflection AI 及企业搜索平台 Glean。Coller Capital 担任延续基金牵头买方,瑞银担任交易顾问。Lightspeed 曾多轮投资 Anthropic,包括其最新一轮融资;该轮融资对 Anthropic 的估值为 9650 亿美元。

08-10 12:17

DeepSeek、Kimi都在拼命砍缓存,英伟达开始让缓存跨模型复用

据动察 Beating 监测,过去两年,大模型推理优化一直在拿 KV Cache 开刀。它是模型读完上下文后留下的中间计算结果,内容越长,越吃显存和带宽。DeepSeek-V2 借助 MLA,相比 DeepSeek 67B 将 KV Cache 减少 93.3%;Kimi Linear 相比全 MLA 又最多减少 75%。大家都在让长上下文更便宜。 但这些方案都有一道墙:缓存通常只能在同一个模型内部复用。Agent 从小模型切到大模型后,目标模型还得把前面几万甚至几十万 Token 重新计算一遍。模型路由越频繁,这笔重复计算越难忽略。 英伟达最新论文开始拆这堵墙。团队发现,在同一家族、KV 结构匹配的不同大小模型之间,缓存存在明显的线性关系。用 500 段、每段 1024 Token 的文本校准一次,就能拟合出一套映射,把一个模型算好的 KV Cache 转给另一个模型继续用。 Qwen3-14B 切到 32B 时,32K 上下文重新计算约需 7 秒,转换缓存只要约 0.28 秒,快约 25 倍。换句话说,以后甚至可以先让小模型负责「读」:把长上下文算成 KV Cache;真正需要更强能力时,再把缓存转给大模型,让大模型直接开始「想」和生成。 这会让模型路由省下更多算力。现在让简单任务跑小模型,主要省的是生成成本;一旦切到大模型,长上下文往往还得由大模型重新算一遍。跨模型 KV Cache 如果做成熟,连这部分 prefill 都能交给小模型完成。Agent 可以长期用便宜模型维护上下文,碰到难题才叫醒大模型,而且不用每次都从头「读档」。

08-04 13:58

DeepSeek API出现性能下降情况,现已恢复

8月4日,海外开源AI Coding Agent平台OpenCode发文称:DeepSeek V4 Flash当前因前所未有的访问量而出现容量不足问题,可能会遇到报错,正在紧急修复中。也有网友发文表示:DeepSeek V4 Flash官方API上午几乎不可用,和Kimi K3刚发布时情况差不多,国产模型能力赶上来了,但可用性与容量仍有改善空间。DeepSeek官方披露,今日上午DeepSeek V4 Flash API出现性能下降情况,目前问题已解决,服务已恢复。(一财)

08-14 08:58

OpenAI把GPT-5.6 Sol提速14倍:750 token/s先上API

据动察 Beating 监测,OpenAI 开始预览 GPT-5.6 Sol 的 Ultrafast 模式。它由 Cerebras 提供算力,最高输出速度达到 750 token/s,最高是 Standard 模式的 14 倍。目前只向少量 API 客户开放。 OpenAI 已在故障排查、研究、客服、金融分析和开发 Agent 等场景中测试 Ultrafast。对于需要连续多次调用模型的 Agent,单次响应提速也能直接缩短整个任务的执行时间。 这比 OpenAI 7 月底推出的 Fast 模式又快了一档。Fast 模式最高是 Standard 的 2.5 倍,Ultrafast 则把上限推到 14 倍。OpenAI 暂未公布 Ultrafast 的价格,也没有宣布何时进入 ChatGPT。