腾讯混元Hy Image3.5 preview上线:最多20张参考图、4K直出
相关推荐
Grok视频Agent升到1.5:接入Image 2.0,多镜头连续性升级
动察 Beating AI 快讯,Grok Imagine 的视频创作 Agent 升级到 1.5 版。 这次容易和 6 月发布的 Grok Imagine Video 1.5 搞混。当时更新的是底层视频模型,现在更新的是 Agent 层。Grok Imagine Video 1.5 已于 6 月正式上线。 新版接入最新的 Image 2.0,重点提升生成质量、叙事和多镜头连续性。Grok 称,它更擅长把多个镜头连起来,让前后画面更连贯。目前已经上线 Grok 网页、iOS 和 Android。 Arena 的 Text-to-Video 榜单里,grok-imagine-video-1.5-agent 暂列第 5,得分 1491,高于 Seedance 2.5、Seedance 2.0 和 MiniMax H3。不过目前成绩仍是 Preliminary,排名还可能变化。
腾讯发布WorldClaw:Agent开始自己搭3D世界
据动察 Beating 监测,腾讯混元发布 WorldClaw,可以让 Agent 自动规划并搭建 3D 世界。用户只要描述想要的场景,它就会先规划地形和区域,再生成建筑、植物、人物等内容,最后在 Blender 里把场景组装起来。 WorldClaw 还会自己检查结果。物体悬空、穿模、比例不对,它会继续调整,再重新渲染检查。 生成后的场景可以继续编辑。地形、建筑和植物都是独立的 3D 对象,可以移动、删除和修改,也能接入游戏、动画和后续渲染流程。 目前 WorldClaw 用 Claude Opus 4.8 负责规划、调度和检查,再调用 GPT-Image-2、SAM3、SAM3D、Hunyuan3D 和 Blender 完成具体任务。
kKimi K2.8 Preview 正式登陆 B.AI,API 与 Web Chat 双端同步开放
ChainCatcher 消息,B.AI 平台宣布 Moonshot AI 最新预览模型 Kimi K2.8 Preview 正式上线,面向开发者同步开放 API 与 Web Chat 双端体验。 该模型专为编程与 Agent 工作流打造,支持 1M(1,048,576 Token)超长上下文及文本、图片、视频多模态输入,综合性能直逼旗舰 Kimi K3,较 K2.7 Code 在思考效率与代码能力上进一步提升,并支持 Low/High/Max 三档灵活可调推理强度。 即日起,开发者可通过 B.AI 平台直接调用 Kimi K2.8 Preview。
Jev团队公开Coding Agent设计草案:每轮重新决定模型该看什么
动察 Beating AI 快讯,TypeSafe 创始人 Diogo Almeida 公开了一份 Coding Agent 设计草案,希望社区直接拿去实验。他直说团队大概率没时间自己把这些想法都做出来。 这份草案最核心的改动是上下文。现在的 Coding Agent 通常会一直带着之前的聊天、工具结果和代码状态,太长了再压缩或重启。TypeSafe 想让 Agent 每轮重新判断:继续沿用现有缓存,还是重新挑一份更合适的上下文;哪些保留全文,哪些只留摘要,哪些直接丢掉。 Almeida 认为,现有 Agent 不少设计都被 KV Cache 反过来绑住了。比如任务先切给便宜模型,再切回强模型,强模型可能还得重新读一遍长上下文,最后反而更贵;工具定义长期塞在系统提示词里,也会一直占空间。 上下文如果能动态重组,模型路由、Sub-agent、MCP 和 AGENTS.md 也能跟着按需加载。简单任务交给便宜模型,需要哪个工具再加载哪个,子 Agent 只拿和自己任务相关的状态。Almeida 暂时把这套思路叫「Meta-attention」。
剪映开始全面Agent化:AI助手负责剪片,创作Hub接管整条生产线
动察 Beating AI 快讯,剪映在 AI 新创作发布会上继续押注 Agent,一口气推出升级版「剪映 AI 助手」和「创作 Hub」。前者直接负责剪视频,后者把灵感、创作到发布串成一套完整流程。 剪映 AI 助手已经能用自然语言完成 Agent 智能剪辑、批量混剪、视频扩写、模板替换,还能直接调用 Seedance 2.5。用户说自己想怎么改,Agent 再调用剪映里的工具完成具体操作。 创作 Hub 管得更宽。它想把一条视频从灵感到成片再到发布的流程放到同一个地方,还支持自定义 Skill,把经常重复的创作方法沉淀下来反复调用。 自然语言剪视频不是新功能,剪映此前已经上线 AI 助手。现在它开始往下一步走,把反复使用的剪辑流程做成 Skill,用户不用每次重新教一遍。
阶跃新旗舰基座模型Step 5 Preview发布 跻身全球权威榜单开源前三
火星财经消息,阶跃星辰发布新一代旗舰基座模型Step 5 Preview,重点面向AI编程、软件工程、专业知识工作、金融等场景,提升模型在真实世界Agentic任务中的综合表现,在能力、成本、效率和场景覆盖之间实现良好平衡,进一步拓展智能与成本之间的最优边界。在全球权威榜单Artificial Analysis Intelligence Index(AA 综合智能指数)中,阶跃 Step 5 Preview 跻身全球开源前三。值得关注的是,该模型单任务成本仅为Claude Opus 5 的1/8。据了解,阶跃将于10月15日正式开源 Step 5 Preview。 (科创板日报记者 黄心怡)