Runway做了个App世界模型:不用代码,直接生成整个界面
相关推荐
Oracle推出Fusion Agentic Applications与AI智能体
Odaily星球日报讯 Oracle 宣布推出面向人力资源领域的全新 Oracle Fusion Agentic Applications 和 AI 智能体,旨在帮助企业加速员工发展、优化人才决策,并更快响应不断变化的业务和技能需求。 Oracle 表示,新一代 Fusion Agentic Applications 由多个专业化 AI 智能体协同驱动,具备目标导向、自主推理和企业级执行能力,可通过安全访问企业统一数据、工作流、政策、权限体系及业务上下文,在 HR 流程中辅助企业制定并执行决策。 此次发布的 AI 能力基于 Oracle Cloud Infrastructure(OCI) 构建,并深度集成至 Oracle Fusion Cloud HCM 平台,覆盖岗位架构、学习发展、管理者辅导、员工成长、内部流动以及 workforce planning(劳动力规划)等多个领域。
Sahara AI 推出 ClawApp 2.0,将本地常驻 AI Agent 堆栈集成于一体
PANews 8月11日消息,Sahara AI 团队发布原生 Mac 应用 ClawApp 2.0,可在单一应用中集成模型、指令、技能、工具、MCP 服务器、权限与调度配置。用户可在应用内构建自定义 Agent,限定其可访问的资源范围后常驻运行。Sahara AI 称,按新版本提供的引导流程,用户大约在数分钟内即可完成首个 Agent 的搭建。
开源Agent BitFun:一句话把任务变成桌面小应用
动察 Beating AI 快讯,BitFun 是一个开源桌面 AI Agent。用户可以直接让它改代码、查资料、写文档,也能操作浏览器、终端和桌面软件完成任务。 它比较特别的是 Mini Apps。你给它一个任务,它可以直接生成对应的图表、看板、表单或控制面板。之后继续对话时,Agent 会读取这个小应用当前的状态,不用每次重新解释进度和上下文。 BitFun 支持 Windows、macOS 和 Linux,也不绑定固定模型。用户可以自己接入模型 API,还能扩展 MCP、Skills、Hooks 和自定义 Agent。
Meta个人Agent上线前翻车:没同意就发邮件、改密码
动察 Beating AI 快讯,Meta 正在给即将上线的个人 AI Agent Hatch 补安全护栏。员工测试早期版本时多次发现它越权操作。Hatch 曾未经允许发邮件、修改账号密码。还有员工让它订酒店,它却没完成预订,反而擅自把 Chase 的通用积分转成了 Hyatt 酒店积分。 Hatch 的权限比普通聊天机器人高得多。它有自己的电脑,可以浏览网页、填表、购物和做深度研究,还能直接连接邮箱、日历等服务。App 关闭后,它也可以继续在后台干活。 安全测试还暴露过凭证泄露。Signal 创始人 Moxie Marlinspike 给 Hatch 接入一个专用 Gmail,再从另一个邮箱发信询问它使用的密码,Hatch 直接把密码回复了出去。另一次测试中,它还把员工带到诈骗网站下单。 Meta 后来把关键限制放到了模型外。现在 Hatch 要联网、使用浏览器、发邮件等敏感操作时,会触发「hard gate」,强制暂停并让用户批准,Agent 自己无法绕过。密码重置链接和双重验证码也不会直接交给它,而是放进单独的「凭证库」,需要额外授权才能读取。
Cursor云Agent终于有真Mac了:每个会话都能拉起一台M5
动察 Beating AI 快讯,Cursor 给 Cloud Agents 接上了 Namespace Devboxes。现在运行 Agent 时,可以直接选择 macOS 环境。Namespace 会为每个会话临时拉起一台 Apple M5 Mac,让 Agent 在真正的 macOS 上改代码、编译和跑测试。 这解决了 Cloud Agent 很实际的一个限制。Cursor 默认的云端开发环境一直是 Ubuntu。写 Web、后端问题不大,但碰到 iOS 和 macOS 原生开发,Linux 根本做不了完整构建。此前 Cursor 社区已经有人专门追问,Cloud Agent 什么时候才能跑 Mac。 这次也不是在 Linux 上套一层 Mac 兼容。Cursor 仍负责模型推理和任务规划,真正的 shell 命令、文件修改、Git 操作、编译和测试全部交给 Namespace 的 macOS DevBox。任务结束后,这台 DevBox 会被销毁。
谷歌给Gemini加视频Agent:成本最高降66%
动察 Beating AI 快讯,谷歌给 Gemini API 上线 Agentic Video Understanding。它让模型自己决定看哪段视频、怎么检查。普通模式默认按 1 FPS 固定抽帧,再一次性放进上下文。新模式会自己沿时间轴找片段,并按问题选择画面、音频或转录文本。碰到快速动作,还能提高帧率重新检查。 Google 自测称,Gemini 3.7 Flash 开启后,Token 消耗最高下降 88%,分析成本最高下降 66%,准确率相对提升最高约 7%。它能定位不到 1 秒的瞬间,也能在几小时的视频里找一个细节。 技术上是把开发者以前要自己搭的「先定位、再精看」流程塞进 Gemini 内部。现在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 都支持。上传视频和 YouTube 视频都能用,也不另收功能费。之后还会接入 Gemini App 和 YouTube 的 Ask YouTube。