跳到正文

#Agent

今日 3 条
今天10月4日周日
10月3日周六
  1. The Verge · AI60

    Meta 开源代码,让用户自制 Muse AI 硬件设备

    Meta 开源了相关代码,让用户自己动手制作搭载其新 AI 智能体 Muse 的硬件设备。Meta 建议的项目包括把 Muse 装到彩色 E Ink 屏上显示提醒、装到 HDMI 棒上在大屏显示,或装到小型触屏设备上做成类似 DIY Muse Charm 的装置,用户可用现成 ESP32 板或树莓派配合其 SDK 连接显示器、按钮和传感器。

  2. The Verge · AI60

    Apple 将限制 Mac 全盘访问,称 AI 智能体大幅增加风险

    Apple 宣布将在 Mac 上新增全盘访问限制,要求用户通过非常明确的主动操作才能授予应用这一权限。Apple 表示,部分开发者使用全盘访问的方式可能让用户暴露文件、邮件、消息乃至浏览历史,而随着 AI 智能体能力与自主性增强,这类访问带来的风险会大幅上升。该改动发生在 Meta 的 Muse AI 被曝在未获明确授权情况下读取用户消息内容数周之后,Apple 未说明更新的具体推出时间。

10月2日周五
  1. MIT Technology Review · AI12

    用自主 AI 重新定义企业智能:MIT Technology Review 报告解析“智能体转型”

    MIT Technology Review 报告指出,2026 年全球 AI 投资将达 2.5 万亿美元,同比增长 44%,但多数企业仍未能靠 AI 实现收入增长,智能散落在各业务孤岛中。报告将 AI 从工具转向运营模式的转变称为“智能体转型”,主张企业先重构流程、再选模型,并建设可组合、主权可控的数据底座,让数据在本地即可被查询和准备,而非迁移集中。

  2. AWS Machine Learning Blog48

    用 Amazon Quick 和 Adjudicated Query 模式批量核查数千份租约合规性

    AWS 提出 Adjudicated Query 设计模式,让业务用户在 Amazon Quick 聊天界面提问合规问题,实际判定交由确定性规则引擎完成,模型只负责把自然语言转为固定类型操作并转述结果。该模式通过完整性回执保证"已扫描 = 合规 + 违规 + 存疑 + 不可读",并以版本化规则数据支持事后审计追溯,示例场景为跨州 5 万份公寓租约的合规核查。

  3. AWS Machine Learning Blog60

    在 Amazon SageMaker AI 上用多轮 RL 微调搜索智能体

    AWS 团队用 Amazon SageMaker AI 的多轮强化学习(MTRL)微调 Qwen3.6-27B 搜索智能体,在 BrowseComp-Plus 上 nDCG@10 提升 23.7%,失败率从 22.89% 降至 0.68%。

    推荐理由:AWS 团队公开了用 SageMaker AI 多轮 RL 微调搜索智能体的完整配置与逐项基准结果,可迁移到自有检索场景。

  4. The Verge · AI36

    AI 幻觉让"顾客永远是对的"更难应付:ChatGPT 被用来质疑服务员和护林员

    生成式 AI 的普及正在让服务业顾客用 ChatGPT 的答案反驳一线从业者:纽约服务员 Madison 称有客人以 ChatGPT 为由否认菜品含贝类过敏原,还有客人拒绝侍酒师、改问 ChatGPT。Meta 新 AI 智能体 Muse 的推出可能加剧这一问题,影院、咖啡店、Apple Store 员工及护林员也遇到顾客拿着 AI 编造的行程或产品前来。

  5. AWS Machine Learning Blog37

    Amazon Quick 推出 Live Data in Apps:AI 构建应用可实时查询受治理数据集

    Amazon Quick 为 AI 构建的 Quick Apps 推出 Live Data in Apps,应用每次打开时都会实时查询受治理的 Quick Sight 数据集,而非依赖构建时的静态快照。查询以查看者身份执行,现有行级和列级安全规则自动生效,SPICE 与 Direct Query 数据集均支持,查看者需为已认证的 Quick 用户并逐数据集授权。

9月22日周二
8月4日周二
  1. Microsoft Research71

    微软研究院开源 Orchard 智能体框架,含 SWE、GUI、Claw 三套训练方案

    微软研究院发布开源框架 Orchard,核心是 Kubernetes 环境服务 Orchard Env,可跨软件工程、网页导航和个人助理任务复用环境、数据管线与评测流程,并支持在 Codex、OpenClaw、ZeroClaw 等真实部署框架内直接训练智能体。

    推荐理由:微软研究院开源 Orchard 框架,读者可了解其环境服务如何让智能体在真实部署框架内训练并复用数据与评测流程。