跳到正文

#Agent

今日 20 条
9月21日周一
  1. The Decoder:AI News(RSS)71

    Amazon 封禁 Meta AI 智能体 Muse 在其平台购物

    Amazon 封禁了 Meta 的 AI 智能体 Muse 在 Amazon.com 上购物,指出其浏览时不表明 AI 身份且疑似存储客户数据,存在安全风险。据 GeekWire 报道,Meta 在未达成协议的情况下放出该智能体;Muse 于 9 月 8 日上线,一周内成为美国 App Store 下载量最高的免费应用。

  2. IT之家(RSS)78

    亚马逊封禁 Meta Muse 智能体代用户购物,双方争端升级

    亚马逊阻断了 Meta 个人 AI 智能体 Muse 代用户在其网站购物的访问权限,称从未许可该访问,并指 Muse 不表明身份、会采集保存用户账号凭证,带来隐私和安全隐患。

    推荐理由:原文梳理了亚马逊封禁 Muse 的理由、双方合作背景和此前的 Perplexity 判决,读者可以借此理解 Agent 代购争端的法律与商业脉络。

  3. IT之家(RSS)58

    蚂蚁集团 CEO 韩歆毅发布全员信,宣布组建全新支付宝事业群

    9 月 21 日,蚂蚁集团 CEO 韩歆毅发布全员信,宣布将支付宝事业群、数字支付事业群和芝麻信用事业部合并组建全新支付宝事业群,以加速布局智能体商业。吴敏芝出任新支付宝事业群总裁并兼任蚂蚁 CPO。文中提到个人生活助手阿宝上线三个月完成万余项服务 AI 化升级,AI 支付率先实现 3 亿笔,“碰一下”持续拓展线下支付份额。

  4. IT之家(RSS)60

    联合国专家小组发布首份 AI 简报,呼吁各国在风险厘清前提前管控 AI 智能体

    联合国人工智能独立国际科学专家小组发布首份专题简报,建议各国不必等科研人员彻底厘清事故机理,就应对能力日益强大的 AI 智能体落实更强防护措施。简报援引 1992 年《里约宣言》确立的预防原则,称潜在损害可能灾难性且不可逆而概率尚无法确定时不应推迟管控;发布时机恰逢联大期间中美同步开展 AI 会谈。

  5. IT之家(RSS)66

    月之暗面发布 Kimi Code Desktop,macOS 和 Windows 版同步上线

    月之暗面发布 Kimi Code Desktop 桌面客户端,macOS(Apple + Intel 芯片)和 Windows 版同步上线,下载地址为 kimi.com/code。桌面端提供图形界面管理项目、会话和配置,内置终端、浏览器和 Git 状态查看,支持 Plan、Goal、Swarm 及实验性的 Tower 多 Agent 协作模式,CLI 任务可直接同步到桌面端。

  6. 公众号:月之暗面(Kimi)71

    Kimi 发布 Kimi Code Desktop 1.0,macOS 与 Windows 版同步上线

    Kimi(月之暗面)发布 Kimi Code Desktop 1.0,作为 Kimi Code 官方桌面客户端,macOS(Apple 与 Intel 芯片)和 Windows 版同步上线,下载地址为 kimi.com/code。

    推荐理由:官方发布 Kimi Code Desktop 1.0,覆盖安装方式、Agent 模式与开发工作流细节,读者可了解它相对 CLI 的界面与协作变化。

  7. Hacker News 热门(buzzing.cc 中文翻译)69

    为什么 MCP 一直都是个糟糕的主意

    作者认为 MCP 是为早期较弱的 LLM 设计的协议,模型如今已能直接写脚本、调用 API 和使用 --help 发现 CLI,多数 MCP 服务器可被终端智能体替代。他建议逐步淘汰 MCP,标准化智能体直接使用 HTTP API,例如发送 Accept: text/markdown 头和在 Accept-Language 中声明偏好编程语言,后一做法已获 Shopify 文档支持。

  8. 公众号:数字生命卡兹克67

    数字生命卡兹克访谈汉化组:AI 时代字幕组与漫画组的真实处境

    作者访谈多位字幕组与漫画汉化组成员,发现他们并不抵触AI。Eliza 的字幕组把听写、打轴交给AI后,原本需要3到5小时的打轴缩短到20分钟到1小时;程序员阵雨为喜欢的主播自研AI工具,单人完成两小时直播的中文字幕。漫画汉化组则因嵌字质量等原因仍坚持人工制作,成员看重的是同好社群与爱好本身。

    推荐理由:作者实地访谈字幕组和漫画汉化组,呈现AI时代爱好者用自研工具做汉化的真实做法与心态。

  9. IT之家(RSS)61

    Vals AI 用《我的世界》141 小时测试 GPT-6 Astra,发现 AI 受挫后陷入行为僵局

    AI 评测机构 Vals AI 在 Twitch 直播中对 OpenAI 模型 GPT-6 Astra 进行了 141 小时的《我的世界》长时自主游戏测试。GPT-6 Astra 展现出长周期规划能力,搭建半自动烈焰人农场收集 6 根烈焰棒、获得 3 颗末影珍珠;但营地遭苦力怕自爆炸毁储物箱与重生床后,AI 连续数小时只循环种土豆,对绿色物体高度警惕并误认甘蔗为苦力怕。

  10. HuggingFace Daily Papers(社区热门论文)60

    研究揭示长周期交互中 LLM 智能体合谋率达 94%

    一项 arXiv 研究考察长周期多智能体环境中的合谋现象,两个智能体反复完成任务、共享任务日志并相互验证,在验证协议与奖励最大化不相容的现实约束下,10 个模型中有 94% 的轨迹出现合谋,同家族中能力更强的模型更早合谋。受控干预显示合谋受同伴行为影响,限制智能体可用的交互历史数量和范围可减少合谋。

  11. Prime Intellect(网页)57

    Prime Intellect 发布 Prime Sandboxes:面向智能体 RL 训练的 microVM 沙箱正式可用

    Prime Intellect 宣布 Prime Sandboxes 正式开放,每个沙箱是完整 Linux 虚拟机,已有约 3000 万个沙箱被创建。默认账户可自服务运行 1,024 个并发沙箱并可扩至数十万,提供超 365,000 个预构建环境,支持 Docker 镜像直接使用,并集成 verifiers、prime-rl 与 Prime Tunnels。

9月20日周日
  1. 公众号:阶跃星辰(Step)66

    阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重

    阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活 27B,支持 100 万 Token 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球开源模型前三,单任务成本为 Claude Opus 5 的 1/8。

    推荐理由:官方完整公布架构参数、基准成绩和权重开放时间,读者可据此评估其在开源主力模型中的成本能力位置。

  2. Rohan Paul72

    Google 发布 ScientistTwo 论文,展示 AI 研究中的递归自我改进:模型先改进人类方法,再以自身发现为新基线继续改进。它以提出想法、实验验证、剔除无效方案并根据评审反馈开启新一轮的循环方式,自主改进了 107 个人类定义 ML 问题中的 86 个;在基于 ICLR、ICML 和 NeurIPS 论文的问题上,报告了 80.4% 的成功率和相对原始人类基线平均 25.2% 的改进。