跳到正文

#Agent

今日 18 条
9月29日周二
  1. elvis52

    Base44(@Base44)发布 Base Code 早期预览版,将代码仓库扫描后把数据库、Redis 等基础设施组件全部搭建到云端,供团队在统一环境中协作开发,支持从任意浏览器访问,WhatsApp / iMessage 接入即将推出。该环境还可支撑自动化软件工厂等能力,如智能体读取支持工单、实现修改并在云端验证。产品与模型无关,免费开放 30 天,可连接任意 GitHub 仓库获取实时预览。

9月28日周一
  1. DAIR.AI39

    Salesforce AI Research 提出 Critical-State RL,用于多轮工具调用的强化学习训练:当奖励依赖后续轮次时,其变化很大程度来自下游噪声,该方法用嵌套采样分离出当前动作带来的奖励变化,只对选定的关键调用做上下文赌博机更新。在 BFCL v4 缺失函数任务上,训练选定的那一轮可提升约 14 分,而训练其他候选轮则准确率持平或下降。

  2. elsewhere:文章(RSS)

    个人主义才能救AI:从办公Agent到Personal agent的锐评

    一篇锐评指出,办公Agent把toB业务向toC宣传在法理和情理上都是死路一条,真正需要的是面向普通人的Personal agent。作者实测Today.ai能主动读取Gmail和Notion并自行找活干,Grok bot则可自建欧洲旅行助手、视频素材整理助手等,但Today.ai无法连接微信,只能连钉钉、腾讯文档和飞书。

  3. Hacker News 热门(buzzing.cc 中文翻译)60

    资深工程师撰文反驳'编程已被AI解决'的叙事

    资深工程师 Alex Ewerlof 发文反驳'编程已解决、工程只看品味'的说法,指出维护、可靠性、安全等 NFR 以及功能需求本身都未解决,AI 无法承担问责。文章列举 LLM 擅长的场景如 POC、个人软件、自然语言转换,并逐条批驳'spec 即代码''英语是新编程语言''Agent 是新编译器'等流行观点,还与 DHH 展开交锋,最后建议工程师保持理解与问责,警惕 AI 过度使用。