跳到正文

#编码

今日 1 条
9月1日周二
  1. HuggingFace Daily Papers(社区热门论文)45

    WebWorld:把浏览器当作世界模型实现自改进的网页代码生成

    arXiv 论文提出 WebWorld,让 VLM 与浏览器这一确定性可执行模拟器交互,将 VLM 的批评编译为类型化交互契约,浏览器重新执行候选代码,只有目标进展与既有能力保持同时满足时才签发验收证书,证书化的转移累积为质量棘轮并作为 SFT 导出的唯一数据。

  2. 公众号:百度智能云(文心)34

    百度千帆Token Plan企业版更新:DeepSeek-V4-Pro-0813与GLM-5.3等三款模型上线并接入百度搜索工具

    百度千帆Token Plan企业版更新,DeepSeek-V4-Pro-0813正式版与GLM-5.3、GLM-5.3-Flash三款模型上线,原有模型ID可直接调用。百度搜索工具正式接入,专属API-KEY即可调用,限时优惠每次2.5积分。Token福利包扩展覆盖语音、OCR、智能文档分析等AI开放能力,席位扩展为四档并有限时赠送积分、夜享Token低至2折等活动。

  3. Hacker News 热门(buzzing.cc 中文翻译)42

    ChatGPT 工作工具与技能参考

    一份 ChatGPT 工作工具与技能参考文档上线,汇总了相关工具与技能的使用说明。该参考面向开发者与进阶用户,便于快速查阅 ChatGPT 工作场景中的功能配置。文档以站点形式发布,供社区参考使用。

  4. The Verge:AI(RSS)56

    Debian 投票允许开发者使用 AI 工具,但不会禁止 AI 代码

    Debian 投票通过新 AI 政策,允许开发者使用 AI 工具参与 Linux 发行版的开发、维护和文档工作,既不支持也不禁止生成式 AI 工具。政策强调“负责任”使用 AI 可提升生产力,但贡献者仍需对提交内容的质量、正确性和法律合规性负责,且不强制披露 AI 使用情况。部分贡献者对此不满,有人宣布退出 Debian。

8月14日周五
8月4日周二
  1. Microsoft Research71

    微软研究院开源 Orchard:可扩展智能体 AI 框架

    微软研究院发布开源框架 Orchard,核心是 Kubernetes 环境服务 Orchard Env,可复用于软件工程、网页导航和个人助理三类智能体任务,并支持直接在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 中训练。

    推荐理由:微软研究院开源 Orchard 框架,公开环境服务、训练流程与数据,读者可据此了解小模型在真实 harness 中训练智能体的可行路径。

7月17日周五
  1. Google DeepMind71

    Google DeepMind 发布 Gemini 3.5 Flash Cyber 网络安全模型

    Google DeepMind 发布 Gemini 3.5 Flash Cyber,这是基于 3.5 Flash 微调的轻量网络安全模型,用于快速发现、验证和修补漏洞,在 CyberGym 等基准上以多次调用取得接近更大模型的成绩。

    推荐理由:Google 把轻量 Flash 微调成专用安全模型,并给出 CyberGym 与 Chrome 流水线的实测对比,可看专用小模型在漏洞挖掘上的取舍。