跳到正文

#编码

今日 0 条
9月27日周日
9月26日周六
  1. Hacker News:AI 热帖78

    开发者自述:停用AI编码一个月后的反思与教训

    一位资深开发者分享其从依赖AI编码到决定停用一个月的经历。起初他享受AI带来的速度提升,但随后陷入“Tokenmaxxing”(多任务并行)的陷阱,导致上下文切换频繁、精力耗尽。他发现AI生成的代码往往需要大量人工审查和修正,实际交付效率并未如预期倍增,反而因过度依赖而丧失对代码的控制权和理解力,甚至产生羞耻感。最终他意识到自己数月未亲手写码,决定回归传统开发方式以重拾掌控感。

  2. Hacker News:AI 热帖54

    Haskell 开发者分享在 LLM 时代保持编程乐趣的工作流

    一位 Haskell 开发者撰文提出在 LLM 辅助下保持编程乐趣与代码掌控权的工作流:规划、研究和杂务交给智能体,核心编码由人完成,并给生成的产物加自动审查循环。他提醒慎用前沿模型的 token 消耗与不透明限额,把 token 耗尽视为服务中断而提前准备离线任务,还建议少读 LLM 生成的文本、保持与人交流代码。他表示这套方法让自己效率约提升一倍,评论区有人补充先写接口再让 AI 实现的做法。

  3. IT之家(RSS)52

    Claude Code 推出新机制:任务中途触发 5 小时上限将优雅收尾

    Anthropic 的 Claude Code 团队于 9 月 26 日宣布启用新机制,任务中途触发 5 小时使用上限时不再直接中断编辑,而是寻找合适的收尾点完成收尾工作。收尾所需时间从用户的每周限制中扣除一小段固定时间;Pro 用户每周可使用一次,Max 和 Team Premium 用户每次达到 5 小时会话限制后都可使用。

  4. Hacker News 热门(buzzing.cc 中文翻译)60

    Nuanced 作者复盘:计划模式为何已死

    作者复盘其围绕规划构建的桌面编码应用 Nuanced 的失败,认为计划模式正变得不再有用。模型理解大型代码库的能力提升,使显式指令和 AI 生成的规格文档价值下降;而规划与构建应交织进行,Codex 等工具正在让计划与执行的边界消融。人类如何在数百个并行智能体快速修改系统时保持连贯的心智模型,仍是未解决的问题。

  5. Peter Steinberger 🦞53

    Peter Steinberger 表示把 OC 迁移到 SQLite 时最大的设计失误是采用同步数据库访问:单个智能体在 Slack 或 iMessage 汇报时没问题,但现在一个智能体可能并行运行 50 个会话且全团队使用,同步成了瓶颈。他设了一个 /goal,用 Astra 迄今提交了 575 个 PR 把一切迁移到异步 worker,并随进展逐步发布改进。他感叹大规模重构如今不再可怕。

  6. HuggingFace Daily Papers(社区热门论文)48

    Relic:把多智能体协作经验沉淀为组织级可执行协议

    Relic 将多智能体协作中反复出现的失败转化为组织所有、可执行的协议,把触发条件、责任、所需证据与执行后果绑定到运行时,并支持修订与退役。在十个软件工作负载、三个模型共 360 次受控运行中,完整契约交付率从 14.06% 提升至 19.76%(+5.71 个百分点)。

  7. ClaudeDevs67

    Opus 5.5 每输入和输出 token 比 Opus 5 便宜 20%,缓存读取便宜 60%。作者据此计算了在 Claude Code 中完成一个任务的实际成本变化,并发布了计算器,读者可从 /usage 运行自己的测算,详见 https://claude.dev/blog/what-a-task-costs-on-opus-5-5/。

    推荐理由:原文把 Opus 5.5 的降价幅度换算成 Claude Code 中单个任务的实际成本,并提供计算器供读者自行测算。

9月25日周五
  1. Cognition 模型 / Devin 博客(网页)72

    Cognition 宣布年化收入运行率突破 10 亿美元

    Cognition 宣布年化收入运行率突破 10 亿美元。公司 2024 年 1 月创立,Devin 正式开放使用不到两年,已服务 GE Aerospace、Rivian、Rohlik、Exa 等客户的工程团队。

    推荐理由:官方披露年收入运行率破 10 亿美元,并列出 GE Aerospace、Rivian 等客户,可作了解 Devin 商业化进展的参考。

  2. GitHub Blog64

    GitHub Security Lab 发布 LLM 驱动的 Fuzzing Taskflow,自动完成 C/C++ 项目模糊测试全流程

    GitHub Security Lab 的 Antonio Morales 开源了基于 Taskflow Agent 的 Fuzzing Taskflow,指向 GitHub 仓库即可自动识别入口点、编写 harness、运行 AFL++、读取覆盖报告并分诊崩溃。

    推荐理由:作者开源了完整的自主模糊测试流水线,并讲清覆盖反馈、结构感知和崩溃分诊的设计取舍,C/C++ 维护者可直接复用。

9月24日周四