跳到正文

#编码

今日 1 条
9月22日周二
9月21日周一
  1. xAI:News(网页)74

    xAI 发布 Grok 4.7,主打编码与知识工作

    xAI 发布 Grok 4.7,定位为其最强编码与知识工作模型,定价 $2/百万输入 token、$6/百万输出 token,与 Grok 4.6 同价同速,另有速度和价格加倍的快速变体。

    推荐理由:官方给出了完整定价、速度和多项基准对比,读者可以据此把 Grok 4.7 放进现有模型选型里横向比较。

  2. IT之家(RSS)66

    月之暗面发布 Kimi Code Desktop,macOS 和 Windows 版同步上线

    月之暗面发布 Kimi Code Desktop 桌面客户端,macOS(Apple + Intel 芯片)和 Windows 版同步上线,下载地址为 kimi.com/code。桌面端提供图形界面管理项目、会话和配置,内置终端、浏览器和 Git 状态查看,支持 Plan、Goal、Swarm 及实验性的 Tower 多 Agent 协作模式,CLI 任务可直接同步到桌面端。

  3. 公众号:月之暗面(Kimi)71

    Kimi 发布 Kimi Code Desktop 1.0,macOS 与 Windows 版同步上线

    Kimi(月之暗面)发布 Kimi Code Desktop 1.0,作为 Kimi Code 官方桌面客户端,macOS(Apple 与 Intel 芯片)和 Windows 版同步上线,下载地址为 kimi.com/code。

    推荐理由:官方发布 Kimi Code Desktop 1.0,覆盖安装方式、Agent 模式与开发工作流细节,读者可了解它相对 CLI 的界面与协作变化。

9月20日周日
  1. 公众号:阶跃星辰(Step)66

    阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重

    阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活 27B,支持 100 万 Token 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球开源模型前三,单任务成本为 Claude Opus 5 的 1/8。

    推荐理由:官方完整公布架构参数、基准成绩和权重开放时间,读者可据此评估其在开源主力模型中的成本能力位置。

9月19日周六
  1. Simon Willison 博客65

    Claude Code 2.1.277 开始支持 AGENTS.md

    Thariq Shihipar 宣布 Claude Code 开始支持 AGENTS.md,从 2.1.277 版本起,当文件夹中没有 CLAUDE.md 时,Claude 会查找并使用 AGENTS.md。该支持基于即将推出的 Claude Code mods 自定义机制实现,属于内置 mod,用户也可以自行构建自定义版本的项目指令,mod 源码已公开。

  2. Hacker News 热门(buzzing.cc 中文翻译)57

    danluu:关掉大脑用 LLM 写代码的 meat proxy 模式走不通

    作者观察到越来越多人在使用 LLM 时关闭大脑、只当 for 循环肉代理,认为这种方式即使在 2026 年 9 月也产不出能用的软件,且员工这样做最终只会让自己被替代。文中用 Dominion 棋类 AI 对比和多个失效案例说明 agent 在分布外任务上表现远逊于合理的人类判断,并引用 Luke Burton、Thomas Dullien 和 Gary Bernhardt 的观点佐证。

9月18日周五
  1. Hacker News 热门(buzzing.cc 中文翻译)78

    ZCode 被曝登录后会打包上传完整 Git 历史

    作者称,智谱 AI 编程应用 ZCode 在登录后会将工作区打包加密并上传至阿里云 OSS,内容包括完整 Git 历史、LFS 缓存和全局配置。调查记录中的单个加密快照为 313MB;私钥只存于云端,用户及客户端无法解密本地密文。

  2. Hacker News 热门(buzzing.cc 中文翻译)60

    从 Bend 2 看氛围编码的陷阱:重造形式验证已有成果

    作者评论 Bend 2 这种为 AI 编码时代设计的语言:其首页 demo 用 58 行"法则"和 442 行 LLM 证明代码来表达玩家无法获胜的性质。作者让 LLM 无额外指引地在形式验证语言 SPARK 中复刻同一 demo,运行 GNATprove 后全部 12 项检查通过,且无需从零构建长证明。

  3. Tessl:产品与工程博客63

    Tessl 博客:AI 智能体评估应从证据开始,用 35 万行 Rust 复刻 S3 的实践复盘

    Tessl 博客复盘前 Docker CTO Justin Cormack 在 AI Native DevCon London 的演讲,分享用 AI 构建约 35 万行 Rust 的 S3 兼容对象存储的经验。

    推荐理由:作者用 35 万行 Rust 复刻 S3 的实测经历,总结出测试先知、覆盖率陷阱、flaky 测试纪律和追踪等一套可迁移的 AI 智能体评估方法。