跳到正文
原文
Hacker News:AI 热帖· theanonymousone·· 24 天前精选AI 评分77

GPT-5.6 Luna 对比 GPT-6 Astra:$1.20 的模型做代码评审够用吗

GPT-5.6 Luna vs. GPT-6 Astra: Is a $1.20 Model Good Enough for Code Review?

AI 导读

Entelligence 在 50 个公开基准 PR 上用相同提示词对比 GPT-5.6 Luna 和 GPT-6 Astra 的代码评审能力,Luna 找到 69 个经验证 bug(Astra 92 个),总成本 $0.20 对 $5.66,精度 74% 对 96%。

推荐理由

原文用公开基准和可复现脚本对比两档模型在代码评审上的召回、精度与成本,并给出按仓库和 bug 类别分层的可迁移测法。

整理与数据来源:AIHOT

来源:Hacker News:AI 热帖 · entelligence.ai