Hacker News 热门(buzzing.cc 中文翻译)· pxx·· 11 天前AI 评分54
Jev 与无法解释的失败的常态化
无法解释的失败的常态化
AI 导读
作者评论 TypeSafe AI 推出的 AI 模型 Jev,认为其用户不做 evals、把置信度分数当形式或甩锅理由,丢弃了对失败原因的追查。他担忧 LLM 驱动的开发会让"有时就是烂"成为排查的可接受终点,而本可用几条提示词搭建的 eval 反而能解决部分问题。
整理与数据来源:AIHOT
来源:Hacker News 热门(buzzing.cc 中文翻译) · ihatethefuture.com