返回 AI 情报
技巧精选 772026-09-15 03:56theanonymousoneHacker News:AI 热帖

GPT-5.6 Luna 对比 GPT-6 Astra:$1.20 的模型做代码评审够用吗

GPT-5.6 Luna vs. GPT-6 Astra: Is a $1.20 Model Good Enough for Code Review?

精选理由

原文用公开基准和可复现脚本对比两档模型在代码评审上的召回、精度与成本,并给出按仓库和 bug 类别分层的可迁移测法。

AI 摘要

Entelligence 在 50 个公开基准 PR 上用相同提示词对比 GPT-5.6 Luna 和 GPT-6 Astra 的代码评审能力,Luna 找到 69 个经验证 bug(Astra 92 个),总成本 $0.20 对 $5.66,精度 74% 对 96%。

正文 · AI 翻译

该来源未收录可展示正文,站内仅提供摘要。

> 站内仅提供摘要,全文见原文。

原文

Original Title

GPT-5.6 Luna vs. GPT-6 Astra: Is a $1.20 Model Good Enough for Code Review?

Source

Hacker News:AI 热帖

Site

entelligence.ai

Author

theanonymousone

Published

2026-09-15 03:56

阅读原文· entelligence.ai

继续阅读