
Модель GPT-5.6 Luna обнаружила 69 подтвержденных ошибок за $0.20, в то время как модель GPT-6 Astra нашла 92 ошибки за $5.66.
Это означает, что модель Luna в 28 раз дешевле, но на 24% менее точна, особенно при обнаружении ошибок безопасности.
Такие результаты вызвали дискуссию на news.ycombinator.com о том, является ли модель стоимостью $1.20 достаточно хорошей для проверки кода.
Стоит отметить, что модель GPT-5.6 Luna показала хорошие результаты, несмотря на свою низкую стоимость.
Это сравнение может изменить подход к выбору моделей для проверки кода, поскольку теперь разработчики могут учитывать не только точность, но и стоимость модели.