Пользователи GPT-6 Astra говорят, что модель стала хуже после запуска

GPT-6 Astra запустили, чтобы хвалить, а затем пользователи назвали это регрессом спустя несколько дней. Эта реакция перекликается с июльской полемикой OpenAI вокруг GPT-5.6 Sol.

Если ИИ-лаборатории могут молча менять, сколько вычислительных усилий модель тратит на ответ после запуска, то как пользователи, разработчики и регуляторы должны проверять, что заявленная способность по-прежнему соответствует тому, что модель выдает спустя дни или месяцы, и кто несет ответственность за доказательство такой согласованности?

https://www.bonuz.xyz/en/blog/gpt-6-astra-users-say-model-dumber