OpenAI 7-versiyani dushanba kuni GPT-5.6’da ishga tushirdi, bunda ko‘proq inferensiya quvvatini ichki yozuvlarni qidirish, topish va qayta ishlashga sarflash orqali murakkab, manbaga bog‘langan ishlar uchun korxona agentlarini foydali qilish mumkin, deb baholandi.

Asosiy fikrlar

  • OpenAI dushanba kuni GPT-5.6’da 7-versiyani ishga tushirdi: korxona agentlari uchun ichki yozuvlarni qidirish, topish va qayta ishlash.

  • 7-versiya kompaniyadagi tarqoq fayllarni vazifalar davomida foydalanishi mumkin bo‘lgan kontekst agentlariga aylantiradi; faqat foydalanuvchi so‘rovlariga tayanish o‘rniga.

  • Agentlar natija ortidagi aniq fayl yoki yozuvga iqtibos keltira oladi; OpenAI buni tekshirib bo‘lmaydigan javoblar sonini kamaytirish sifatida taqdim etadi.

  • OpenAI dushanba e’lonidan tashqari narx yoki taqdimot jadvalini oshkor qilmagan

Kompaniya V7 tarqoq kompaniya fayllarini kontekstga aylantirishini, agentlar uni topshiriq davomida ishlatishi mumkinligini aytdi; faqat foydalanuvchi so‘rovga yozgan narsaga tayanish emas. OpenAI bu tizim agentlarga “institutsional xotira” berishini, ya’ni inson xodim bir necha oy davomida ishda o‘zlashtiradigan to‘plangan ichki bilimni ta’riflab berdi.

Ushbu vosita bir yildan ortiq vaqt davomida avtonom AI tizimlarining korxona miqyosida qabul qilinishini sekinlashtirib kelayotgan bo‘shliqni nishonga oladi: agentlar chiqish ortidagi aniq fayl yoki yozuvni keltira olishi — OpenAI buni ishonchsiz (tekshirib bo‘lmaydigan) javoblarni kamaytirish yo‘li sifatida taqdim etayotgan manba-bog‘lash funksiyasi.

Ana shu bo‘shliq ortidagi qaror qabul qilish muammosi bu hafta e’lon qilingan alohida tadqiqot maqolasida yuzaga chiqqan.

U topilgan qarama-qarshi xotiralar zaif modellarida gallyutsinatsiya ko‘rsatkichlarini keskin oshirishi mumkinligini aniqladi va ishonchsiz kontekst modelga yetib borguncha uni filtrlash uchun yengil qaror qabul qilish qatlamini taklif qildi.

Shuningdek o‘qing: Yashirin nuqson, tadqiqotchilar 72 soatda Claude’dan foydalanib OpenAI’ning kodbazasi ichiga kirib hack qilishdi

Nega korxonalar AI agentlariga ishonishda qiynalmoqda?

V7 sinovi shunchaki agentlar ko‘proq faylni topa oladimi-yo‘qmi emas; gap shundaki, korxonalar iqtiboslarni shunchalik ishonchli deb qabul qiladimi, ular inson tekshiruvini kutmasdan harakat qila oladimi. Masalan, bir xil mijorga ikki marta javob bergan support agenti yoki kompaniyaning ichki uslubiy qo‘llanmasini o‘tkazib yuboradigan kodlash agenti — bu sessiyalar o‘rtasida bardoshli, tekshiriladigan kontekst yo‘qligini ko‘rsatadi.

OpenAI’ning “manba bilan bog‘langan ish”ga urg‘u berishi muammoning yanada qiyin yarmi faqat eslab qolish emas, balki izchillik/izlanarlilik ekanini ko‘rsatadi.

Shuningdek, agentlar ichki yozuvlarni qidirish, olish va qayta ishlash uchun inferensiya resurslarini sarflagani sababli, u birgina so‘rovga javob berishdan ko‘ra har bir topshiriqqa hisoblash yukini ham oshiradi.

Stratechery’dagi tahlilchi Ben Tompson esa yaqindagi izohlarida frontier laboratoriyalar oldingi avlod model kelishidan oldin korxona mijozlariga bunday vositalarni o‘zlashtirish uchun vaqt berish maqsadida imkoniyatlar chiqarish tezligini boshqarish bosimi ostida bo‘lishini aytgan; u buni laboratoriyalar agent infratuzilmasini mas’uliyat bilan qanchalik tez jo‘nata olishi bilan bog‘liq “overhangs” deb atagan.

Raqqobatchilar, jumladan Anthropic va Google, doimiy agent konteksti borasida shunga o‘xshash qiziqish bildirgan, biroq bu oy hech qaysi biri xuddi shunday nomdagi taqqoslanadigan mahsulotni chiqarmagan. OpenAI esa dushanba e’lonidan tashqari narx yoki taqdimot jadvalini oshkor qilmagan.

Keyingisi: Short siqilishi BTC’ni 85 000 dollardan oshirdi va 648 million dollarlik shortlarni yakson qildi