По дороге на работу утром наткнулся на одну придирчивую (и злобную) заметку: автор пишет, что полгода назад в одном «большом AI» вскользь накидал идею продукта, а теперь её тем же текстом снова скормлили как пример. В комментариях ругают, мол, «данные белопотребуют». Я не стал присоединяться к хейту. В офисе открыл Private Inference с @OpenGradient и хотел понять: то, что он говорит, — это всего лишь обещание в условиях, или же в основе есть реальный механизм, который перекрывает этот путь. $pivx
Я выбрал кусок с явно узнаваемыми «пальцами» вымышленного коммерческого плана, в Private Inference прогнал его в четырёх вариантах формулировок, сделал три раунда, двенадцать запросов — и каждый раз параллельно собирал логи на узлах, чтобы проверить, действительно ли prompt не сохраняют на диске. Итог совпал каждый раз: на стороне узла остаются только хэш зашифрованной полезной нагрузки и одноразовый идентификатор сессии; открытый текст ни разу не появляется вне TEE-анклава. В момент выхода из анклава память обнуляется, в логах нет полей, по которым можно было бы собрать фрагменты обратно в обучающий датасет.
В массовых обсуждениях про Private Inference почти всё крутится вокруг эмоционального «не дать украсть/белопотребствовать». А настоящая работа OpenGradient холоднее: вынуть «не обучают» из пользовательских условий и переписать это как физический маршрут, гарантируемый аппаратурой и криптографией. Именно TEE решает, можно ли завести открытый текст внутрь и получится ли его вывести. Oblivious HTTP отрезает идентичность и источник. Verification Layer потом выдаёт поддающиеся публичной проверке протоколы выполнения. Условия могут поменяться, но этот путь не изменится. $SYRUP
И метрики тоже сдвинулись. Я не смотрю, сколько приватных prompt’ов запускает OpenGradient; меня интересуют данные, которые не совпадают с общим консенсусом: сколько раз за день протоколы можно воспроизвести под проверкой третьей стороной, и при этом доказать, что не было ни кэша, ни возврата. Первое — про популярность, второе — про то, выдержит ли эта стена от «белопотребства» реальную нагрузку.
Если $OPG — это просто плата за одноразовый приватный вычислительный «сервисный сбор», то это больше похоже на токен биллинга за шифрованную пропускную способность. Но если в будущем вокруг него замкнётся контур: TEE-узлы вносят залог, протоколы подписываются, за нарушения есть штрафы с конфискацией, споры о утечке тренировочных данных разрешаются, а пользователи компенсируют ущерб — тогда это уже не разменный токен, а единица залогового доверия этой сети «анти-белопотребство» в приватных вычислениях.
Не тороплюсь с выводами. Чтобы сделать «не обучают» верифицируемым маршрутом, нужно время — я хочу продолжать смотреть то, что OpenGradient отдаёт на основной сети, и образцы, которые будут передавать подключаемые стороны. #opg
我的数据不会被白嫖了
0%
他说没用我的数据我怎么知道
0%
0 проголосовали • Голосование закрыто