Раньше я вообще не думал, что «живые данные» так уж важны.

Когда я раньше видел проекты на базе ИИ, где говорили про данные, я в основном просто пробегал взглядом.

Объём данных, размер модели, с кем сотрудничали… в целом со временем всё казалось одинаковым.

Но недавно, посмотрев на KGeN, я внезапно заинтересовался очень простым вопросом:

Если в будущем тренировочные данные для ИИ будет всё больше генерировать сама ИИ, то кто сможет доказать, что изначально эти данные действительно были созданы людьми?

Это, на мой взгляд, довольно интересно.

Сейчас в интернете информации становится всё больше, но «больше» не означает «лучше».

Статья может быть написана ИИ, изображение — сгенерировано ИИ, а комментарий — тоже может быть массово сгенерирован ботами.

Если всё это дальше использовать для обучения следующего поколения ИИ, то в конце концов может возникнуть довольно странный цикл:

ИИ генерирует данные → ИИ учится → снова генерирует больше данных → снова обучает ИИ.

Данных становится всё больше, но реальные человеческие переживания и опыт — наоборот, становятся всё более редкими.

Именно поэтому я в последнее время начал присматриваться к KGeN.

Направление KGeN — это не просто очередная «платформа данных», а связующее звено между верифицированными человеческими сетями и потребностями ИИ в данных.

Официально сейчас акцент делается на такие направления, как Verified Human, а также мультимодальные данные Sound / Sight / Motion / Touch, плюс Physical AI и LLM.

Мне кажется, по-настоящему интересная часть этого направления — вовсе не слова «ИИ».

А вот что:

Когда ИИ станет всё больше, не превратятся ли живые люди сами по себе в дефицитный ресурс?

Я думаю, за этим вопросом стоит дальше наблюдать в контексте KGeN.

#KGEN