Откуда берётся «машинный привкус» в AI-авторстве? a16z: перестаньте гадать, AI это написала или нет — вопрос в том, хороша ли статья

После того как генеративный AI получил широкое распространение, вопрос «эта статья написана AI?» почти превратился в новый тип сомнений в интернете. Однако венчурная компания a16z, в том числе подразделение a16z crypto, считает, что проблема может быть в самом вопросе. (Вы читаете рассылки, которые тоже написаны AI? Substack запустил инструмент для обнаружения AI, чтобы противостоять «Claudefishing» — фейкам под “человеческое” авторство.) a16z crypto недавно поделились статьёй «The habits of AI writing, and what to do about them», где обсуждают, откуда на самом деле берётся знакомый многим «AI-вкус». Многие проблемы в письме, которые приписывают AI, существовали ещё задолго до того, как люди начали пользоваться большими языковыми моделями. AI лишь массово копирует и усиливает эти вредные привычки.

Поэтому вместо того чтобы выяснять, какая доля текста сгенерирована AI, куда важнее спросить: ясно ли автор объяснил суть? Насколько информация заслуживает доверия? Есть ли реальная ценность для читателя?

Так называемый «AI-вкус» — это во многом просто человеческие плохие привычки

Когда вы читаете статью, людям легко определить, что она «похожа на ChatGPT». Например, много предложений, которые выглядят глубокомысленными, но по сути содержат мало информации; обилие заученных формулировок в стиле корпоративных презентаций; каждая тема разложена ровно на три пункта; у текста есть понятная структура, но при этом не слышен собственный голос автора; либо неоднократно встречаются чрезвычайно похожие знаки пунктуации и синтаксические модели.

a16z crypto сводят эти проблемы примерно к нескольким типам, включая «псевдоглубину» (pseudo-profound), чрезмерно общие формулировки, чрезмерную структурированность, отсутствие личного голоса, а также повторяющиеся знаки пунктуации и шаблоны предложений.

Но в том-то и дело, что эти недочёты не изобрёл AI. Корпоративные пресс-релизы, отчёты консультантов, академические статьи и даже новостные заметки уже давно полны похожих проблем. Большие языковые модели лишь учатся на огромных массивах человеческого текста, а затем заново собирают самые распространённые, самые безопасные и наиболее предсказуемые способы выражения. Иными словами, многие ненавистные «AI-нотки» в той или иной степени — это среднее значение посредственного человеческого письма.

Вместо того чтобы искать AI, относитесь к «AI-вкусу» как к списку ошибок в тексте

Это также даёт повод задуматься о том, почему появляется «AI Detection». Вместо того чтобы считать определённые признаки доказательством того, что статья сгенерирована AI, можно рассматривать их как набор «классификаций плохих текстов». Если в статье много расплывчатых прилагательных — значит, автору нужно добавить конкретных людей, цифры, события и примеры. Если абзац вроде бы полный, но в нём нет позиции — попросите себя понять, что автор на самом деле хочет сказать. Если каждый абзац выглядит одинаково — заново настройте ритм. А если одно предложение подходит для любой индустрии, вероятно, оно не даёт почти никакой информации.

Ключ к хорошей статье — не «в ней нет AI», а достаточная конкретность и подлинность

a16z crypto считают, что по-настоящему важно поддерживать в письме specificity (конкретность) и authenticity (аутентичность). Это означает, что AI необязательно следует полностью исключать из процесса создания текста. Наоборот, AI можно использовать, чтобы проверять, какие фрагменты слишком абстрактны, какие предложения стоит удалить, не спутана ли структура статьи, а также помочь авторам находить избитые фразы, которые они снова и снова используют.

По-настоящему не подходит для полного «аутсорса» AI — это авторские суждения. Например: «почему стоит написать об этом?», «какая деталь наиболее важна?», «с какой позицией рынка я не согласен?», и «какая информация заслуживает того, чтобы читатель потратил на неё время?» Именно эти элементы и формируют реальную разницу между текстами. Если автор отдаёт эти решения модели, то даже если грамматика будет идеальной и структура очень красивой, в итоге вы всё равно можете получить материал «без ошибок, но и без того, что запомнится».

Откуда берётся «машинный привкус» в AI-авторстве? a16z: перестаньте гадать, AI это написала или нет — вопрос в том, хороша ли статья. Впервые опубликовано.