Антропик опять устроила очередные «забавы».
В публичных материалах они раскрыли случаи, когда Claude использовали для кибератак, исследований оружия, слежки и т. п., и подчеркнули, что продолжают последовательно блокировать такие злоупотребления.

Изначально, конечно, дело в вопросах безопасности ИИ, но этот эпизод также показывает: ИИ больше не просто чат-бот.

ИИ начал сам читать информацию, писать код, вызывать инструменты и даже вовлекаться в реальные экономические активности — и тогда возникает новый вопрос: как доказать, что ИИ действительно становится сильнее?
В конце концов, Doubao сейчас все еще нередко несет чушь.

А если ИИ управляет Web3-кошельками, тем более нужно, чтобы все обратили на это внимание.
Пусть ИИ суммирует и пишет ретроспективный отчет — это довольно легко: если деньги потеряны, он может рассказать, где именно все пошло не так и как изменить подход в следующий раз.
Но путь к подлинной эволюции должен выглядеть так: принять решение → посмотреть на результат → найти причину → внести правки → снова протестировать.
Недавно запущенная NeoSoul функция самоэволюции NeoTrade — про нее я уже однажды говорил.

Она рассматривает торговлю как для ИИ «реальный экзамен»: были ли прогнозы верными, состоялась ли сделка, сколько составили комиссии и проскальзывание — в итоге, заработал ли он деньги, все это фиксируется по факту.
Более того, после внесения изменений его можно сначала проверить с помощью shadow run на реальном рынке — не торопясь испытывать гипотезы на настоящем «живом» капитале.

Поэтому в будущем, оценивая агента, возможно, нельзя будет смотреть только на то, насколько он умен сейчас.
Нужно еще понять, какие ошибки он допускал — и действительно ли становился умнее после того, как ошибался.
Возможно, именно это и есть самое осмысленное улучшение ИИ после перехода от «инструмента» к «участнику экономики».