Qwen 3.8 27B, запущенный локально на RTX 5090, только что «снес» Opus 4.8 в реальных бенчмарках

200 токенов/с. Никакого интернета. Никаких подписок. Никаких затрат на API.

А теперь — питание агента Hermes, работающего 24/7 бесплатно.

Это тот самый инфраструктурный сдвиг, о котором все спят. Пока CT спорит о том, какой LLM арендовать, некоторые аноны уже запускают автономных агентов на своём собственном железе.

Без ограничений по частоте. Без цензуры. Без ежемесячных затрат.

Мета-агенты ИИ только что стали дешевле и более «разрешающими».