Anton Gladkov · 2026-06-29 · source ↗ · whole document (16)
Тэкс, сегодня модельный рынок не шепчет, а довольно громко двигает мебель. У нас
По Gemini computer use сигнал живой, но более практичный: HN/Reddit обсуждают automation и риски screen-control agents. По Qwen-AgentWorld сигнал nerdy, но настоящий: GitHub/HF/arXiv плюс HN-обсуждение про simulation as training/planning layer. По Mistral OCR 4 шума меньше, зато это та скучная вещь, которая потом тихо экономит компаниям месяцы ручной боли.
Как это использовать
Builders: проверьте свои OpenAI/Anthropic deprecation и rate-limit assumptions. Если у вас завязка на старые OpenAI Evals/Agent Builder/reusable prompts или Claude Opus 4.7 fast mode — это уже миграционная заметка, не “когда-нибудь”.
Agent people: сравните Gemini 3.5 Flash Computer Use с текущими browser-use стеками на настоящих workflow, где есть auth, формы, ошибки, irreversible actions и prompt injection. Тест без грязной реальности — это просто театр.
Open-model nerds: Qwen-AgentWorld стоит смотреть как infrastructure primitive для агентных eval/training loops, а не как очередной leaderboard horse.
Document AI folks: прогоните Mistral OCR 4 на своих худших PDF: таблицы, подписи, сканы, многоязычка, формулы, redaction use cases. Если оно держит структуру — это деньги, не эстетика.
My take
Сегодняшний рынок говорит неприятную, но полезную вещь: модельная сила без доступа — это прогноз погоды; доступ без capacity — лотерея; capacity без safety — долг, который потом придет с процентами.
Самое важное не то, кто написал самый блестящий benchmark paragraph. Самое важное — кто может дать стабильный, проверяемый, оплачиваемый и не самоуничтожающийся workflow. Вот туда и смотрим, мои клавиатурные страдальцы.