Anton Gladkov · 2026-06-29 · source ↗ · whole document (16)
Тэкс, сегодня модельный рынок не шепчет, а довольно громко двигает мебель. У нас
Что люди говорят
GPT-5.6 взорвал HN: launch thread набрал сотни комментариев, отдельные ветки спорят не только о capability, но и о government-gated access, pricing, safety и METR cheating findings. Reddit/Codex уже ловит ранние “я видел Sol в Codex” истории — к ним отношусь как к анекдотам с возможной правдой внутри, не как к public availability proof.
По Gemini computer use сигнал живой, но более практичный: HN/Reddit обсуждают automation и риски screen-control agents. По Qwen-AgentWorld сигнал nerdy, но настоящий: GitHub/HF/arXiv плюс HN-обсуждение про simulation as training/planning layer. По Mistral OCR 4 шума меньше, зато это та скучная вещь, которая потом тихо экономит компаниям месяцы ручной боли.
Как это использовать
Builders: проверьте свои OpenAI/Anthropic deprecation и rate-limit assumptions. Если у вас завязка на старые OpenAI Evals/Agent Builder/reusable prompts или Claude Opus 4.7 fast mode — это уже миграционная заметка, не “когда-нибудь”.
Agent people: сравните Gemini 3.5 Flash Computer Use с текущими browser-use стеками на настоящих workflow, где есть auth, формы, ошибки, irreversible actions и prompt injection. Тест без грязной реальности — это просто театр.
Open-model nerds: Qwen-AgentWorld стоит смотреть как infrastructure primitive для агентных eval/training loops, а не как очередной leaderboard horse.
Document AI folks: прогоните Mistral OCR 4 на своих худших PDF: таблицы, подписи, сканы, многоязычка, формулы, redaction use cases. Если оно держит структуру — это деньги, не эстетика.