Бенчмарки
Gemini 3.8 Flash: цифры, выводы, сравнение
Официальная таблица Gemini 3.8 Flash против пяти моделей, недельный расход связки и вердикт по подписке Antigravity за $100.
Автор канала Аи Помогатор. Пишу про Claude Code, AI-инструменты и автоматизацию — баги, фиксы, рабочие приёмы.
Бенчмарки
Официальная таблица Gemini 3.8 Flash против пяти моделей, недельный расход связки и вердикт по подписке Antigravity за $100.
AI-разработка
Суть: Spec Generator связывает требования, дизайн, задачи и фактические результаты тестов в один граф, чтобы после AI-агента оставался проверяемый след, а не только код и ответ «готово».
GPT-5.6
Коротко TL;DR: GPT-5.6 вышла в паблик 9 июля — ChatGPT, Codex, API. На живых примерах с X счёт с Claude Fable 5 примерно равный: 5.6 берёт 3D и интерактивность, Fable — рендер и законченность. В API у 5.6 контекст 1.05M, но сколько дадут на подписке — OpenAI не
Telegram
Вкратце: связка Stop-хуков не даёт Claude Code свернуться, пока работа реально не сделана — ловит враньё про «готово» и гонит доделывать. Один заскриненный прогон — 5 часов 9 минут и 719 тысяч токенов; автономность стабильно держит 6 часов+.
Коротко TL;DR: ИИ-агент пишет тесты, которые проходят и покрывают 100% строк, но ничего не проверяют — happy-path и ассерты-пустышки. Mutation testing вскрывает часть таких: намеренно ломает код и смотрит, упадёт ли тест. Но и mutation врёт. Ниже — на реальном примере моего проекта dev-pomogator: где зелёные тесты обманывали и что ловило
Claude
Вкратце: Claude Fable 5 — публичная модель класса Mythos выше Opus. Вышла 9 июня, через 3 дня США отключили её и Mythos 5 по нацбезопасности. Бенчмарки топ, но это заявки Anthropic; на практике 2× цена Opus и баги тул-юза. 30 июня контроль сняли — доступ восстанавливают с 1 июля.
Claude Code
Коротко TL;DR: Встроенный claude update на Windows зависает: его HTTP-клиент отваливается по таймауту на загрузке бинарника ~240 МБ (issue #37801). Решение — качать claude.exe напрямую через curl -L -C - с резюмом, сверять SHA256 по официальному манифесту и активировать копией поверх .local\bin\claude.exe. Практический гайд: как обновить
Telegram
Коротко: Anthropic выпустил Claude Opus 4.8 28 мая 2026 — через рекордный 41 день после 4.7, и это догоняющий релиз, который в 4 раза реже молча пишет багованный код, бьёт GPT-5.5 на SWE-Bench Pro и первым в истории проходит Super-Agent на 100%.
Telegram
Коротко TL;DR: Dynamic Context Injection (DCI) — фича Claude Code: команда с ! в SKILL.md выполняется в shell до отправки промпта, и Claude получает уже готовый результат, а не сам решает вызывать тул. Это убирает пропуск тулюзов (в эвалах их игнорировали в 56% случаев), экономит токены и сокращает контекст на
Telegram
Коротко TL;DR: После обновления Claude Code 1M-контекст пропадает с ошибкой «not available for your account» из-за кеша OAuth-токенов с subscriptionType: null в ~/.claude/.credentials.json. Фикс без релогина — вписать в этот файл subscriptionType и rateLimitTier под свой план (Pro / Max 5x / Max 20x). Альтернатива: удалить credentials.json и заново
Telegram
Коротко TL;DR: Monitor — новый тул Claude Code: агент запускает фоновый процесс (например мониторинг логов), не блокируя основной поток. Запуск не нативный — нужно явно попросить «юзай монитор тул», слеш-команды нет. Сабагент обучен на логах и сам находит проблемы. Claude поднимает фоновый процесс, не блокируя поток выполнения Раньше приходилось городить заборы
Telegram
Коротко TL;DR: Anthropic пофиксила старый баг с самопроизвольным скроллом терминала в Claude Code, когда вывод сам прыгал и улетал на самый верх. Новый экспериментальный рендерер убирает этот фликер и поддерживает события мыши прямо в терминале. Он пока на ранней стадии, но большинство внутренних пользователей уже предпочитают его старому. Включается