К
Константин Доронин
17.07.2026 13:02 · 👁 9.3K
Мы начинаем наш стрим "Харнесс будущего. Какой он?"
Подключайтесь: https://youtube.com/live/LAUdN1-4mgI
К
Константин Доронин
13.07.2026 00:37 · 👁 2.2K
Прилетело обновление ChatGPT на iOS.
Добавили режим work и спрятали Pro-модель в Chat.
Теперь, чтобы выйти из Instant-режима, нужно добавить "Интеллект" из меню для добавления файлов и изображений (привет UX-специалистам OpenAI!).
В режиме Work выбор модели работает, как в Codex, то есть Pro-модели там нет.
Короткое видео о том, где теперь искать интеллект у ChatGPT:
К
Константин Доронин
12.07.2026 14:41 · 👁 2.1K
Про обновлённый Codex App.
Поработал с ним плотно после релиза и пока что впечатления сугубо положительные. Я знаю, что на Windows всё не очень хорошо с интерфейсами, но это сделано исключительно для того, чтобы пользователям винды было привычнее :)
Сам по себе проект всё ещё достаточно сыроват, но надеюсь, что обновлениями всё-таки доведут до готовности. Время вайбкодинга – это когда "ну, оно же запускается!" является достаточным аргументом для отправки приложения в продакшн.
Для моих задач Codex, даже в текущем состоянии, оказался удобнее, чем VS Code + официальное расширение от OpenAI. Наконец-то в Codex App добавили возможность просматривать и редактировать исходный код и файлы, не открывая сторонние IDE.
Плюсы по сравнению с VS Code: есть просмотр PDF без дополнительных плагинов.
Минусы по сравнению с VS Code: нет просмотра видеофайлов без дополнительных плагинов.
Codex App теперь умеет ставить сам себе цели без вызова /goal. Я давал три длинные задачи, но он только в одном случае решил поставить себе цель. Возможно, играет роль фраза "Пока всё не закончишь и все тесты не будут зелёными, не останавливайся".
Можно из интерфейса Codex вызвать классический GPT-чат, провести там исследование с помощью Pro-модели (или deep-research, если вы до сих пор умудряетесь выживать на подписке за $20), а потом передать результаты из чата сразу в активную рабочую сессию Codex. Это удобно.
В codex добавили целую пачку системных плагинов. Я не помню, какие из них были до, но сейчас список выглядит следующим образом:
1. github@openai-curated – для работы с git.
2. documents@openai-primary-runtime – работа с текстовыми Word/Docx-документами.
3. spreadsheets@openai-primary-runtime – работа со всеми видами таблиц.
4. presentations@openai-primary-runtime – работа с презентациями. Кстати, надо будет попробовать. Как раз есть одна задачка, чтобы набросать уже готовую презу под конкретное оформление.
5. pdf@openai-primary-runtime – работа с pdf. Попробовал вчера с ним поработать – достаточно хорошо умеет править, но надо чётко формулировать свои задачи и ограничивать его от вкорячивания скриншотов посреди страницы.
6. template-creator@openai-primary-runtime – создаёт шаблоны документов, таблиц и презентаций. Чтобы потом можно было переиспользовать.
7. visualize@openai-bundled – инструмент для создания графиков, диаграм, карт, симуляций и визуализации данных. Мне очень нравится, как Sol рисует схемы при помощи этого инструмента. Для меня это лучшее обновление, отлично вписывающееся в пайплайн.
8. browser@openai-bundled – собственный браузер. Сейчас Codex саботирует установленный мною Playwright и использует исключительно этот тул для web-ui-тестов.
Итого: я переехал на Codex App из VS Code по состоянию на сегодня. В нём есть почти всё, что мне надо для идеального инструмента для разработки с агентами. Плюс – регулярно использую подключение с телефона к ноутбуку, чтобы продолжить сессию, пока нахожусь не дома.
Как у вас опыт с обновлением Codex App?
К
Константин Доронин
10.07.2026 17:19 · 👁 8.8K
Харнесс будущего. Какой он?
Ответим на этот вопрос в формате стрима.
Для этого я позвал очень интересных гостей:
Александр Абрамов, автор канала Dealer.ai.
Тимур Хахалев, автор канала Тимур Хахалев про AI Coding.
Павел Рыков, автор канала Pavel Zloi. У нас с Пашей недавно был стрим "Что же такое harness?". Если ещё не посмотрели – welcome.
На стриме обсудим, как текущие задачи, которые решаем с помощью AI-агентов, так и то, во что превратится harness в будущем. Какие изменения и вызовы ждут нас впереди.
Дата и время проведения стрима: пятница, 17 июля, 16:00 (GMT+3)
Место проведения: мой YouTube-канал
Ссылка для добавления в календарь
p.s.: вопросы на стрим – пишите в комментарии.
p.p.s.: делитесь найденными на превью пасхалками :)
К
Константин Доронин
08.07.2026 16:16 · 👁 2.3K
Важно: AI-ассистент в этих случаях пишет первым.
К
Константин Доронин
05.07.2026 07:07 · 👁 2.6K
/goal или вайб-кодинг по ключ
Тут наш друг Костя Доронин хороший кейс с /goal описал про, фактически, создание приложений "под ключ", когда агент по подробному плану может работать сутки и более: https://t.me/kdoronin_blog/1312
Но там есть пара важнейших нюансов, которые я не смог не прокоментировать, продублирую:
При всей моей любви к GPT 5.5 Pro - это вообще не панацея. Я довольно часто использую эту модель для разных задач, в т. ч. для V0 примерно как Костя описал и хочу сказать, что GPT 5.5 Pro это все еще совсем не магия. В кейсах "приложение под ключ с нуля" именно этап интервью критически важен - чем оно подробнее тем лучше результат на выходе. И в целом, такой подход довольно рискованный. Даже Pro модель часто такую дичь может напланировать, что можно вообще приложение свое не узнать после этих 26-ти часов. И, конечно, бизнесовый контекст в этом случае очень важно давать - для кого приложение, нефункциональные требования (профиль нагрузки, например), иначе может как переусложнить (часто) так и упростить не там, где надо.
Ну и UX лучше отдельно прорабатывать - а то, вроде, все красиво делает и функционально, но дико неудобно и совершенно непонятно для пользователя, который видит приложение в первый раз. Поэтому по UX прям отдельно интервью лучше провести, а по-хорошему, сначала макеты посмотреть.
Кстати, раз уж про инженерию с нуля заговорили, расскажу про свой мини-проектик новый, вайб стек называется. Короч, помимо бизнесовых требований, чтобы разработка и сопровождение шли как гладко, довольно важно еще и с технологиями оптимальными определиться - собсна, вайб стэк эту проблему и решает, давая очень оптимальные opinionated дефолты: https://github.com/CodeAlive-AI/vibe-stack/
На днях подробнее расскажу подробнее про эту штуку.
@ai_driven
К
Константин Доронин
05.07.2026 07:07 · 👁 2.6K
Полезное дополнение к посту выше от Родиона 👍
К
Константин Доронин
04.07.2026 20:25 · 👁 3.5K
Далеко идущие цели.
Или как за выходные потратить 80% недельной Pro-подписки OpenAI за $200 на экспериментах с /goal.
/goal – это режим для AI-агента (я использовал Codex CLI), который позволяет задать агенту цель. Он будет идти до неё, пока не достигнет. Важно, что перед финальным ответом, агент вернётся к исходной цели и перепроверит, а точно ли он её достиг?
Как сделать так, чтобы AI-агент мог работать над задачей по-настоящему долго?
Мы должны задать следующее:
1. Конечный результат. Чем подробнее – тем лучше.
2. Критерии, описывающие, что такое "готово".
3. Какие у модели есть ограничения. Ключевой пункт на самом деле. Потому что он создаёт для модели feedback-loop.
4. Инструменты, с помощью которых соблюдение ограничений можно проверить.
Как это можно организовать на практике:
1. Идём в GPT-5.5 Pro.
2. Надиктовываем ему детально идею проекта, который хотим реализовать.
3. Сообщаем, что сейчас будем собирать детальное ТЗ, которое нужно сразу записывать в md-файлы для подготовки итогового zip-архива (чтоб не потерял ничего по пути).
4. Просим провести с собой глубокое интервью (с вариантами ответов и подсветкой правильного по мнению модели – так проще проходить опрос на 100 вопросов), чтобы вы с GPT понимали детали реализации на 100% одинаково.
5. Далее, опционально, можно уточнить "А будет ли готово к продакшну то решение, которое сейчас описано в ТЗ?". И получить ещё пачку вопросов в интервью с вариантами ответов, чтобы подсветить другие аспекты проекта.
6. Разбиваем с помощью GPT ТЗ на конкретные задачи. Выполнение каждой должно быть проверено через запуск тестов. Unit+автотесты+playwright для UI-тестов. Это те самые ограничения, которые обеспечивают feedback-loop после каждой задачи.
7. На базе сформированного архива просим сделать /goal-промпт, который будет ссылаться на md-файлы внутри архива (ибо ограничение в 3000 символов на /goal).
8. Готово. После прохождения всех описанных выше этапов – я получил 26 часов работы в /goal-режиме на выполнение 400+ задач по реализации проекта.
Схема достаточно общая. Посмотреть на долгий /goal она позволит. Получение production-ready продукта не гарантировано. Придётся напильником доводить до того, что нужно.
Есть моменты, в которых её можно улучшить. Например, более суровый feedback-loop и описание каждой из задач в определённом формате. Про свои находки в этих (и других) направлениях расскажу в следующих постах.
К
Константин Доронин
03.07.2026 12:23 · 👁 1.5K
Доехали на Agentic Dev Conf!
Если кто тоже тут, пишите звоните, ловите, пересечемся 🤙🏻
Концентрация шарящих за AI людей крайне высока, уже на улице дрались фанаты Fable против GLM, охране разнимать пришлось
К
Константин Доронин
30.06.2026 07:36 · 👁 4.7K
Запись стрима "Что же такое harness?".
Ссылка на YouTube: https://www.youtube.com/watch?v=QAxejH-KNak
Стрим получился полезным, с примерами на практике. Большое спасибо, Паша, что согласился прийти!
Таймкоды доступны как на YouTube, так и прямо в Telegram:
00:00 — Вступление
07:12 — О чём этот стрим?
09:31 — Что такое harness?
17:10 — Откуда появился термин «harness»?
23:20 — Виды harness
26:20 — Анатомия harness
34:28 — Вопросы от зрителей
35:20 — Что такое Skill?
39:10 — Чем harness отличается от guardrails?
44:30 — Можно ли использовать harness в продакшене банка?
49:43 — Чем harness отличается от scaffolding?
53:05 — Агент Coddy на практике
54:45 — Как harness может быть заточен под модель? На примере Coddy
59:03 — Как Coddy обрабатывает запрос?
1:00:30 — Пример работы Agent Loop
1:03:30 — 30 инструментов для on-prem-модели
1:06:15 — Работа с schedule-задачами
1:08:50 — Работа в режиме Plan
1:12:20 — Заставляем OSS-120B работать по SSH
1:14:20 — Проблемы on-prem-моделей с мультиязычностью
1:16:40 — Как работают Agent Skills?
1:21:30 — Протокол ACP на примере интеграции с Obsidian
1:31:10 — HTTP API в Coddy
1:36:50 — Уроки и грабли при создании собственного harness
1:48:00 — Готовые фреймворки для создания harness
1:50:06 — Принципы построения агентов на базе harness и отличие от AI-агентных фреймворков
1:53:55 — Harness работает только через API или поддерживает подписки Claude и Codex?
1:55:55 — Инструменты для экономии токенов
2:00:30 — Как патчить Hermes и Claude Code?
2:03:09 — Мониторинг качества harness
Полезные ссылки со стрима:
1. Презентация – использовать как полезную шпаргалку по harness
2. Coddy – harness, который создал Паша
3. Pi – минималистичный harness
4. Hermes – качественно-сделанный harness, который умеет доделывать самого себя
5. OpenClaw = Hermes+страдания (для ценителей)
Подписывайтесь на каналы участников трансляции:
Павел Рыков
Константин Доронин
p.s.: Под конец стрима у меня немного отвалился звук. Прошу понять и простить – я всё ещё в процессе дрессировки OBS.