
Опять двойка 2030

против Энтропии

Листаю материалы к OpenAI Technical Practitioner.
Прямо черным по белому в учебных материалах написано:
Вот если клиент спрашивает «вот у меня есть такая-то проблема, начальство разрешило, давайте порешаем», то правильный специалист не должен отвечать «всё понятно, тебе нужна вот эта штука», а должен отвечать «ой всё сложно, может конечно и тебе и нужна эта штука, но надо сначала узнать то и то и это, чтобы провести качественное исследование, подключить после этого ещё тематические команды чтобы потом вместе собрать качественное предложение».
И платформа обучения предлагает несколько путей сертификации.
OpenAI Technical Practitioner — прям совсем-совсем простой тест.
И что ещё смешнее, то в тестах к OpenAI Technical Practitioner практически во всех случаях правильный ответ всегда приводится в самой длинной формулировке. Например:
Когда вам пора звать профильного специалиста:
Вот такой уровень вопросов.
Из курса про ИИ-агентов:
To build an effective rubric, you must move away from vague quality descriptions and establish operational definitions. An operational definition is a clear, unambiguous definition of a quality attribute in measurable terms. If five people grade an output using an operational definition, they must all arrive at the same rating.
For example, instructing an annotator or an autorater to check if a chatbot response «sounds professional» is highly subjective.
Instead, you must operationalize «professional» into concrete criteria:
Да в целом я бы сказал, что на людей это можно растянуть, или даже вернее обратное. Эти правила растут из того, как мы оцениваем реальных людей, например в том же корпоративном чате, на удалёнке, большой разницы тут нет. Как говорил мне один коллега: в корпоративном мире никогда не извиняйся, но благодари.
Разница между агентом и человеком размывается всё больше, особенно когда вы не общаетесь лично, причём агентам я начинаю доверять всё больше: у них хотя бы есть метрики и промты, а у людей — только совесть.
Во-первых, как раньше уже не будет.
С новыми AI-инструментами разработка изменилась до неузнаваемости.
При помощи AI действительно можно что-то быстро сваять.
Была у меня проблема — из нескольких источников собрать данные в разных форматах (в данном конкретном случае — брокерские выписки), сделать анализ согласно налоговой методологии, сделать расчёты и подготовить данные для формирования налоговой декларации (в данном конкретном случае — форма 270).
В прошлом году я делал подобный же расчёт, но вручную и в EXCEL, данные сдал и забыл.
Вот наступил новый налоговый период, и я на первом попавшемся языке программирования (ну право, не на ABAP же это всё писать, хотя… ) потратил несколько дней на пошаговую имплементацию такого инструмента.
Файлы выгрузил вручную, загрузил ай-яй-яя налоговым кодексом, правилами заполнения, пошагово через провалы и победы дошел до конца.
Ай-яй-яй реализовал самый простой пользовательский интерфейс в TUI (это я попросил), кроме самих данных для выгрузки сделали с ним в экспорте дашбордики (как он их сам назвал «премиальные»).
Ушло на всё это моих человеческих дня два-три в несколько сессий. С перерывами, включая ожидания, пока сбросятся лимиты. Было очень интересно.
Планирую полученный результат сдавать, вроде бы всё похоже на правду.
Проблему решил, результат сложу в архив и забуду до следующего раза. А будет ли следующий раз?
Во-вторых, как раньше уже не будет.
Когда настанет следующий год или у меня спросит какой-то собрат с похожей проблемой, я не стану доставать это решение из архива.
Скорее всего я напишу новое, потому что налоговый кодекс поменяется, потому что у брокеров что-то поменяется, может сами брокеры поменяются, исчезнут одни виды операций, появятся другие. Появятся новые инсайты для налоговой оптимизации.
И в этот новый раз будет другой язык программирования, другая БД, другой интерфейс, другие файлы для загрузки. А может быть будет сделано примерно то же самое.
Но самое главное — это будет делать другая модель.
Вообще, я полагаю, что пререкаться с LLM довольно бессмысленно, но это доставляет какое-то отдельное удовольствие:

Это смешно до тех пор, пока оно не трогает прод.
Шёл третий день вайб-истории. Были 16 чекпоинтов обработки данных, 63 тестовых сценария на 300 секунд рантайма. Всё просто отлично.
Запускаю новую фичу, отвлекаюсь, возвращаюсь — смотрю он в каких-то странных местах за пределами рабочей папки, присматриваюсь внимательнее — он ещё и скрипты временные генерирует. «Полный стоооп» кричу ему в чат!
А он парень простой — мол, вы действительно хотите выполнить команду taskkill бла-бла-бла?
Да, говорю, и требую пояснений, смотрю десяток ключевых файлов из полусотни имеет нулевой размер. А он мене в стиле: ну понимаешь, папка лежала в ВанДрайве, а когда папки лежат в ВанДрайве, то так иногда бывает, я ни в чём не виноват, оно само. Короче он их как-то пролюбил, и пытался втихаря из каких-то неведомых глубин типа кэша вэ-эс-кода их достать.
И тут же — опа, лимиты кончились. Опера-балет в нескольких частях — пятичасовой антракт начался. Иду за кофе.
Хорошо, из истории ВанДрайва восстановил нулевые файлы, подождал пять часов, вернулись лимиты. Говорю ему — вот я файлы восстановил, всё перепроверь, мусор вынеси — надо готовиться стартовать дальше с ключевой точки.
Крутился-крутился, рапортует: «Всё сделаль, хазяин!». Проверяю — синтаксическая ошибка. Отправляю обратно, снова крутится-крутится, а потом — логическая ошибка при запуске обработки данных.
Показываю ему ошибки — говорит ой методология неправильная, теперь вот такая другая правильная, всё переделаю. Начинает переделывать, «НЕЕЕЕТ» снова кричу я, изначальная методология правильная, вертай всё взад.
Начал вертать, говорит, что почти-почти всё закончил, ошибку понял и… снова кончились лимиты.
Вот очередной пятичасовой антракт в опере-балете, где я кричу фальцетом, а он — танцует.
Два риторических вопроса:
Настоящие выводы:
Заманчиво звучит конечно:

Купил бы себе парочку ультимейтов на все 500$, но конечно же есть подвох, вопрос только какой.
Он простой: чтобы получить кэшбэк надо тратить от 500$ в месяц, а лимит на кэшбек 50$. Так что сильно много не выиграешь, дураков в таком маркетинге не осталось.
Вот купишь себе как дурак Google AI Pro на рождественской распродаже и смотришь как там у всех нормальных начинает всё пузыриться, как два лидера дерут друг-другу глотки в погоне. А ты стоишь как бедный родственник с немым укором во взгляде «а как же я?».
И вот наконец в этом году 15 минут славы, только что вышла Gemini 3.5 Flash, которая хоть какую-то надежду даёт, что компания вернётся в большую тройку. Вот в части программирования знатоки говорят только два варианта есть — Claude Code или Codex.
Почему 15 минут? Потому что оба лидера не дремлют, очевидно. В любой момент и OpenAI, и Anthropic анонсируют что-то ещё.
И что ещё более удивительно — Гугловцы взяли свой только недавно выпущенный Антигравити, этот комбайн с агентами, вижуал студией и встроенным браузером…
…и выкинули из него всё кроме чата. Встречайте Антигравити 2.0, вот такая ирония.
UPD. 24.05.2026. Всё-таки оказалось что нет, просто разделили это на два разных продукта, и второй продукт Антигравити ИДЕ выкатили несколько дней позже. Посмотрю ещё потом что осталось на месте, а что переделали.
UPD. 24.05.2026. Ещё не очевидно как это повлияет на так называемое SEO, но кажется мы наблюдаем закат эпохи.
Запустил компьютер, открыл окно чата, чёрненькое такое.
Вбил что хочу, получил ответ, вбил команду, процесс покрутился-покрутился, закончился, выкатился ответ, почитал ответ, вбил другую команду, ещё пара итераций, потом в потоке неожиданно выскочил вопрос (yes/no), ответил, можно хлебнуть кофе, готово, компьютер можно выключать.

Вот и вернулись на круги своя, 40 лет спустя, прорвавшись через все окошечки и менюшечки.
Вот только раньше промтом называли начало строки приглашения A:\>.
AUTOEXEC.BAT у нас был вместо системного контекста.
Из контекста у нас были переменные окружения и текущий путь.

Вообще очень удобно, Джемини может и не палить концовку, но можно и обсудить без спойлеров:
Читаю вторую книгу Колесо Времени. Очевидно, что Леандрин — это слуга тьмы. Но их там минимум две. В рамках второй книги это может быть спойлером?
А оно мне отвечает:
Да, это спойлер.
В рамках второй книги истинная суть Лиандрин подтвердится прямо по сюжету. Ваша догадка абсолютно верна.
Что касается вашей теории про «минимум двух» — любое подтверждение или опровержение личностей других потенциальных Приспешников Тьмы гарантированно испортит вам финал «Великой Охоты» и интригу следующих частей цикла. Роберт Джордан специально выстраивает повествование так, чтобы вызывать паранойю и сомнения в каждом персонаже.
Концовка второй книги расставит всё по местам и даст четкие ответы о том, кто именно служит Темному из текущего окружения героев. Лучше дочитать без поиска дополнительных подтверждений.
Хорошо, читаю дальше, уговорило.