AI Adopter | внедряю ИИ в жизнь


Гео и язык канала: не указан, не указан
Категория: не указана


🤖 AI adoption без хайпа
AI в работе, разработке и жизни:
агенты, SDLC, автоматизация, AI tools,
ошибки внедрения, кейсы и практика
🧠 Без нейрослопа
Автор: @michael_emelyanov

Связанные каналы

Гео и язык канала
не указан, не указан
Категория
не указана
Статистика
Фильтр публикаций


🤖 Сначала требования, потом код. Как это работает с AI на реальном проекте?

Идея Spec-Driven Development (SDD) простая: сначала фиксируем, что должно получиться, затем агент пишет код по спецификации.

Но сколько времени уйдёт на подготовку? И не придётся ли потом исправлять и код, и документы? 🙂

🔍 В блоге RuStore разбирают Spec Kit и OpenSpec на задачах реального Android-проекта. Интересный повод посмотреть, как SDD вписывается в повседневную разработку.

https://www.rustore.ru/developer/blog/spec-kit-i-openspec-v-realnom-android-proekte-testiruem-sdd-na-zadachah-rustore

Disclaimer Это не рекламный пост) Статья основана на реальном сравнении работы spec-фреймворков на задачах нашего Android-приложения. И получились интересные, которые спешим с вами поделится 😉




Ну что? Погнали 😎😁
#gpt


Выбор моделей потихоньку всё 👋

Наверное, у тех, у кого подписка


Поддерживаю 👍

Пользоваться моделями Anthropic в нормальном режиме, не попав в ежедневный лимит, стало невозможно. Это до выхода Fable 5.1 уже было. Мои нубские отчеты и парсинг, 5 скринов, 2 пдф, сжирает лимиты до 27-30% за сессию 🤣

И с этим надо что-то делать. 🚀

https://x.com/bridgemindai/status/2095906173270573363


Все любят OpenAI ❤️

Релиз GPT-6 Astra получился слегка через одно место: модель анонсировали, а доступ большинству платных пользователей сразу не дали.

Теперь OpenAI обещает за каждый день без доступа к Astra начислять по одному banked reset для Codex.

То есть можно сохранить reset и потом полностью обновить свои 5-часовой и недельный лимиты🥳

На фоне последних историй с Anthropic - подход прям заметно отличается 😏

https://x.com/thsottiaux/status/2095651088502591861

#новости


🎙️ Сегодня в 19:00 МСК выступаю на Podlodka AI Engineers Club с докладом «Как измерить реальный эффект AI в разработке, или иллюзия продуктивности». А к докладу выложил симулятор — интерактивную модель реального дашборда DX Core 4, на которой можно проверить, как метрики продуктивности работают друг с другом.

Как работает симулятор?

15 метрик, из них 9 складываются в сводный индекс. Двигаете любой ползунок — и видите, как он отзывается в сводных плитках: с каким весом входит, что тянет за собой и почему индекс иногда реагирует совсем не так, как ожидаешь.

💡 Главная фишка — конструкция индекса видна насквозь. У каждой метрики раскрывается «как считается», у каждой сводной плитки — «из чего складывается», а вклад каждого ползунка в общую цифру пересчитывается на лету. Сводная цифра перестаёт быть чёрным ящиком.

Что можно проверить:

📈 Веса индекса — DXI (балл из опроса разработчиков) весит 25% общей цифры, а частота релизов — 6,25%. Например: жмёте «DXI до Elite» — верхняя плитка прыгает вверх без единого лишнего релиза. Один балл опроса двигает индекс вчетверо сильнее релизов, и этого никто осознанно не выбирал.

🔍 Серые метрики — 6 из 15 метрик дашборда весят ноль. Например: Technical Debt Ratio можно утащить с 42% куда угодно — сводные цифры не шелохнутся. Половина площади дашборда не влияет ни на что.

✅ Готовые сценарии — от «всё лучше на 10%» до стресс-теста на накрутку: «Нарезали задачи мельче» даёт +57,8% «продуктивности» при неизменной работе, а тумблер защиты в панели ROI показывает, как формула чинится.

🧭 Своя база — выставьте ползунки под цифры своей команды, нажмите «Установить как базовые значения» — и гоняйте те же сценарии уже от своей отправной точки.

Если коротко:
сводный индекс — это конструкция из весов и формул, и прежде чем ему доверять, её стоит увидеть насквозь. Симулятор тут: https://michaem.github.io/dx4/

А про то, как индустрия дошла от DORA до AI Measurement Framework и как считать эффект AI без иллюзий, — сегодня на эфире. Приходите :)

#dxcore4


Opus 5 - дно👎

🤖 Вчера Opus 5 чуть не похоронил мне доклад. Весь вечер переделывал — расскажу, что пошло не так и какие правила я из этого вынес.

Контекст: готовлю выступление про метрики реального эффекта AI в разработке. Попросил Opus 5 собрать блок «находки из наших дашбордов». Он принёс красивое: «встречи рвут фокус в 11 раз чаще остального». Звучит как готовый слайд. Открываю сырой CSV опроса — 43% против 41%, почти вровень. Цифра родилась из пересказа отчёта, а не из данных.

Дальше хуже. Для «драматургии» Opus вписал кульминацию: «мы проверили свой дашборд — и он проверку не прошёл». В тексте эффектно, со сцены — обесценивает всё, что я показывал до этого.

💡 Корень один: модель оптимизирует на «впечатляюще», а не на «правда». Генерация правдоподобного текста всегда быстрее проверки, и в длинной сессии это копится молча — пока не откроешь первоисточник.

В итоге переключился на Fable 5 и прошёл с ним весь доклад послайдово: каждую цифру сверяли с сырым CSV и дашбордами, выдуманные «находки» выкинули, блок пересобрали на реальных данных. Задача сделана, но осадок остался 🙄

Что теперь в правилах работы с агентом:

1️⃣ Каждая цифра берётся только из первоисточника — сырой CSV, дашборд через MCP. Пересказ отчёта источником не считается.

2️⃣ Каждый слайд проходит тест «что это меняет для слушателя». Не проходит — вылетает.

3️⃣ Регрессионные проверки гоняются после каждой правки: пересборка речи из деки, замер хронометража. Иначе артефакты молча разъезжаются.

Если коротко:
Opus 5 отлично генерит и отвратительно проверяет. Его работу нужно перепроверять постоянно.

Сам доклад — 19 августа на Podlodka AI Crew, как раз про то, как мерить реальный эффект AI 🙂

#cluade #опыт


Ну что, как там Opus 5?😏 Пока не успел его затестить как следует🤓

Говорят, разрывает все модели последние. Не?😅

https://x.com/i/status/2080760629653102958


🏆Каждая неделя - новая модель

Гонка продолжается) Ждем выхода Opus 5😁

А тем временем, выигрывает в этой гонке не тот, кто заюзал ловко и быстрее новые модели, тот, кто эффективно выстроил харнесс тулинг (AI-ассистентов, агентов, автономность) вокруг личной жизни или рабочих процессов (в вашем SDLC, как угодно), благодаря которым, вы экономите свое/рабочее время и деньги😏

А по анонсу, не успел отупеть Fable 5, как появился анонс Опуса 5😂

https://x.com/i/status/2080115212821434639


Kimi-k3 распродано

Попробовал я хайповую китайскую модель, которая по слухам решает задачи как Fable 5. Ага😁👊

У Moonshot перегруз с инфрой, видяхами случился. На сайте в подписках Sold Out❌

Кто успел? Как вам модель?) Только честно)

https://x.com/i/status/2078958257138528373


Fable 5 в подписке

С 20 июля, всем у кого Anthropic подписка за 100/200 бачей, будет доступен Fable 5, но с такими же ограничениями по лимитам. 50% недельного иначе на Opus 4.8 уезжаете.

Новость классная. Мне Fable 5 зашёл, несмотря на то, что жрёт как не в себя.

Я комбинирую его с Opus 4.8 (с еффортом не меньше xhigh). Там где скиллы уже готовые - делаем на Опусе. Там где нужен анализ данных, отчетов - на Фейбл. Неизвестная задача, разработка с нуля проекта для тестов и т.д. тоже на Фейбле.

Тем не менее, у меня еще личные действия по финансам, здоровью и другим вещам духодит на ChatGPT 5.6.

В общем, многие хейтили Fable, на практике меня устраивает😎

https://x.com/i/status/2078302415804379218


Рейтинг человеков vs Fable 5

В какой из стран качество жизни самое лучшее?🤔 Таким вопросом задаются сейчас все чаще и чаще люди, учитывая мировые события.

И вот такой рейтинг появился з
https://naked-science.ru/community/1202032

В статье однозначно показываются, что скандиновские страны Европы прям - рай для человеков😁

Так ли это?
Ведь данные в статье крайне противоричивые. Казахстан прировняли к Ливану🤣 по уровню жизни. России так вообще там нет. Израиль с Бангладешом🤣

Чтобы разобраться в этом вопросе, я просто скинул на анализ Fable с max effort.😏

Первое, что он выдал, так это действительно, статья составлена неверно:

Согласен, у этого рейтинга есть фундаментальная проблема — и она не в том, что «Россию занизили», а в самой методологии 👇
Почему Wharton Best Countries — не про качество жизни:
📊 Это опрос восприятия: 15 131 респондент из 33 стран  (naked-science) оценивают 85 государств, в большинстве которых никогда не жили. Измеряется репутация/бренд страны, а не реальность
🇰🇿 Отсюда абсурд: Казахстан на уровне Ливана (где экономика рухнула в 3 раза с 2019-го), Беларусь рядом с Кенией
🔄 Скандинавский бренд самоусиливается: «все знают», что там хорошо → так и отвечают


Второе, Фейбл сам составил рейтинг, основываясь на публичных данных и таких сервисов, как numbeo.

В общем, вот ссылка

Забирайте. Посмотрите сами)


Fable 5 че там?

Сижу на Fable 5 уже неделю. Многие видели, да и писали, что доступ к нему продлили до 19 июля. Это видимо на фоне отмены лимитов у ChatGPT😁

Опыт с Fable пока нравится. Более лучше понимает задачу, делает точнее и сам перепроверяет.

Кажется, что Fable разрушает построенные SDD, т.к. модель достаточно быстро делает этапами сама, запускает воркфлоу там где надо, дает human-in-loop.

👉Я пока сделал задачи по сбору всех прршлых сессии на повторяющиеся действия и рутину. И Fablr обернул часть в скиллы, поставил их запуск по расписанию и протестил сам.

👉Вторая задача, делаю доклад с нуля. Поглядим.

В общем, клёво. Но конечно цена неадекватная пока.


OpenAI показали ChatGPT Work - агента для работы

💡 Что за Work?

ChatGPT Work - это агент внутри ChatGPT, который берет задачу целиком и доводит ее до готового результата: таблицы, презентации, документы, веб-приложения. Может работать над проектом часами, разбивая его на шаги и выполняя их самостоятельно. Под капотом технологии Codex и свежая GPT-5.6.

⚙️ Что внутри?

• Плагины - подключаете Slack, Google Drive, почту, CRM, и агент сам понимает, откуда тянуть контекст. Можно явно указать через @название
• Scheduled Tasks - повторяющиеся задачи по расписанию или по событию. Например, обновлять презентацию, когда на почту падает новый фидбек
• Sites (бета) - агент собирает интерактивные дашборды и внутренние порталы, доступные по ссылке
• На десктопе - встроенный браузер и Computer Use: агент сам кликает, печатает и двигает файлы

Из интересного - приложение Codex сливается с новым десктопным ChatGPT, старое переименуют в ChatGPT Classic. А браузер Atlas закрывают, не прожив и года - вместо него ChatGPT переезжает в сайдбар Chrome.

💸 Кому и почем?

Раскатка уже идет: сначала Pro, Enterprise и Edu, через несколько дней Plus и Business. Десктопное приложение доступно всем, включая Free. Важный нюанс: Work тратит лимиты по модели Codex - чем сложнее задача, тем больше съедает подписки.

📌 По сути OpenAI собрали все свои агентские наработки в один продукт и целятся прямо в офисную рутину. Идея та же, что у Claude Cowork от Anthropic - гонка агентов для работы официально открыта)

#новости
https://openai.com/index/chatgpt-for-your-most-ambitious-work/


Сегодня день - ChatGPT

OpenAI выпустила GPT-5.6 - теперь у моделей есть имена

После закрытого превью в общий доступ вышло целое семейство: Sol (флагман), Terra (баланс цены и качества) и Luna (самая дешевая). Цифра теперь означает поколение, а имена - уровни моделей, которые будут развиваться каждая в своем темпе.

Что внутри?

• Главная ставка релиза - не рекорды, а эффективность: больше пользы с каждого токена. На Artificial Analysis Coding Agent Index Sol показывает 80 баллов, тратя вдвое меньше токенов и времени, чем конкуренты

• Новый режим ultra - модель запускает четыре параллельных агента на одну задачу. Дороже по токенам, но быстрее и качественнее на сложных задачах

• Programmatic Tool Calling в API - модель пишет и запускает мини-программы, которые сами координируют инструменты и фильтруют промежуточные данные. Меньше раундтрипов, меньше токенов

• Заметный скачок в дизайне и работе с документами: модель теперь сама смотрит на отрендеренный результат и доводит его до ума, а не просто генерит код

💸 Цены за 1М токенов: Sol - $5 вход / $30 выход, Terra - $2.5 / $15, Luna - $1 / $6.

А что по-честному?

OpenAI в анонсе хвастается отрывом от Claude Fable 5, но их же собственные таблицы показывают картину интереснее: на Artificial Analysis Intelligence Index Fable 5 все еще впереди (59.9 против 58.9), на SWE-Bench Pro разрыв вообще серьезный - 80% против 64.6% в пользу Claude. Реальное преимущество GPT-5.6 - в цене и скорости, а не в потолке интеллекта.

📌 Тренд очевиден: гонка сместилась с "кто умнее" на "кто дешевле при том же уме". Для тех, кто внедряет AI в процессы, это лучшая новость года - фронтир-качество становится доступным по цене вчерашних середнячков.

#новости
https://openai.com/index/gpt-5-6/


Авторы AI 2027 выкатили сиквел - AI 2040: Plan A

Помните AI 2027 - тот самый сценарий, где гонка к суперинтеллекту заканчивалась либо вымиранием, либо концентрацией власти в руках пары человек? Команда AI Futures Project (включая экс-OpenAI Дэниела Кокотайло) вчера опубликовала продолжение. На этот раз - позитивное.

Важно: это не прогноз, а рекомендация. Авторы честно пишут - "так должно быть, а не так будет". Но каждый шаг расписан по годам, с механизмами и цифрами.

Как выглядит их план?

• 2029 - США и Китай договариваются не устраивать гонку к суперинтеллекту
• 2030 - полная автоматизация AI-ресерча была бы уже здесь, но сделка ее откладывает
• 2030-2035 - модели масштабируют медленно, до уровня топовых экспертов-людей
• 2035 - пауза, чтобы человечество сохранило контроль
• 2040 - снятие паузы и выход на суперинтеллект

На чем все держится?

Полная прозрачность AI R&D для всего мира, десятки компаний на фронтире вместо двух-трех, и режим "взаимно гарантированного уничтожения компьюта" - если кто-то жульничает, остальные могут вырубить его дата-центры. Звучит как холодная война, только про GPU )

📌 Главный тезис авторов: индустрия убедила себя, что контроль над суперинтеллектом "разберемся по ходу". Плана нет ни у кого. И даже если прогноз сработает - власть над армией супер-ИИ окажется у горстки людей.

📌 Читается как научная фантастика, но со сносками и экономическими моделями. Даже скептикам полезно - редко кто расписывает свои предположения настолько явно.

#новости
https://ai-2040.com


Продление Fable 5 по подписке до 12 июля

Антропик продлил доступ к самой умной модели Fable 5 с 7 июля до 12го.

Правила теже: 50% недельного лимита можно использовать Fable, дальше либо за кредиты отдельно, либо переключится на другую модель.

И тут многие в каналах ИИ раздают советы, как успеть потратить лимиты, если нет конкретных проектов и задач под него у вас.

Например,

👉Попросить саммаризировать всю вашу работу по всем сассиям Claude Code и выявить: неоптимальности, неэффективности, рутину, что можно в скиллы унести.

Или,

👉Разработать игру в некой симуляции мира с вашей идей
Правда там в лимиты можно точно уйти и игра получится всратая казуальщина. Но попробовать можно)

А какие у вас идеи есть, как потратить лимиты Fable 5 бесплатно до 12 числа?🤔


Видео недоступно для предпросмотра
Смотреть в Telegram
Gamma теперь прямо в ChatGPT - забираем и юзаем

Gamma - сервис, который из текста собирает готовые презентации: раскладывает по слайдам, подбирает визуал, оформление. Раньше был отдельным сервисом, теперь завезли прямо в ChatGPT.

📌Я очень много делаю презентации, поэтому Гамму попробую обязательно. До этого гонял презы в Claude Design на Опусе 4.8 - там до чистого результата уходило по многу итераций.

Как подключить?
⚙️ Settings → Apps
🔍 В каталоге ищем Gamma: Create presentations and docs
🔌 Жмёи Connect - без API-ключей и доплат за подписку Gamma
💬 В чате/сессии просто просим - "сделай из этого текста презентацию"

На выходе ChatGPT собирает структуру и текст, Gamma - визуал. Получаем черновик, а не финал: цвета, лейауты, графику доводишь уже в редакторе Gamma.

Работает и в Claude тоже😁 Тот же коннектор, та же логика.

#новости


OpenAI открывает превью GPT-5.6 🚀

Три модели одной линейки: Sol - флагман, Terra - баланс цена/качество, Luna - самая быстрая и дешёвая. Terra по возможностям примерно на уровне GPT-5.5, но в 2 раза дешевле. Luna даёт неплохие возможности по самой низкой цене в линейке.

На что натаскивали Sol?
💻 Agentic coding - новый рекорд на Terminal-Bench 2.1 (командная строка, планирование, координация инструментов)

🧬 Biology/genomics - на GeneBench v1 результаты лучше, чем у GPT-5.5, и при этом меньше токенов на выходе

🔐 Кибербезопасность - на ExploitBench результаты сравнимы с Mythos Preview (это модель Anthropic), но Sol тратит примерно в 3 раза меньше output-токенов

Из новых режимов: max reasoning effort - для более глубокого рассуждения, и ultra mode - модель разбивает сложную задачу между subagent'ами(!), а не тянет всё в одиночку.

Почему такой осторожный релиз?
Модель ощутимо мощнее прошлых, поэтому у OpenAI самый жёсткий safety-стек за всю историю - многослойная защита: сама модель обучена отказывать на попытки jailbreak, плюс классификаторы в реальном времени, плюс ревью на уровне аккаунта при подозрительной активности. По их оценке Sol не пересекает Cyber Critical threshold: на тестах с Chromium и Firefox модель находила баги и "строительные блоки" для эксплойтов, но собрать рабочий full-chain exploit сама не смогла.

Интересно, что ограниченный доступ (пока только API и Codex, только для отобранных партнёров) - это не только перестраховка самой OpenAI. Список партнёров согласован с американским правительством, релиз идёт поэтапно по их просьбе, в рамках работы над будущим cyber Executive Order. Сама OpenAI пишет, что не хочет, чтобы такая практика стала нормой - но пока идут на это как на "самый быстрый путь к широкому релизу".

Цены и доступность
💸 Sol: $5 / $30 за 1M токенов (вход/выход)
💸 Terra: $2.5 / $15
💸 Luna: $1 / $6

Плюс в июле - Sol на железе Cerebras, скорость до 750 токенов/сек, тоже сначала для узкого круга клиентов.

Полный публичный релиз обещают "в ближайшие недели" ))

#новости
https://openai.com/index/previewing-gpt-5-6-sol/

Показано 20 последних публикаций.