Гриненко про ИИ, бизнес и образование


Гео и язык канала: Весь мир, Русский
Категория: Технологии


Владимир Гриненко — ex-CTO Яндекс ID про переход из найма в свое дело и про то, как ИИ меняет правила игры. https://grinenko.pro

Связанные каналы

Гео и язык канала
Весь мир, Русский
Категория
Технологии
Статистика
Фильтр публикаций


#ГриненкоПро №27: мультиагентный spec-driven development на OpenSpec с Киром @geekylog Белевичем

https://www.youtube.com/watch?v=nntQKlHS-z4

Задача состояла в том, чтобы сохранить гарантию качества, но перестать читать код за агентами.

В выпуске на примере разработки редактора markdown-файлов разбираем, как Киру удалось с этой задачей справиться и какие модели он использует в своем пайплайне, чтобы не переплачивать за токены.

Ставьте лайки, делитесь с друзьями, подписывайтесь на Кира @geekylog и приходите обсудить в чате сообщества: @grinenko_pro

Приятного просмотра!

@devspotting


AI-харнессы, мультиагенты и собственный язык нейросетей в восьмом выпуске «ИИ — не новостей» с Сергеем @veged_and_code Бережным

— Почему модель показывает радикально разный результат в зависимости от харнесса — и где вообще заканчивается модель и начинается её «обвязка»?
— Кафетерий для агентов, общий контекст и собственный язык
— Почему тексты нейросетей всё равно часто узнаются с первых абзацев и помогают ли промпты, персонализация и многоступенчатые редакторские пайплайны действительно писать лучше?

Поставьте лайк, поделитесь видео с друзьями и сами не забывайте подписаться, чтобы не пропустить новые не новости!

@devspotting


AI-harness на чистом CSS

Zero JavaScript. Zero dependencies. Zero intelligence.

@devspotting


Вышел Sonnet 5.5

Ожидаемо лучше, быстрее и дешевле предшественника.
Более того, по замерам Антропиков даже лучше Opus 5.5 в agentic coding (хотя и уступает по остальным бенчам).

Скоро обещают хайку.

А завтра DevDay у OpenAI — если уж лаборатории договорились замедлиться, то кто ж их остановит?

@devspotting


#ГриненкоПро №26 с Никитой Уманским — тимлидом из Барселоны

https://www.youtube.com/watch?v=olVSVppq5hw

Обсуждаем:
— Как выглядит разработка, когда Claude Code получает контекст из Jira, Figma, backend-репозитория и дизайн-системы
— Почему даже хороший агентный пайплайн всё ещё требует проверки человеком на каждом этапе
— Что такое нейрослоп и почему AI может ускорять рост технической энтропии
— Почему программист превращается в тимлида собственной команды субагентов
— Как AI изменил собеседования и какие навыки теперь важнее алгоритмических задач
— Что останется от профессии программиста, если следующий уровень абстракции действительно станет похож на компилятор

Ставьте лайки, делитесь с друзьями, приходите обсудить в чате сообщества: @grinenko_pro

Приятного просмотра!

@devspotting

1.1k 0 14 24 13

Репост из: HardFest
Видео недоступно для предпросмотра
Смотреть в Telegram
Закон Конвея работает даже на нейронках: собрали агентный пайплайн, а получили копию своей команды, только на созвонах теперь сгорают токены, а не люди.


17 октября на HardFest в Екатеринбурге вместе с Владимиром Гриненко разберемся, что измерять, где искать узкие места и как заставить агентов работать на команду, а не создавать вам ещё одну👾


В OpenCode в рамках OpenCode Zen на неделю появилась новая бесплатная мультимодальная стелс-модель Space Bunny с 1М контекста.

На реддите предполагают, что китайская, хотя по Spece в названии можно было и Grok заподозрить.

Обещают Zero Data Retention, верим? Впрочем, дареному кролику в уши не смотрят (а в Китае, говорят, кролик живет на луне). Надо брать, пока дают.

@devspotting


Обсуждаем Jev в седьмом выпуске «ИИ — не новостей» с Сергеем @veged_and_code Бережным

Кроме того, обсудили:
— Почему чата, терминала и Markdown уже не хватает для работы с AI-агентами?

— Разбрали кастомные интерфейсы под конкретную задачу, Astra, автоматический монтаж в DaVinci Resolve и момент, когда проще попросить агента нарисовать себе UI.

— Откуда взялись разговоры про «10% вероятности вымирания человечества»?

Поставьте лайк, поделитесь видео с друзьями и сами не забывайте подписаться, чтобы не пропустить новые не новости!

@devspotting


#ГриненкоПро №25 с Анастасией Бианко, руководителем отдела подбора персонала в Циан

https://www.youtube.com/watch?v=i2fExyLLke4

Обсудили что происходит на рынке IT, судьбу джунов, фальсификации опыта, автоматизацию найма, AI-интервью и что повышает шансы кандидата.

В выпуске:
— почему кандидатов стало так много, а дефицит сильных специалистов при этом никуда не исчез
— как работодатели распознают накрученный и полностью выдуманный опыт
— почему рекомендации, профессиональная репутация и прямой контакт с компанией снова важны
— что произошло с наймом джунов и почему от студентов теперь ждут гораздо большего
— нужно ли указывать конкретный стек, если с нейронкой можно быстро освоить новую технологию
— как Циан использует ИИ для фильтрации резюме и интервью со стажёрами
— какие AI-навыки уже стали гигиеническим минимумом для кандидата
— заменит ли ИИ рекрутеров и как может выглядеть автоматизированный найм ближайшего будущего
— почему компании пока продолжают нанимать роли, а не «универсальных продуктовых инженеров»
— чем культура найма в Циан отличается от Яндекса

Ставьте лайки, делитесь с друзьями, приходите обсудить в чате сообщества: @grinenko_pro

Приятного просмотра!

@devspotting

1.1k 1 15 14 15

Аркадий, а что мы ускорили?

Помните Аркадия, которого мы просили убрать руки с клавиатуры?

Допустим, Аркадий справился. Перестал лично вайбкодить каждую задачу, выдал команде агентов и теперь смотрит на результаты: пулл-реквестов стало больше, однако фичи до пользователей быстрее не доезжают.

Как же так-то? А задача три дня ждала уточнения требований, потом неделю лежала на ревью, а потом выяснилось, что смежники вообще планировали другое.

Зато код сгенерили, пока играли в падел.

Как раз про это будет Avito.Tech.Conf 26 сентября, о которой я уже рассказывал: как меняется сетап команды с AI-агентами и как на практике расти без роста штата.

Можно прийти со своей историей про «код ускорили, а дальше что?» — на конференции будет мастермайнд с разбором управленческих проблем.

Участие бесплатное, офлайн в Москве в AG Loft или онлайн с трансляцией докладов. Если узнали в Аркадии себя или свою команду — регистрация здесь.

@devspotting


На OpenRouter очередная бесплатная стелс-модель — Union Alpha.

UPD: лавочка закрылась, модель оказалась роутером над неизвестным набором чужих моделей.

Заточена под агентную разработку, понимает картинки на вход.

Результаты неофициальных прогонов Terminal-Bench лучше GPT-5.6 Sol и очень близки к Claude Opus 5 (но верить им пока рановато).
Вероятно, очередная Kimi или GLM.

Традиционно для стелс-моделей инференс медленный, а провайдер может сохранять запросы. Если это не пугает — есть смысл попробовать.

@devspotting


Шестой выпуск «ИИ — не новостей» уже на Ютубе (или на ваших любимых стримингах).

На этот раз мы с Сергеем @veged_and_code Бережным разбирались с нейродизайном.

Обсудили:
— как обеспечить консистентность генеренки через ограничения

— почему старый-добрый компонентный подход все еще рулит

— как избавиться от слопа с помощью мудбордов и ImageGen
и что такое Spec-Driven Development для дизайнеров.

Поставьте лайк, поделитесь видео с друзьями и сами не забывайте подписаться, чтобы не пропустить новые не новости!

@devspotting


But I'm likely human after all
I'm likely human after all
Don't put your blame on me
Don't put your blame on me

@devspotting


Недавно рассказывал, что указание агенту задавать недостающие вопросы может сильно повысить эффективность работы со спецификациями.

Но тут вышла статья IdeaAMBIG: Benchmarking Implementation-Critical Gaps in Research-Idea Specifications, где исследователи проверили способность моделей устранять критичные неоднозначности.

TL;DR для тех, кто не пойдет читать статью: пока что LLM с этим справляются так себе.

Агент может бесконечно задавать вопросы (иногда очень хорошие), но плохо понимает, какие из них действительно важны. Тогда как устранение неопределенностей принципиально влияет на результат — доля готовых к реализации спецификаций растет с 14% до 98% (в статье есть еще несколько подтверждающих тезис метрик).

Поэтому там, где важно получить полную спеку, есть смысл вместо «если постановка неоднозначна — сначала задай уточняющий вопрос» использовать что-то в духе:

Перечисли методологические решения, которые придётся принять при реализации. Для каждого укажи, следует ли решение однозначно из доступных требований. Если нет — укажи, какой информации не хватает и каким вопросом или поиском её можно получить. Не приступай к реализации, пока все пробелы не устранены.


И, возможно, стоит выделять на эту проверку отдельную роль рисерчера, чтобы избежать байаса у агента-исполнителя.

@devspotting

888 0 27 14 20

Видео недоступно для предпросмотра
Смотреть в Telegram


Разработка будущего

15 октября выступаю в Питере на Разработке будущего (отдельный день в рамках Joker).

Расскажу, как заставить агентов создавать интерфейсы по гайдам, как разработать дизайн-систему, если в команде нет дизайнера и как сохранить консистентность на больших проектах.

Организаторы констатируют, что эпоха конференций про «лучшие практики» закончилась и перепридумывают подход. Мы как раз обсуждали это с Лешей Федеровым в свежем выпуске «Гриненко про».

Разработка будущего — это конференция для тех, кто уже прошёл восторг от агентов и понял, что узкое место не в моделях и не тулинге вокруг них, а в человеке по эту сторону промпта.


Состав участников получился достаточно непохожим на конференции, где я обычно выступаю — см. скриншот в посте.
Конференция платная, но ребята подогнали промокод на персональные билеты для читателей моего канала: devspotting

Так что определенно будет интересно, буду рад встретиться!

@devspotting


В новом выпуске «ИИ — не новостей» с Сергеем @veged Бережным разбирались, как так вышло, что исследователи ИИ-агентов приходят к противоположным выводам (и почему оба правы).

А еще:

— Почему одна и та же нейронка сначала уверенно говорит, что задача не решается, а потом сама чинит её за 20 минут — и почему иногда «сделай хорошо» работает лучше подробной инструкции?
— Когда высокий reasoning помогает, а когда модель начинает сомневаться, ходить кругами и просто жечь токены?
— Почему AI-разработку почти невозможно нормально забенчмаркать и как работать в мире, где сегодняшняя best practice через две недели может оказаться анти-паттерном?
— И заодно: неужели нейронки всё-таки научились шутить?

Поставьте лайк, поделитесь видео с друзьями!

Приятного просмотра (или прослушивания, если вы слушаете нас на вашем любимом стриминге)!

@devspotting


OpenAI дропнули новенькую ChatGPT Images 2.5

Лучше сохраняет исходники (например, лица людей), лучшее умеет в логотипы и прочий дизайн, а заодно в 4 раза быстрее.

Ну что, дизайнеры, добро пожаловать в клуб? :)

@devspotting


Боб Мартин, автор «Чистого кода», уже несколько месяцев не проверяет код за агентами.

Объяснял он это тем, что умеет в автоматические ограничения и проверки: спеки, линтеры, измерение цикломатической сложности, разные виды автотестов, вот это вот всё.

Теперь он засомневался, нужны ли современным агентам такие строгие ограничения вообще. Говорит, модели стали астрономически лучше.

Если уже и дядя Боб (вслед за Андреем Мелиховым) движется от SDD к вайбкодингу, не пора ли готовиться к тому, что через полгодика будем разбирать мультиагентные пайплайны, которые сейчас многие активно строят?

@devspotting

1.4k 1 29 37 17

Мультиагентный пайплайн

Показано 20 последних публикаций.