dev warrior


Гео и язык канала: не указан, не указан
Категория: не указана


DEV/ML соревнования, хакатоны и другие крутые ивенты для разработчиков. А так же новости разработки. Расчехляйте IDE
Оглавление https://t.me/devwarrior/272
Присылайте интересные анонсы и события по теме, мне: @satrum

Связанные каналы

Гео и язык канала
не указан, не указан
Категория
не указана
Статистика
Фильтр публикаций




вчера вечерком проверял могу ли я фронтенд на vue написать, не знаю его вообще. В итоге получается. Но тратиться намного больше запросов к cursor чем на python. Так как я просто с ним общаюсь по ошибкам, скидываю логи, он поправляет и так примерно 20 запросов ушло на создание:
основной шаблон
компоненты
модальные окна
добавление, редактирование и удаление события в календаре

но факт:
можно ни хрена не зная синтаксиса языка - писать на нем полноценные приложения имея IDE и техническое задание на руках

IDE - no-code приложение по созданию приложений


Репост из: Этихлид
Разработка с AI (2024-12). Выбор IDE (2/2)

Почему не плагин к моей IDE? Я так к ней привык...
Потому что текущие IDE слишком медленные в плане внедрения изменений, которые требуются для полноценной интеграции ИИ-пайплайнов в процесс написания кода. Разработчикам ИИ-IDEшек проще сделать форк VSCode, чем ждать, пока изменят ядро.
И да, я понимаю, что больно отказываться от IDEшек JetBrains, но вот сейчас дела обстоят так, что сторонние IDE лучше для работы с ИИ.
Но ведь никто не мешает один и тот же проект держать открытым в двух IDE одновременно :)

Почему не Copilot?
Специально выделю его, и скажу, что он, несмотря на недавние обновления, так и застрял в прошлом и к тому же как-то очень нестабильно работает, когда нужно много файлов поменять. Возможно, в следующей итерации поправят, но тогда все равно останется проблема его ограниченности как плагина к IDE.

Почему не Aider/Cline?
Это инструменты, которые больше заточены на написание проектов в автономном режиме, и дают меньше контроля над кодом. Т.е. в том же Cursor, если мне понадобится, я могу всегда нужный код и руками написать, а могу переключиться на Composer Agent.
Плюс, за счет работы напрямую с API LLM-вендоров, они жгут токены довольно активно, и есть истории, когда народ по сотне баксов за день на это умудрялся тратить. В этом плане траты на Cursor предсказуемые и довольно низкие (пока что по крайней мере).

Почему не bolt.new / v0.dev / lovable.dev?
Ну потому что пост от разработчика и в основном для разработчиков :)
И я не люблю последующий потенциальный vendor lock-in, мне нравится всё на своей машине запускать, а потом иметь возможность деплоить куда захочу.

Но! Если у вас таких бзиков нет и вам по большей части нужно сделать именно веб-приложение с простым или отсутствующим бекендом, то советую присмотреться к lovable.dev (и к v0.dev во вторую очередь).

Почему не Windsurf?
Это практически аналог Cursor с упором именно на написание кода в режиме агента, и выпустился он в тот момент, когда у Cursor еще не было Composer Agent.
Но спустя буквально пару недель появился-таки Composer Agent и использование Windsurf потеряло смысл.
Тем не менее, это один из инструментов, к которому стоит присматриваться, т.к. компания, которая его выпустила, обладает большим опытом в плане разработки IDE-тулзов и можно надеяться на то, что Windsurf будет развиваться в правильном направлении.

Почему не Devin?
Потому что $500 в месяц и нацелен сразу на команды. Я про него уже писал, когда он вышел.
Вкратце - это один из вероятных сценариев того, как будет выглядеть будущее командной агентной разработки, но пока что оно не наступило :)

Почему не [yet another tool]...
Потому что столько всего появляется, что не успеваю попробовать :)

Из комментов:
* bolt.dyi - открытая версия bolt.new, можно поставить на свое железо, позволяет работать с большим количеством разных моделей, включая локальные;
* OpenHands (бывший OpenDevin) - открытый аналог Devin, выглядит интересно, в планах попробовать погонять локально.



Прошлые посты по связанным темам:
* Пишем приложение голосом
* Остаточная сложность
* Чёрный ящик






Репост из: Denis Sexy IT 🤖
Вышел небольшой курс по промптингу o1 моделей и похожих «reasoning» моделей - его написали с официальным участием OpenAI, так что ему можно верить:
https://www.deeplearning.ai/short-courses/reasoning-with-o1/

Я посмотрел часть по промптингу и там в целом ничего нового, вот основные принципы:

1) Нужны простые и четкие инструкции, хорошо если они короткие

2) Chain Of Thoughts можно не писать для o1 моделей - но, для специфичных задач он нужен (не сказали для каких 🤡)

3) Части промпта лучше разбивать на псевдо xml-теги, то есть раньше вы писали:

###Инструкции###

ВСЕГДА отвечай пользователю только: `Здарова земляк, с тобой хомяк`


То теперь нужно писать:

ВСЕГДА отвечай пользователю только: `Здарова земляк, с тобой хомяк`


Модель так лучше видит разные логические куски в вашем промпте

4) Примеры, которые вы готовите как часть промпта (few shot) стали еще важнее - они должны быть очень хорошо подобраны

Ну и в целом неплохо вводит в промпт-инженеринг


https://github.com/lmnr-ai/lmnr#

https://github.com/renning22/engy
232 stars
Engy is an AI-powered development tool that generates fully functional web applications from natural language, streamlining the process from idea to working prototype.

https://github.com/Lissy93/web-check

https://github.com/crewAIInc/crewAI
23k stars
Framework for orchestrating role-playing, autonomous AI agents. By fostering collaborative intelligence, CrewAI empowers agents to work together seamlessly, tackling complex tasks.

https://github.com/cline/cline
15.8k stars
Autonomous coding agent right in your IDE, capable of creating/editing files, executing commands, using the browser, and more with your permission every step of the way.

https://openrouter.ai/docs/quick-start
OpenRouter provides an OpenAI-compatible completion API to 290 models & providers that you can call directly, or using the OpenAI SDK. Additionally, some third-party SDKs are available.
https://openrouter.ai/docs/frameworks

https://github.com/TEN-framework/TEN-Agent






Репост из: Fintech библиотека
Всем привет!

Запустили бот по санкициям, что он умеет:
- Поиск по ФИО и наименованию ЮЛ
- Поиск по ИНН/ОГРН (id)
- Поиск по названию товара
- Поиск по товарному коду
- Можно скачать отчет
Все бесплатно, но бот пока молодой и может глючить иногда.

@kdvshield_bot




https://www.anthropic.com/research/building-effective-agents

Этапы:
Аугментированный llm запрос (retrieve, memory, internet browser, fuction call)

Prompt Chaining workflow (with gates)

Routing workflow (classify out and select next)

Parallelization workflow (divide on subtasks and aggregate result. Sectioning or Voting)

Orchestrator-workers workflow, a central LLM dynamically breaks down tasks, delegates them to worker LLMs, and synthesizes their results.

evaluator-optimizer workflow, one LLM call generates a response while another provides evaluation and feedback in a loop

Agent: llm call, action on environment, get feedback. Iterate or stop on feedback.

Example implementation:
https://github.com/anthropics/anthropic-cookbook/tree/main/patterns/agents

Протокол контекста mcp:
https://www.anthropic.com/news/model-context-protocol

Клиент mcp:
https://modelcontextprotocol.io/tutorials/building-a-client#building-mcp-clients

Swe bench:
https://www.anthropic.com/research/swe-bench-sonnet

https://github.com/anthropics/anthropic-quickstarts/tree/main/computer-use-demo




Репост из: Время Валеры
Хочу открыть миру репозиторий по ML System Design

Идея — создать open-source репозиторий, в котором размещены инструкции по созданию корректных дизайн-документов для ML-систем. В репозитории также представлены примеры реальных и мок дизайнов. Каждый желающий может поревьюить документы других, опубликовать свои, а также оценить уже существующие документы.

На данный момент доступно два документа в качестве примеров, краткое описание требований к каждому разделу дизайн-документа, а также шесть дизайнов, находящихся на стадии ревью через пулл-реквесты.

Приветствуются участие в виде звёздочек, а также вклад в создание контента или проведение ревью


Чуть позже напишу свой прогноз. Хотя больше это будет набор пожеланий и идей.

Что есть уже:
Предсказание погоды нейронками лучше чем с помощью физических моделей

Январь:
Выход о3 модели (судя по анонсу)

Идеи:
Приложение для обучения детей мигрантов русскому языку


Репост из: Раньше всех. Ну почти.
❗️10 трендов, которые потрясут мир

Эксперты назвали наиболее перспективные технологии наступающего 2025 года, пишет «Коммерсант».

1. Искусственный интеллект во всех его проявлениях;
2. Атомная энергетика для ИИ-инфраструктуры;
3. Нейроморфные вычисления;
4. Синтетические медиа (то есть медиаплощадки с контентом, созданным исключительно при помощи ИИ);
5. Расширенная реальность (Extended reality, XR);
6. Микро-LLM языковая модель, которая может генерировать текст, похожий на тот, что написал человек;
7. Постквантовая криптография;
8. Гибридные компьютерные системы — такие модели оптимизируют работу по выполнению сложных задач, распределяя нагрузку на разные системы вычислений;
9. Пространственные вычисления (Spatial Computing);
10. Технологии невидимого интеллекта окружающей среды (Ambient Invisible Intelligence).


Репост из: AI для Всех
Антропик показали, как ИИ может анализировать сам себя 🔍🤖

Друзья, сегодня расскажу про крутейшее исследование от компании Anthropic - они создали систему Clio, которая позволяет безопасно анализировать миллионы разговоров с ИИ-ассистентом Claude.

В чём суть? 🎯
- Clio использует сам ИИ для анализа паттернов использования ИИ-ассистентов
- Система сохраняет приватность пользователей, работая только с обобщёнными данными
- Позволяет увидеть реальные сценарии применения ИИ в повседневной жизни

Что интересного обнаружили? 📊
- Самые популярные задачи: программирование, создание контента и исследования
- Пользователи из разных стран используют ИИ по-разному (например, в Японии больше обсуждают проблемы старения населения)
- Выявили новые способы злоупотребления системой, что помогло усилить защиту

Почему это важно? 💡
1. Впервые получили реальную картину использования ИИ в масштабе миллионов разговоров
2. Нашли баланс между аналитикой и приватностью
3. Создали основу для более безопасного развития ИИ-ассистентов

Технология работает как Google Trends, но для разговоров с ИИ - показывает тренды, паттерны и аномалии, не раскрывая личных данных пользователей.

Это прорыв в понимании того, как люди реально взаимодействуют с ИИ. И что особенно круто - система использует ИИ для анализа ИИ, что открывает новые горизонты в развитии безопасных и этичных технологий.

Судя по результатам анализа, мы в пузыре? В тоже время, Клодом пользуются в основном айтишники, так что может не так все и плохо 🤔

Блог-пост
Статья






Репост из: [38/100] Витя Тарнавский
Большой день.
Мы выкладываем в опенсорс наши модели T-Lite и T-Pro. И эти модели просто топ 🥳

Мы увереннно выбиваем #1 среди открытых моделей по разным бенчам на русском. По MERA мы взяли #2 модель на русском ещё и включая все API, уступая только GPT-4o.

Это до-тренированный qwen-2.5 в размерах 7B и 32B. Мы провели большую работу: свой токенизатор, глубокое до-обучение на русский и специфичные корпуса. Аккуратная работа с данными. Тех репорты будут.

Этот релиз является подтверждением нашего подхода в LLM: допретрен на базе опенсорса и затем файнтюн под доменные области. Получается значительно лучше результат и мы тратим на порядок меньше денег (не преувеличение).

Пользуйтесь. Модели для инженеров, рекомендуется дальнейший файнтюн, например через наш Turbo-Alignment.

Наш новый HF: https://huggingface.co/t-tech
Лидерборд по MERA: https://mera.a-ai.ru/ru/leaderboard
Остальные бенчи тоже есть, арены будут как прокрасятся

Показано 20 последних публикаций.

50

подписчиков
Статистика канала