Neural Links


Гео и язык канала: Весь мир, Русский
Категория: Искусство


Изображения от нейросети stable diffusion с описанием (promt)

Связанные каналы

Гео и язык канала
Весь мир, Русский
Категория
Искусство
Статистика
Фильтр публикаций


Репост из: Метаверсище и ИИще
Офигенный новый пост от Андрея Карпатого. Грех его не разобрать.

Потому что, наверное, многих из вас немножко приподдостала многословность, по крайней мере SOL 5.6, и необходимость просить его сокращать и вообще выдавать ему разные инструкции.

А тут сразу о том, как сразу получать хорошо и не только текстом, а "мультимедийно".

Пойду ваять системный промпт.

Дисклаймер: это не для написания литературных текстов и креативов. Это для объясняторов и помогаторов.

Смысл поста не в ASD-STE100 (см ниже). Он предлагает гораздо более интересную идею: перестать воспринимать текст как основной формат ответа LLM.

Его иерархия:

текст -> схема -> интерактивная HTML-страница -> персональное объясняющее видео.

И чем сильнее становятся модели, тем чаще кожаный будет не сам “делать работу”, а проверять, понимать и направлять результат. Поэтому формат, в котором модель объясняет свою работу человеку, становится почти так же важен, как качество самой работы.

Что такое ASD-STE100

Андрюша пишет, что просто попросите: “Explain this in ASD-STE100”

ASD-STE100 Simplified Technical English - реальный стандарт контролируемого английского языка. Его начали разрабатывать для авиационной технической документации, чтобы инструкции одинаково хорошо понимали специалисты с разным уровнем английского.

Там довольно жесткие механические правила:

- словарь примерно из 900(шта?) разрешенных общеупотребительных слов плюс специализированная техническая терминология;
- по возможности один термин -> одно значение;
- вместо цепочки синонимов выбирается одно слово, например start, а не begin / commence / initiate;
- максимум 20 слов в процедурном предложении и 25 в описательном;
- максимум 3 слова в noun cluster;
- в процедурных инструкциях используется active voice;
- ограничен набор допустимых форм глагола;
- один шаг или инструкция должны быть сформулированы максимально однозначно.

Можно смягчать, чтобы не разговаривать с робатом:

“80% of the way to ASD-STE100”

Идем дальше. Мультимедия: diagrams -> HTML -> video

Здесь Андрюша фактически описывает переход от LLM как генератора текста к LLM как генератору интерфейса объяснятора.

Например, вместо ответа на 3000 слов модель может сама решить, что конкретную тему лучше показать через:

* интерактивный(!) график
+ slider
+ несколько переключателей
+ анимацию
+ короткие пояснения

И сгенерировать для этого одноразовую HTML-страницу.

Раньше писать специальное приложение, чтобы объяснить кожаным один вопрос, было абсурдно дорого. Теперь его можно дажененавайбкодить, а просто попросить за минуту и выбросить после одного использования.

Это он называет “large, custom, discardable software artifacts”.

Мне кажется, это центральная мысль поста.

Короче:

> “Объясни мне трансформеры”

> Апажалуйста! На тебе одноразовый интерактивный учебник именно для тебя, после прочтения можешь выбросить. Следующий будет новее и лучше.

На итоге: Сам ответ может быть не текстом, как мы привыкли, а приложением, симуляцией, схемой или видео.

Остается одна проблема. Кожаный должен во все это вникнуть и понять. А кожаный ленив и туп. Никакой разжеватор не поможет. Поэтому остается вопрос: а может вы за меня и понимать будете?

ПС. Русский вариант в след посте.

@cgevent


Репост из: Dasha’s notes | люди и смыслы
ai_adoption_guide.pdf
1.6Мб
⚡️ Практический гайд по AI-adoption для руководителей

Ну что, готов горячий пирожок — мой гайд о том, как внедрять AI в ежедневную работу команд.

За последний год разговор про AI внутри компаний сильно изменился. Нам нужно понять, как сделать так, чтобы новые инструменты действительно вошли в работу, и задача руководителя здесь — помочь своим людям, создать нужную среду, дать доступ к инструментам, научить, самому стать примером.

Меня в процессе AI-adoption мотивирует вот какая мысль одного моего коллеги: ИИ всё усиливает, и хорошее, и плохое, и порядок, и хаос. Если в команде понятные процессы, нормальные доступы, сильная экспертиза и культура обмена знаниями — AI может всё это заметно усилить. Если процессы разваливаются, контекст живёт в головах, а инструменты выдаются как попало — массовый adoption, скорее всего, просто масштабирует этот хаос.

Поэтому гайд — рабочая карта того, как помочь своей команде освоиться в новой рабочей реальности, где умение работать вместе с ИИ уже стало базовым навыком. Мы в Яндексе сейчас проходим этот путь в очень большом масштабе. Что-то уже умеем делать системно, какие-то первые подходы пришлось пересобрать, а часть практик всё ещё проверяем на ходу.

В гайде я собрала то, что оказалось полезным у нас:
— с чего начинать adoption в команде;
— как искать первые рабочие кейсы;
— зачем нужны AI-champions и амбассадоры;
— почему обычное обучение часто не работает;
— какие инструменты и условия нужны людям;
— что имеет смысл измерять, а что легко превратить в бессмысленный KPI.

Там, где это полезно, добавила практики других технологических компаний — как ещё один способ сравнить подходы.

Гайд адаптирован для чтения с мобилки, навигация по разделам кликабельная.

Без смс, без ботиков, только за ваши сердца 💙

@technohumanist


Репост из: Метаверсище и ИИще
Stem Studio

Опенсорсная штуковина для разделения звукового (или звука из видео) файла на диалоги, музыку и шумы.

Это если вам с площадки прилетела запись, где все вместе.

На входе звук, на выходе:
🗣 Dialogue
🎼 Music
💥 SFX

Все в WAV.

https://github.com/wassermanproductions/stem-studio

@cgevent


Репост из: mimagie
NBP_R&D_part2_2026_air.pdf
45.2Мб
Сделали исследование возможностей NBP. Все картинки сделаны чистым t2i.

Исследование показывает, что Nano Banana Pro предлагает фундаментально иной подход к созданию стиля по сравнению с функцией SREF в Midjourney. NBP использует семантическую деконструкцию, что позволяет управлять «ДНК» изображения.

Высокая точность в коммерческой эстетике:
NBP продемонстрировал способность различать тонкие нюансы текстур и создавать сложное освещение.

Работа со светом как инструментом нарратива:
В отличие от простых фильтров, NBP успешно интерпретирует сложные схемы смешанного освещения . Модель корректно воспроизводит температурные контрасты для создания кинематографического напряжения и драматизма.

Геометрия и физика сцены:
Для сюрреалистичных и концептуальных задач NBP показал способность выстраивать сложные пространственные композиции , строго следуя логике сцены.


Black Forest Labs представляет FLUX.2 [klein] — быструю ИИ-модель для генерации и редактирования изображений профессионального качества менее чем за одну секунду.

https://bfl.ai/models/flux-2-klein

https://huggingface.co/black-forest-labs/FLUX.2-klein-base-4B
https://huggingface.co/black-forest-labs/FLUX.2-klein-4B

https://huggingface.co/black-forest-labs/FLUX.2-klein-base-9B
https://huggingface.co/black-forest-labs/FLUX.2-klein-9B

* Модель FLUX.2 [klein] 9B является дистиллированной версией для высокого качества на субсекундной скорости.
* Для работы FLUX.2 [klein] 9B требуется 19,6 ГБ видеопамяти для локального вывода на оборудовании.
* Недистиллированная базовая модель 9B предлагает максимальную гибкость и контроль, идеально подходя для тонкой настройки.
* Базовой модели FLUX.2 [klein] 9B для работы требуется около 21,7 ГБ видеопамяти (VRAM).
* Вариант модели 4B является самым быстрым в семействе Klein и создан для интерактивных приложений.
* Для запуска модели FLUX.2 [klein] 4B требуется примерно 8,4 ГБ видеопамяти (VRAM).
* Существует вариант 4B Base для локального развертывания на оборудовании с ограниченными аппаратными ресурсами.
* Модель FLUX.2 [klein] 4B Base использует для своей работы 9,2 ГБ видеопамяти (VRAM).
* Модели 4B и 4B Base выпускаются под разрешительной лицензией Apache 2.0, способствующей открытому использованию.
* Более крупные модели 9B и 9B Base используют более строгую некоммерческую лицензию FLUX.
* Утверждается, что модель более чем на 30% быстрее любой из конкурирующих на рынке моделей.
* Веса всех вариантов моделей FLUX.2 [klein] доступны для скачивания на платформе Hugging Face.
* Исходный код и примеры реализации проекта опубликованы в открытом доступе на платформе GitHub.
* Компания предоставляет интерактивную «песочницу» (Playground) для тестирования модели без необходимости регистрации или настройки.
* Для коммерческого использования моделей требуется отдельная лицензия, условия которой доступны на сайте компании.


Репост из: Нейросети без дураков
Обнаружил, что Gemini может делать прикольные портреты на основе ваших селфи 😂

Получился слегка толстоват, но надо отдать должное, мешки под глазами исчезли))) Я использовал номер 4️⃣

Заходите на сайт Gemini (можно даже ничего не платить) и закидываете в него один из промптов, которые мне нагенерил ChatGPT. Когда будете фоткаться, встаньте напротив хорошего источника света, так результат будет лучше

©️Профессиональное и корпоративное фото

1️⃣Руководитель

"Сначала попроси у меня селфи. Преобразуй моё селфи в чёткий, профессиональный портрет уровня руководителя, подходящий для профилей C-suite в LinkedIn. Освещение — драматичное, но деловое, с мягкими тенями. Моя осанка уверенная и дружелюбная; на мне тёмно-синий пиджак. Фон — современный корпоративный офис с окнами «от пола до потолка», слегка размытый."


2️⃣Юрист

"Сначала попроси у меня селфи. Преврати моё селфи в резкий, авторитетный портрет, идеальный для партнёров юрфирм и правовых каталогов. Освещение — классическое и вне времени, с контролируемыми тенями. Выражение — серьёзное, но доброжелательное; плечи ровно и прямо к камере. Фон — традиционный кабинет с панелями из красного дерева и книжными полками, элегантно размытый."


©️Для нетворкинга

3️⃣На hh.ru

"Сначала попроси у меня селфи. Преврати моё селфи в располагающий портрет для Head Hunter, который буквально говорит: «возьмите меня на работу прямо сейчас». Освещение — естественный дневной свет с мягким, ровным покрытием. Улыбка искренняя и уверенная, взгляд прямо в камеру. Фон — светлое, современное коворкинг-пространство с растениями и природными элементами, профессионально размытое."


4️⃣Эксперт в отрасли

"Сначала попроси у меня селфи. Преврати моё селфи в портрет эксперта, подходящий для подкастов и медиа-интервью. Освещение — телевизионного качества с профессиональной постановкой. Манера — знающая и чёткая, осанка — готовая к выступлению. Фон — профессиональная студия или вещательная среда, кинематографично размытая."


©️Творческие специалисты

5️⃣ Художник / Креативный профессионал

"Сначала попроси у меня селфи. Преврати моё селфи в художественный портрет для креативного портфолио и галерей. Освещение — атмосферное и драматичное, с художественными тенями. Выражение — созерцательное и вдохновлённое, в глазах — креативность. Фон — арт-студия с полотнами и инструментами, художественно размытая."


6️⃣Контентмейкер

"Сначала попроси у меня селфи. Преврати моё селфи в эффектный портрет инфлюенсера — для коллабораций с брендами и спонсорских предложений. Освещение — оптимизированное для соцсетей, с аккуратным улучшением кожи. Вайб — трендовый и вовлекающий, выражение — естественно фотогеничное. Фон — стильная локация в духе Instagram* с эстетичными деталями, красиво размытая."


©️Здравоохранение и помощь

7️⃣Медицинский специалист

"Сначала попроси у меня селфи. Преврати моё селфи в заслуживающий доверия портрет медицинского работника, идеально подходящий для сайтов клиник. Освещение — чистое и «клиническое», но тёплое и располагающее. Выражение — заботливое и уверенное, передающее профессионализм. Фон — современный медицинский офис с деликатными медицинскими деталями, профессионально размытый."


8️⃣Терапевт / Консультант

"Сначала попроси у меня селфи. Преврати моё селфи в портрет терапевта, который сразу дарит чувство безопасности. Освещение — мягкое и уютное, с естественным теплом. Образ — спокойный и эмпатичный, взгляд — понимающий и поддерживающий. Фон — спокойный кабинет терапии с растениями и умиротворяющими цветами, мягко размытый."


©️Бизнес и предпринимательство

9️⃣Предприниматель / Стартап

"Сначала попроси у меня селфи. Преврати моё селфи в портрет предпринимателя, привлекающий инвесторов и партнёров. Освещение — визионерское и амбициозное, с тенями, акцентирующими ощущение успеха. Образ — инновационный и целеустремлённый; взгляд отражает деловую хватку. Фон — офис стартапа или современная бизнес-среда, деликатно размытая.


* Instagram принадлежит компании Meta, признанной экстремистской и запрещённой на территории РФ

Скидывайте в комменты, что у вас получилось😂


Репост из: Джимми Нейрон 🚀
Ideogram Character

Идеограм выпустил Characters — модель, которая работает только с одним эталонным изображением. Загружаете изображение (или делаете селфи), прописываете промпт и получаете другие фотографии. Можно воспользоваться готовыми шаблонами на сайте.

Попробовать можно бесплатно здесь.

Первые впечатления:
🔹Лицо подхватывает очень хорошо, нет мыльности (как у flux или higgsfield), не плавит лицо как Миджорни и ChatGPT.

🔹Т.к. я не не использовал референсы, а только текстовые промпты, результаты получились похожими на фотосессию на фоне фотообоев (впрочем, генерации можно отредактировать в фотошопе, как обычные фотографии). Нейросетевые референсы, которые вы можете сделать в других нейросетях — залог успеха.

🔹Результат генерации напрямую зависит от качества исходного изображения (с селфи у меня получилось не очень).

Классная штука, чтобы создать другие ракурсы вашего персонажа (или сделать гламурную фотосессию для Шрека). Еще подойдет мужикам, у которых есть ровно одна хорошая фотка.


Suno 4.5+ — кайф. 😮

Давайте поговорим про функцию Cover в Suno. Точнее, послушаем. Сделал мини-альбом каверов на опенинг из старого мультика про Черепашек-ниндзя.

Если коротко: Cover — круто. Загружаете мелодию / трек / напев с микрофона, крутите настройки, пишете промт — и у вас качественный кавер в любой аранжировке за минуту. Если бы я был музыкантом — сочинял бы черновики и сразу прогонял их через Cover, чтобы протестировать разные ходы, а потом писал на чистовую.

Несколько особенностей по моим тестам:

1) Не даёт загружать известные треки и тексты.

Но, например, русский рок за "известную музыку" особо не считается.
Если ругается на текст — попробуйте заменить некоторые буквы на фонетически близкие или убрать один куплет.

2) Настройки. Есть три ползунка:

🥴 Weirdness — лучше не трогать или понижать.
Выше 50% — и начинается каша.

😎 Style Influence — влияет на силу промта.
Для каверов хорошо работает диапазон 80–100%.

🎧 Audio Influence — определяет, насколько кавер будет близок к загруженному аудио по структуре и мелодике. Здесь всё зависит от жанра и задачи.
У меня хорошо работало в диапазоне 10–50% — чтобы модель интерпретировала по-своему, но сохраняла узнаваемость оригинала.

Естественно, только в платной подписке (но это того стоит). 🙃

P.S: Почему-то при репосте поста с приклеенным аудио не отображается канал. Знайте, что он из Ai molodca. Ну и подписывайтесь!


Репост из: Миша, давай по новой
Видео недоступно для предпросмотра
Смотреть в Telegram
🙃 Как сгенерировать продуктовое видео товара бесплатно

Есть такая нейронка, Vidu называется. В ней после регистрации можно сделать 5 видео бесплатно в разрешении 1080p, а потом каждый месяц делать до 10 видосов в 720p. Что самое крутое — в нейронку можно загрузить несколько картинок и сгенерировать из них видео. Например, загрузить персонажа, какой-то предмет и локацию — нейронка все это объединит и сгенерирует видео. При этом сделает это в хорошем качестве и с нормальной анимацией.

Попробовать тут

Миша, давай по новой


Репост из: Метаверсище и ИИще
Кто устал ломать глаза в ComfyUI, прикручивая Flux Kontext, - есть первые экстеншены для Forge + Kontext:

https://github.com/DenOfEquity/forge2_flux_kontext

@cgevent


Репост из: Метаверсище и ИИще
Видео недоступно для предпросмотра
Смотреть в Telegram
Фоновая музика для ваших нейропрожарок.

MurekaAI, конечно, не Suno.ai, но они выкатили любопытную (продуктовую) фишку.
Вгружаете туда свой\чужой трек - Мурека делает из него чисто инструментальный трек, подходящий под фон к вашему видео. Этакий фоновый нейрокавер по вайбу на инструментале.
Понятно, что за музику для лифтов и торговых центров мы уже давно выпили, теперь очередь за фоновыми подкладками для ютюб-видосов.

https://www.mureka.ai/

@cgevent



Показано 12 последних публикаций.