Нейросети | Вайбкодинг | GenAI


Kanal geosi va tili: Butun dunyo, Ruscha


Нейросети, Вайбкодинг, AI-генерация. Максимум практики: учимся создавать, генерировать и экспериментировать с ИИ. Новости про AI (ИИ). От идеи до первых клиентов за выходные.
По сотрудничеству: @lostpage

Связанные каналы  |  Похожие каналы

Kanal geosi va tili
Butun dunyo, Ruscha
Statistika
Postlar filtri


Собрали подборку психологических тестов, которые помогут лучше понять себя

Практикующий психолог рекомендует начать с этих пяти:
1. Тест Бравермана — показывает, какой нейромедиатор сильнее влияет на особенности вашего мышления и поведения.
2. Эгопрограмма по Эрику Берну — помогает определить, какое эго-состояние чаще управляет вашими решениями.
3. PAEI — определяет ваш стиль работы и сильные стороны в достижении целей.
4. Тест Белбина — показывает, какую роль вы обычно занимаете в команде.
5. Тест на темперамент — помогает понять, как вы реагируете на стресс, принимаете решения и взаимодействуете с людьми.

Все тесты доступны онлайн и проходятся всего за несколько часов.




OpenAI показала 10 математических открытий, сделанных новой моделью Astra

Внутренняя версия следующей крупной модели OpenAI решила (https://openai.com/index/ten-advances-in-mathematics/) или существенно продвинула сразу 10 сложных задач, над которыми математики работали годами.

Среди результатов есть доказательство существования не-софических групп, опровержение гипотезы Конна, новые границы для упаковки сфер и кодов, а также решение трёх задач Эрдёша.

Модель также получила новые результаты в квантовой теории сложности, криптографии на решётках, геометрии и теории графов.

Самое интересное в стоимости. По оценке OpenAI, все вычисления для поиска десяти решений обошлись бы примерно в 2000 долларов по тарифам Sol API.

После генерации люди подготовили результаты к публикации вместе с моделью. Затем Astra формализовала каждое доказательство в Lean, чтобы его можно было проверить программно.

OpenAI отдельно подчёркивает, что математические идеи сгенерировала именно система. Люди занимались подготовкой рукописей, формализацией и проверкой корректности.


Bending Spoons купит Airtable за 1.3 миллиарда

Airtable позволяет создавать таблицы и базы данных в облаке без программирования.

За все время компания привлекла около 1.35 миллиарда инвестиций. На пике в 2021 году Airtable оценивали в 11.7 миллиарда долларов.

Стратегия Bending Spoons — покупать и выжимать соки из устаревших проектов-динозавров, пока они не умерли окончательно. Поразительно, как быстро Airtable попал в эту категорию. А я так и не сделал в нем ни одной публичной таблички со списком чего-нибудь полезного.


💰 Cloudflare анонсировал (https://blog.cloudflare.com/wallets/) криптокошельки для ИИ-агентов.

С помощью Cloudflare Wallet ИИ-агент сможет сам покупать доступы к API, MCP или контенту, чтобы пользователю не приходилось каждый раз регистрироваться у нового провайдера, привязывать карту и вручную выпускать ключи.

Расчеты будут проходить в стейблкоинах через агентный протокол x402. Для ИИ-агента можно будет задать строгий лимит трат.


Любую книгу теперь можно превратить в навык нейросети — вышел (https://github.com/virgiliojr94/book-to-skill) опенсорсный конвертер book-to-skill для ваших ИИ-агентов.

Скармливаете ему PDF, EPUB, DOCX, Markdown или целую папку документов — агент считывает текст, собирает конспекты глав, словарь, паттерны и шпаргалку, а затем превращает это в skill. Метод отлично экономит токены — в 24-51 раз меньше затрат, чем если бы вы просто закинули нейронке целую книгу.

Идеально, чтобы обсудить с нейронкой любимую книгу или превратить рабочий манул в инструмент. Забираем — здесь (https://github.com/virgiliojr94/book-to-skill).


Акции AMD упали на 8% после заявления Илона Маска о том, что SpaceX будет использовать «исключительно» чипы Nvidia.

При этом квартальная выручка AMD достигла рекордных $11,5 млрд, а чистая прибыль год к году увеличилась с $872 млн до $2,3 млрд


Их разыскивают

#humor


Вежливость к ChatGPT тоже потребляет электричество

ООН посчитала, сколько энергии уходит на наши «пожалуйста» и «спасибо» в запросах к ИИ. Оказалось, цифровой этикет тоже не бесплатный — особенно когда им пользуются миллионы людей.

По оценке исследователей, если убрать из промптов лишние вежливые слова, энергозатраты можно сократить примерно на 25%. Потенциальная экономия — до 98 ГВт⋅ч в год. Этого хватило бы на бытовые нужды примерно 760 тысяч человек.

Причина довольно прозаичная: модели обрабатывают текст токенами, а каждый дополнительный токен — это вычисления. Даже если токен выглядит как безобидное «спасибо».

Есть и более тяжёлые сценарии:
— генерация одного изображения требует примерно в 60 раз больше энергии, чем текстовый запрос
— сложное ИИ-видео может быть тяжелее уже примерно в 8000 раз

Учёные не предлагают срочно хамить нейросетям и писать «сделай, железка». Смысл скорее в осознанном использовании: меньше пустых диалогов, меньше лишних перегенераций и меньше запросов «просто посмотреть, что будет».


Исследователи из Стэнфорда создали аналог Git для ИИ-агентов.

Он называется Shepherd.

Когда ИИ-агент допускает ошибку в процессе выполнения задачи, ему не нужно начинать всё заново. Вместо этого система откатывается к последнему корректному шагу и продолжает работу с этого места.

Shepherd сохраняет каждый этап выполнения как отдельный коммит — вместе с файлами и состоянием запущенных процессов. Можно мгновенно вернуться к любой точке выполнения одним вызовом. До 95% вычислений, выполненных на предыдущих шагах, используются повторно, поэтому ничего не приходится пересчитывать дважды.

Поверх всего работает мета-агент, который автоматически выполняет откат, как только обнаруживает ошибку. Участие человека не требуется.

Проект полностью с открытым (https://github.com/shepherd-agents/shepherd) исходным кодом 😏


Китай может ограничить доступ иностранцев к своим моделям

Власти Китая хотят, чтобы самые мощные модели были доступны только на внутреннем рынке. Причём речь не только о закрытых моделях, но и о моделях с открытыми весами. По словам источников, ограничения сейчас обсуждают с Alibaba, ByteDance и Z.ai.

Пекин также рассматривает жёсткие наказания за утечки и кражу проприетарных AI-технологий. Ещё один возможный блок — ограничения на финансирование китайских AI-стартапов иностранными инвесторами.


Claude Cowork теперь работает в вебе и на смартфонах

Можно начать сессию на компьютере и продолжить на смартфоне.

Доступ начнут раскатывать с подписчиков Max.

https://claude.com/blog/cowork-web-mobile


👍 Люди не могут объективно оценивать ИИ-модели, показал эксперимент.

Ученые разделили 162 добровольцев на три группы и предложили им решить задачи с помощью нейросетей. Одни думали, что получили слабые модели (GPT-3.5/4 или Claude Haiku 3), но на деле общались с флагманами (GPT-5, Sonnet 4), другие — наоборот, а третья, «контрольная», получала честный ярлык.

У тех, кто думал, что общается с более мощной моделью с самого начала были и более высокие ожидания от нее, и разочарование после работы. И наоборот — те, кто думал, что общается со слабой моделью, были удивлены «смышленностью» ИИ в работе.

⚡️ При этом изменение мнения после использования вообще не зависело от качества результата — важно было только насколько оправдались ожидания и стал ли человек увереннее в себе после работы с ИИ.

«Пользователи оценивают питч, а не продукт», — резюмируют (https://arxiv.org/abs/2607.02531) исследователи.


✴️ GPT-5.6 Sol, Terra и Luna выходят уже завтра — OpenAI официально обновила анонс

Похоже, большой релиз совсем близко: OpenAI написала, что GPT-5.6 Sol, Terra и Luna запустятся публично в четверг, 9 июля. А предварительный доступ уже начали расширять глобально — так что идём проверять, кому уже прилетело.


AlayaWorld

Видеогенератор интерактивных миров в рилтайме

Акцент на долгосрочную согласованность мира и мгновенную реакцию на действия - внизу сайта есть демка

• 60+ секунд непрерывного видео 720p 24fps
• управление персонажем через WASD
• каст заклинаний как часть геймплея
• смена стиля прямо в генерации
• 15B параметров

Код (https://github.com/AlayaLab/AlayaWorld) / веса ждем

#world #text2world #imagw2world #interactive #realtime




Цукерберг включается в игру: MetaAI выпустила Muse Image

Muse Image это первая модель генерации картинок от собственной лаборатории MSL. Модель работает как агент, а не просто рисует по описанию.

Перед генерацией она разбирает запрос, ищет в интернете нужный контекст и строит план того, что должно получиться. За счёт этого пользователь чаще получает именно то, что имел в виду, с первой попытки.

Внутри модель правит свой же результат прямо внутри рассуждения и это поведение появилось само во время обучения через RL, разработчики его не закладывали.

Композиция по нескольким референсам, когда много исходных картинок сливаются в одну цельную генерацию. И многошаговое редактирование, когда можно дорабатывать изображение итерациями без потери стиля и без старта с нуля.

Muse Image сделали персональной. Можно подгружать свои фото, отмечать друзей через собачку, вытягивать образы из того, что сейчас в трендах. Готовый результат отправляется в сторис, ленту или групповой чат в пару тапов.

Ещё показали превью Muse Video. Модель конкурентоспособна по точности следования промпту, визуальному качеству и стабильности между кадрами. Скоро появится в Meta AI.


Новый король удаления фона найден — релизнулся сервис Cut It Out.

— Работает на самых передовых нейронках;
— Идеально распознает фон, справился даже со сложным узором паутины;
— Можно поставить локально (https://github.com/Suvink/cut-it-out) или пользоваться в браузере (https://cut-it-out.vercel.app/);
— Не сжимает фотку и сохраняет исходное качество;
— Бесплатно, без регистрации и ограничений.


Секретные данные о фильме Терминатор 2

#humor


Tencent открыла Hunyuan 3 — флагманскую MoE-модель под агентов и код

Tencent выложила в open source Hunyuan 3 — новую версию своей флагманской языковой модели. Веса уже лежат на Hugging Face, код для инференса — на GitHub, лицензия Apache-2.0, то есть модель можно свободно скачивать и использовать.

Hy3 построена как MoE-модель с быстрым и медленным режимами мышления: всего 295 млрд параметров, активных — 21 млрд, контекст — 256K токенов. Апрельская версия была превью, теперь это официальный релиз с акцентом на кодинг, поиск и агентные задачи.

Главная ставка — эффективность. Tencent утверждает, что при 295B параметров Hy3 конкурирует с открытыми флагманами, которые крупнее в 2–5 раз.
Сильнее всего модель выглядит в агентных и поисковых сценариях:
— ClawEval: 68.5 — выше GPT-5.5 и Qwen-3.7 Max
— BrowseComp: 84.2 — почти на уровне GPT-5.5

В классических кодинг-бенчмарках Hy3 пока не лидер. По замерам Tencent, впереди остаются Claude Opus 4.8 и среди open-source — GLM-5.2:
— SWE-bench Verified: Hy3 — 78.0, GLM-5.2 — 84.2, Claude Opus 4.8 — 88.6
— SWE-bench Pro: Hy3 — 57.9, GLM-5.2 — 62.1, Claude Opus 4.8 — 69.2
— SWE-bench Multilingual: Hy3 — 75.8, GLM-5.2 — 83.0, Claude Opus 4.8 — 84.4
— Terminal-Bench 2.1: Hy3 — 71.7, GLM-5.2 — 81.0, Claude Opus 4.8 — 85.0

Модель уже работает внутри продуктов Tencent, а API доступно через Tencent Cloud TokenHub. Линейку ведёт Яо Шуньюй — бывший ведущий исследователь агентов в OpenAI.

Hugging Face (https://huggingface.co/tencent/Hy3)
GitHub (https://github.com/Tencent-Hunyuan/Hy3)

20 ta oxirgi post ko‘rsatilgan.