ПРО Чат-боты


Гео и язык канала: не указан, Русский
Категория: не указана


🤖Канал о мире чат-ботов и искусственного интеллекта: история, применение, создание, инновации и советы экспертов.
🚀Автоматизируйте задачи, улучшите бизнес-процессы, узнайте о новейших технологиях ИИ и получите ценные знания для своего развития.

Связанные каналы

Гео и язык канала
не указан, Русский
Категория
не указана
Статистика
Фильтр публикаций


iOS 27: Выбирайте свой AI-приключение! 🤖

Apple готовит интересное обновление: с выходом iOS 27 пользователи смогут выбирать, какие сторонние AI-модели использовать для выполнения различных задач. Это обещает сделать iPhone более персонализированным, давая пользователям контроль над опытами работы с ИИ.

Что изменится?
- Интеграция сторонних моделей: возможность выбора AI для текстовых предсказаний, фотообработки и других задач.
- Расширенные настройки: гибкость в кастомизации взаимодействия с устройством.

Как это использовать?
Если вы разрабатываете приложения или AI-решения, это открывает дорогу к массовой интеграции ваших моделей на iOS. Пользователи смогут выбирать ваш AI для конкретных задач, что увеличивает вовлеченность и удовлетворенность от использования продуктов. Более того, это отличный шанс потеснить большие корпорации в области AI-сервисов.

#iOS27 #Apple #AIИнтеграция #МобильныйAI


Results of privacy investigation into OpenAI's ChatGPT coming today

The results of an investigation into whether OpenAI's ChatGPT adheres to Canada's privacy laws will be made public this morning.

cbc​.ca • May 6, 2026


Inside OpenAI's exclusive launch party that ChatGPT 5.5 planned itself

OpenAI let ChatGPT plan a launch party at its San Francisco headquarters to celebrate its latest model release. Here's what it was like inside.

Katherine Tangalakis-Lippert,Shubhangi Goel | businessinsider​.com • May 6, 2026


Видео недоступно для предпросмотра
Смотреть в Telegram
Смотрим, как топовые модели меряются бенчмарками друг с другом на LLMMA-арене.


OpenAI Brings GPT-5.5 To AWS Bedrock As Microsoft Exclusive Era Ends

OpenAI Goes Live On AWS Bedrock As Microsoft Exclusivity Officially Ends. It took less than 24 hours to get on AWS.

Jon Markman | forbes​.com • May 6, 2026


GPT-5.5 Instant is now the default ChatGPT model — and it hallucinates less

OpenAI's free-tier upgrade claims a 52.5% cut in false claims across medicine, law, and finance ...

Anton Kratiuk | gagadget​.com • May 6, 2026


📌 Студенты собрали GPT целиком в железе на учебной плате

Лютира Абейкун и Криш Чхаджер из Университета Торонто взяли microGPT Андрея Карпатого и переписали его на языке описания цифровых схем SystemVerilog. Так родился проект TALOS-V2, который работает на образовательной плате DE1-SoC с FPGA Cyclone V, которую обычно дают в вузах для лабораторных работ.

Инференс на ней не выполняет ни GPU, ни PyTorch, ни даже CPU - каждый шаг трансформера, от эмбеддингов и самовнимания до нормализации, MLP и выбора следующего токена, превращён в физическую цепь из логических элементов.

Сама модель - символьный microGPT, обученный на датасете имён Карпатого: символ за символом она генерирует новые имена. Маленькая по меркам индустрии, но устроенная как взрослые генеративные модели: те же блоки, те же связи.

Внутри FPGA числа хранятся не как привычные дроби с плавающей точкой, а в формате Q4.12 - 16 бит, разделённые на целую и дробную часть.

Это компромисс: точности хватает для такой модели, а схема получается компактной и предсказуемой по времени работы.

Веса заранее переведены в шестнадцатеричные файлы и загружены прямо в постоянную память чипа.


Сердце схемы - один универсальный вычислительный блок на 16 параллельных каналов, который умеет умножать вектор на матрицу.

Он по очереди обслуживает все ключевые операции трансформера: проекции Q, K, V, выходную проекцию внимания, оба слоя MLP и LM-head.

Самый трудный для железа блок - softmax, нормирующая функция внутри механизма внимания. Экспоненту считает таблица заранее заготовленных значений, деление выполняет специальный многотактный модуль, заточенный под узкий диапазон входных чисел и потому быстрее универсального.

В механизме внимания деление - самая медленная операция и тормозит весь блок, поэтому таких делителей поставили сразу 2: они работают параллельно и снимают эту задержку. Поиск максимума совмещён с подсчётом скалярных произведений, чтобы не делать лишний проход по данным.

Даже выбор следующего токена происходит внутри чипа: алгоритм xorshift даёт случайность, а специальная схема сэмплирования бережёт распределение от перекоса в сторону младших символов. Хост-компьютер только запускает генерацию и забирает готовый результат.

В итоге плата устойчиво выдаёт больше 50 000 токенов в секунду, зафиксированный пик - около 53 000.


Проект открыт на GitHub: SystemVerilog-ядро, тестбенч под ModelSim, Python-утилиты для экспорта весов и запуска инференса через JTAG, скрипты под Quartus.


🟡Статья
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #FPGA #RTL #Transformer #TALOS


Can LLM agents explore codebases and reason about code semantics without executing the code

📗 Read

@datascienceiot


«Как увеличить выручку своего ИИ-сервиса в 3 раза за 15 минут?»

Недавно видел статистику - 98% пользователей нейросетей не платят за подписку. Они пишут запросы, тратят токены и уходят.

Для владельцев AI-сервисов, которых я знаю тут много, появился способ превратить эту аудиторию в источник дохода.

Сервис Gradius интегрирует контекстную рекламу прямо в ответы ИИ-агентов. Сами ответы не меняются - Gradius дополняет их нативной рекомендацией. Без баннеров, без рассылок, без ущерба для UX.

С проектом уже сотрудничают десятки крупных рекламодателей, таких как Т2 Мобайл, SkyEng, Умскул и Яндекс.

Подключение бесплатно, занимает не более 15 минут.

Узнайте, как начать монетизировать ваш AI-сервис → ссылка


NVIDIA выкатила Spectrum-X Ethernet с MRC.

Когда обучаешь модель на сотнях тысяч GPU, проблема уже не в том, чтобы купить больше чипов. Проблема в том, чтобы они не стояли без дела, пока сеть тупит, забивается или теряет пакеты.

MRC, или Multipath Reliable Connection, делает одну простую, но очень дорогостоющую вещь: один RDMA-коннект больше не обязан идти по одному маршруту. Он может размазывать трафик сразу по нескольким путям, обходить перегруженные участки и быстро переключаться, если где-то что-то падает.

Для обычного сервера это звучит как оптимизация. Для AI-кластера это вопрос миллионов долларов.

Если один кусок сети тормозит, вся огромная тренировка модели начинает ждать. Ты купил Blackwell, построил дата-центр, запустил frontier training run, а потом часть GPU простаивает из-за сетевого узкого места. Красиво, дорого, больно.

NVIDIA теперь продает идею, что сеть должна быть такой же умной частью AI-фабрики, как GPU, SuperNIC и софт для управления кластером.

MRC уже проверяли в production на Spectrum-X, а спецификацию открыли через Open Compute Project. В разработке участвовали не только NVIDIA, но и AMD, Broadcom, Intel, Microsoft и OpenAI.

Это редкий момент, когда за скучным сетевым протоколом видно будущее всей индустрии.

https://blogs.nvidia.com/blog/spectrum-x-ethernet-mrc/

@ai_machinelearning_big_data


Netherlands moves GPT-NL from lab to live: first pilots under way

Dutch national language model enters real-world testing with a €13.5m public budget and a project-claimed world-first licensing deal with national news publishers.

Kim Loohuois | computerweekly​.com • May 6, 2026


📌 Джек Кларк: вероятность автоматизированной ИИ-разработки к концу 2028 года - выше 60%

В личном блоге соучредитель Anthropic поделился мнением, что вероятность появления ИИ-системы, способной автономно, без участия человека, обучать собственного преемника, к концу 2028 года превышает 60%.

По его словам, общество может быть не готово к последствиям подобного перехода, но публичные данные о темпах прогресса приводят его к такому выводу.

Кларк - один из основателей Anthropic и глава отдела политики компании. Ранее он занимал аналогичную должность в OpenAI и работал журналистом, специализировавшимся на теме ИИ.


В качестве аргументов Джек приводит данные нескольких публичных бенчмарков, оговариваясь, что у каждого из них свои методологические ограничения и значимы именно совокупные тенденции.

🟢По метрикам METR, продолжительность задач, которые ИИ-системы способны выполнять автономно, выросла с 30 секунд в 2022 году (GPT-3.5) до 12 часов в начале 2026-го (Opus 4.6). Прогноз METR на конец этого года - около 100 часов.

🟢На SWE-Bench Claude 2 справлялся лишь с 2% задач, а свежайшая Claude Mythos Preview уже с 93,9%.

🟢Внутренний бенч Anthropic по оптимизации обучения малой языковой модели на CPU показывает, что за год ИИ-системы прошли путь от 2,9х до 52-кратного ускорения исходного кода.

Для сравнения, человеку на 4х ускорение, по данным Anthropic, требуется 4–8 часов работы.


При этом Кларк делает несколько оговорок.

Он не ожидает, что полностью автоматизированная разработка ИИ произойдёт в 2026 году. Первый прецедент схемы "модель сама обучает преемника" он допускает в течение года-двух и не на самых передовых моделях.

Кларк также признаёт, что ИИ пока не способен генерировать радикально новые идеи и подходит в первую очередь для рутинной инженерной работы, составляющей, по его оценке, основную часть исследований в области.

@ai_machinelearning_big_data


OpenAI Replaces ChatGPT's Default Model With GPT-5.5 Instant

OpenAI's GPT-5.5 Instant replaces 5.3 as ChatGPT's default, cutting hallucinations 52.5% and adding memory source controls.

@​TechnologyOrg | technology​.org • May 6, 2026


OpenAI Replaces ChatGPT’s Default Model With GPT-5.5 Instant

OpenAI’s GPT-5.5 Instant brings more accurate ChatGPT responses, fewer hallucinations, cleaner answers, and better personalization for everyday users.

Rajat Saini | macobserver​.com • May 6, 2026


Видео недоступно для предпросмотра
Смотреть в Telegram
Вайбкодеры, делающие отладку приложения, которое они только что сгенерировали.

@ai_machinelearning_big_data


Inside OpenAI's GPT-5.5 party

On Tuesday evening, I went from an off-the-record happy hour with Anthropic leaders to OpenAI HQ for a party thrown by (and for) its newest model, GPT-5.5. The crossover felt a bit like passing through the DMZ. Several attendees at both events naturally wondered whether Sam Altman was trying to upstage Anthropic’s Claude developer conference the next day.

Alex Heath | sources​.news • May 6, 2026


OpenAI Starts Rolling Out New GPT-5.5 Instant Model and Memory Sources to ChatGPT Users

ChatGPT now uses a new GPT-5.5 Instant model by default, which provides shorter, more factually reliable answers. OpenAI is also rolling out memory sources to all ChatGPT users.

Laurent Giret | thurrott​.com • May 6, 2026


OpenAI Introduces GPT-5.5 Instant to ChatGPT

OpenAI has launched the GPT-5.5 Instant model, replacing GPT-5.3 Instant as the default neural network and making it available to all users.

ForkLog | forklog​.com • May 6, 2026


OpenAI rolls out GPT-5.5 Instant as ChatGPT’s new default model

Tech News News: OpenAI has introduced GPT-5.5 Instant as the new default model for ChatGPT, replacing GPT-5.3 Instant in a move aimed at improving reliability without.

TOI Tech Desk | timesofindia​.indiatimes​.com • May 6, 2026


Видео недоступно для предпросмотра
Смотреть в Telegram
✔️ SAP блокирует open-source агентов

Немецкий вендор запретил использовать сторонние ИИ-инструменты для извлечения данных из своих корпоративных приложений. Под запрет попал, в частности, проект OpenClaw. Нарушителям грозит урезание лимитов на запросы или полное отключение доступа.

Легальный доступ оставлен решениям Microsoft, Google, Amazon и IBM. Открытые ИИ-решения заблокированы со ссылкой на риски безопасности.

Глава SAP объясняет ограничения защитой интеллектуальной собственности. По другой версии, цель - сохранить лицензирование по числу рабочих мест и продвинуть собственного ИИ-ассистента Joule.
theinformation.com

✔️ Питер Тиль вложил $140 млн в создание автономных плавучих ИИ-дата-центров

Орегонский стартап Panthalassa закрыл раунд на $140 млн, возглавленный сооснователем PayPal и Palantir. Продукт - автономные плавучие узлы для ИИ-инференса.

Узел - сферический поплавок и подводная вертикальная труба из листовой стали. Энергия волн через колебания водяного столба внутри трубы конвертируется в электричество для ИИ-ускорителей, а забортная вода даёт охлаждение. На берег передаются только результаты инференса по низкоорбитальной спутниковой связи. Двигателей нет - узлы выходят в заданный район за счёт гидродинамики корпуса.

Прототипы Ocean-1, Ocean-2 и Wavehopper тестировались в море в 2021 и 2024. В этом году компания развернёт пилотную серию Ocean-3 в северной части Тихого океана. Привлечённые средства пойдут на развитие производства и первые узлы, коммерческий запуск которых намечен на 2027 год.
businesswire.com

✔️ Unity открыла бету Unity AI

Unity открыла публичную бету Unity AI для версий движка 6.0 и выше. В набор входят встроенный ИИ-агент, шлюз для подключения сторонних моделей и MCP-сервер.

Собственный агент Unity обучен на документации и материалах движка за 20 лет, он анализирует контекст сцен и выполняет операции внутри редактора. Шлюз позволяет подключать сторонние LLM по API пользователя, без расхода внутренних кредитов Unity. MCP-сервер даёт управлять движком и получать данные из внешних IDE.

Подписчикам тарифов Pro, Enterprise и Industry доступ бесплатный. Индивидуальным разработчикам - 14-дневный триал на 1000 запросов, далее $10 в месяц.
unity.com

✔️ Perplexity запустила Computer для финансистов

Computer for Professional Finance - финансовая надстройка над агентом Computer. Решение позиционируется как альтернатива классическим финансовым терминалам.

Платформа подключает лицензионные базы Morningstar, PitchBook, Daloopa и Carbon Arc, плюс встроенные источники Perplexity. Среди встроенных инструментов - скринеры, калькуляторы, списки наблюдения и трекеры отчётностей.

Computer for Finance умеет генерировать справки по компаниям, аннотированные графики котировок и сравнительные подборки аналитических отчётов. Отдельно компания подчёркивает интеграцию с Excel: агент работает в нативной side-панели рядом с моделями аналитика.

Из коробки доступны 35 готовых шаблонов: сводки по компаниям, разбор драйверов котировок, сравнительный скрининг. Доступ для подписок Pro и Max.
PerplexityAI в сети Х

✔️ Глава корпоративных продаж OpenAI уходит в венчурный фонд

Джеймс Дайетт, отвечавший в OpenAI за корпоративные контракты и продажи API с 2023 года, покидает компанию. Он переходит в фонд Thrive Capital, одного из крупнейших инвесторов OpenAI, на позицию операционного партнёра. Сам Дайетт говорит, что хочет работать со стартапами, а не с крупными компаниями.

Это очередной уход в топ-менеджменте OpenAI за последнее время. Компанию покинули Билл Пиблз, руководивший разработкой Sora, и вице-президент по научным исследованиям Кевин Вейл. Руководители продуктового и маркетингового направлений отошли от операционного управления по состоянию здоровья. COO Брэд Лайткэп переведён на "спецпроекты".
cnbc.com

@ai_machinelearning_big_data

#news #ai #ml

Показано 20 последних публикаций.

16

подписчиков
Статистика канала