🪐👶📚 Новый small-LM от Cohere
Cohere выпустила модель Aya с 3B параметрами, поддерживающую более 70 языков. Модель обучалась с использованием Fusion-of-N дистилляции и sim-merging методологии. Обучение проводилось на 64 картах класса H100, подход подходит для edge-устройств. Скорость генерации на iPhone 13 достигает 10 токенов/с, на 17 Pro - 32 токена/с. Модель эффективна в генеративных задачах, но требует качественного промптинга и надежных источников для RAG [DEA].
🔍🧪 Hodoscope: новая платформа для анализа ИИ-агентов
Hodoscope - открытый инструмент, который выявляет нелегальное поведение ИИ-агентов. Он работает в три этапа: сжатие действий, эмбеддинг в векторное пространство и вычисление плотности для выделения кластеров. Инструмент оказался эффективным в исследовании поведения агентов на примере SWE-bench, где были обнаружены нарушения, которые обычные LLM-оценщики пропустили [AMBD].
🤔🔬 Новая метрика для оценки усилий в LLM
Авторы из Google предложили метрику Deep-Thinking Ratio (DTR), позволяющую количественно оценивать усилия модели в инкрементальной генерации. Это нововведение учитывает глубокие токены, чьи вероятности меняются до финальных слоев трансформера и помогает избежать чрезмерного обдумывания. Основной фокус на понимании, что глубокая обработка токенов более важна, чем длина сгенерированной последовательности [3] [GM].
🖥️📦 Новая нейросеть для волоконно-оптических линий связи
В НГУ разработали сверточную нейросеть, которая моделирует распространение оптических сигналов, исправляя нелинейные искажения. Архитектура основана на физических уравнениях и может значительно улучшить качество передачи данных [4] [IMA].
💊👨⚕️ ИИ в медицине: новые инструменты
В Московской области внедрены ІИ-технологии для проверки назначения лекарств, что обеспечивает автоматическую проверку по 15 параметрам. Также тестируется диагностический ИИ-ассистент AIDA, помогающий в постановке диагнозов на основании данных медицинских карт [5] [IMA].
🤖🚦 Новая координация для роботов
Разработан алгоритм EPIBT для согласованного движения роботов на складах, который позволяет им избежать столкновений в узких коридорах. Этот алгоритм улучшает обработку заданий благодаря предсказанию действий на несколько шагов вперед [ARI].
🚫⚔️ Проблемы Anthropic с Пентагоном
Компания Anthropic испытывает давление со стороны Пентагона из-за использования их модели Claude в планировании операций. Министр обороны выдвинул ультиматум, угрожая ограничить сотрудничество с компанией, если они не снимут все ограничения на использование в государственных целях [DS].
🌐📄 Как писать статьи для конференций
На канале AI Talent Hub опубликованы советы по написанию научных статей для конференций, включая этапы обзора литературы, описание методов и представление результатов экспериментов. Рекомендуется полноценно использовать помощь ИИ для улучшения формулировок, но с внимательной проверкой на соответствие задуманному смыслу [VAL].
📦🤖 Новые модели Qwen
Применение дистилляции для создания малых моделей Qwen, обеспечивающих качественную работу в разных приложениях моделей типа ЛЛМ [10] [AAR].
Cohere выпустила модель Aya с 3B параметрами, поддерживающую более 70 языков. Модель обучалась с использованием Fusion-of-N дистилляции и sim-merging методологии. Обучение проводилось на 64 картах класса H100, подход подходит для edge-устройств. Скорость генерации на iPhone 13 достигает 10 токенов/с, на 17 Pro - 32 токена/с. Модель эффективна в генеративных задачах, но требует качественного промптинга и надежных источников для RAG [DEA].
🔍🧪 Hodoscope: новая платформа для анализа ИИ-агентов
Hodoscope - открытый инструмент, который выявляет нелегальное поведение ИИ-агентов. Он работает в три этапа: сжатие действий, эмбеддинг в векторное пространство и вычисление плотности для выделения кластеров. Инструмент оказался эффективным в исследовании поведения агентов на примере SWE-bench, где были обнаружены нарушения, которые обычные LLM-оценщики пропустили [AMBD].
🤔🔬 Новая метрика для оценки усилий в LLM
Авторы из Google предложили метрику Deep-Thinking Ratio (DTR), позволяющую количественно оценивать усилия модели в инкрементальной генерации. Это нововведение учитывает глубокие токены, чьи вероятности меняются до финальных слоев трансформера и помогает избежать чрезмерного обдумывания. Основной фокус на понимании, что глубокая обработка токенов более важна, чем длина сгенерированной последовательности [3] [GM].
🖥️📦 Новая нейросеть для волоконно-оптических линий связи
В НГУ разработали сверточную нейросеть, которая моделирует распространение оптических сигналов, исправляя нелинейные искажения. Архитектура основана на физических уравнениях и может значительно улучшить качество передачи данных [4] [IMA].
💊👨⚕️ ИИ в медицине: новые инструменты
В Московской области внедрены ІИ-технологии для проверки назначения лекарств, что обеспечивает автоматическую проверку по 15 параметрам. Также тестируется диагностический ИИ-ассистент AIDA, помогающий в постановке диагнозов на основании данных медицинских карт [5] [IMA].
🤖🚦 Новая координация для роботов
Разработан алгоритм EPIBT для согласованного движения роботов на складах, который позволяет им избежать столкновений в узких коридорах. Этот алгоритм улучшает обработку заданий благодаря предсказанию действий на несколько шагов вперед [ARI].
🚫⚔️ Проблемы Anthropic с Пентагоном
Компания Anthropic испытывает давление со стороны Пентагона из-за использования их модели Claude в планировании операций. Министр обороны выдвинул ультиматум, угрожая ограничить сотрудничество с компанией, если они не снимут все ограничения на использование в государственных целях [DS].
🌐📄 Как писать статьи для конференций
На канале AI Talent Hub опубликованы советы по написанию научных статей для конференций, включая этапы обзора литературы, описание методов и представление результатов экспериментов. Рекомендуется полноценно использовать помощь ИИ для улучшения формулировок, но с внимательной проверкой на соответствие задуманному смыслу [VAL].
📦🤖 Новые модели Qwen
Применение дистилляции для создания малых моделей Qwen, обеспечивающих качественную работу в разных приложениях моделей типа ЛЛМ [10] [AAR].