TGStat
TGStat
Type to search
Advanced channel search
  • flag English
    Site language
    flag Russian flag English flag Uzbek
  • Sign In
  • Catalog
    Channels and groups catalog Search for channels
    Add a channel/group
  • Ratings
    Rating of channels Rating of groups Posts rating
    Ratings of brands and people
  • Analytics
  • Search by posts
  • Telegram monitoring
DSTGSUM

2 Mar, 21:01

Open in Telegram Share Report

📊🔍 Новый подход к спекулятивному декодингу
Статья "LK Losses: Direct Acceptance Rate Optimization for Speculative Decoding" предлагает новый метод оптимизации, который напрямую увеличивает acceptance rate в спекулятивном декодинге. Этот метод обеспечивает прирост +8-10% в mean acceptance length на разных архитектурах. Веса моделей доступны в HF [LOV].

🧬👩‍🔬 Мультиагентная система для биотеха
Проект Virtual Biotech, созданный Стэнфордом и PHD Biosciences, использует агентов для анализа клинических испытаний. Система предложила новую метрику cell-type specificity, со значительной корреляцией с успехом препаратов. Представлен иммуно-регуляторный белок как перспективная мишень [DS].

🧠🔗 Claude-Mem: память для AI
Инструмент Claude-Mem добавляет долгосрочную память для AI Claude, позволяя сохранять контекст между сессиями. Результаты показывают до 95% сокращение токенов и увеличение способности к вызову инструментов [3] [DAM].

🔧🚀 Автоматизация NLP тестирования
Запуск нового проекта с использованием Langfuse для автоматизации тестирования NLP и LLM-сценариев с использованием LLM-судей [EA][EA].

🤖🚀 Модели Qwen 3.5
Alibaba представила новые компактные модели Qwen 3.5 (от 0.8B до 9B), которые демонстрируют сильные результаты при малом размере. Модели имеют мультимодальность и оптимизированы для реальных сценариев [16] [AMBD][AN].

📝💼 Конкурс по RAG-пайплайну
Открыта регистрация на Agentic Legal RAG Challenge 2026, направленный на оценку качества ответов, grounding и латентности систем. Призовой фонд составляет $32,000 [BA].

📉💡 Метрики для LLM
Обсуждение метрик LLM и их улучшения на примере моделей Qwen 3.5. Является ли качество моделей связано с их архитектурой и объемом данных [DEA].
Love. Death. Transformers.
Возвращаясь к теме спекулятивного декодинга. Сегодня выпустили нашу работу LK Losses: Direct Acceptance Rate Optimization for Speculative Decoding. Стандартом обучения драфт моделей стала минимизация KL дивергенции между самим драфтером и таргетной моделью, но почему? С одной стороны, такой выбор и...

8 0 0
Catalog
Channels and groups catalog Channels compilations Search for channels Add a channel/group
Ratings
Rating of Telegram channels Rating of Telegram groups Posts rating Ratings of brands and people
API
API statistics Search API of posts API Callback
Our channels
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Read
Академия TGStat Telegram Research 2019 Telegram Research 2021 Telegram Research 2023
Contacts
Справочный центр Support Email Jobs
Miscellaneous
Terms and conditions Privacy policy Public offer
Our bots
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot