TGStat
TGStat
Type to search
Advanced channel search
  • flag English
    Site language
    flag Russian flag English flag Uzbek
  • Sign In
  • Catalog
    Channels and groups catalog Search for channels
    Add a channel/group
  • Ratings
    Rating of channels Rating of groups Posts rating
    Ratings of brands and people
  • Analytics
  • Search by posts
  • Telegram monitoring
Олег Булыгин | Полезная нагрузка

22 Sep, 12:02

Open in Telegram Share Report

Твои задушевные переписки с нейронкой читает живой мужик за $50 в час 🤫

Издание 404 Media выкатило жирное расследование про Project Lily — закрытую изнанку OpenAI по ручной оценке пользовательских диалогов.
Суть: компания нанимает сотни сторонних подрядчиков, которые сидят и в промышленных масштабах читают реальные диалоги пользователей с ChatGPT.

Помните, как в посте про Навье-Стоксгейт писал про математиков, заламывающих руки на тему: «О боже, OpenAI стащила наши черновики из Codex, это шпионаж, а не обучение!»?

Так вот, реальность оказалась куда прозаичнее и смешнее. Речь даже не о хитрых алгоритмах, вытаскивающих смыслы из эмбеддингов. Ваши промпты просто выводятся на экран живым людям.

Самая мякотка из утечки внутренних инструкций и реальных кейсов:

🟡 Иллюзия приватности уровня детский сад
В интерфейсе ревьюеров регулярно всплывают промпты, где пользователи на полном серьезе пишут боту: «Только пообещай, что это останется между нами». После чего какой-нибудь контрактник из Северной Америки спокойно читает этот крик души под утренний кофе и оценивает ответ по шкале от 1 до 7.

🟡 «Анонимизация», которая смогла
В OpenAI божатся, что перед отправкой диалогов людям прогоняют их через свой фильтр приватности. Но компания сама признает: фильтр регулярно лажает на коротких контекстах и намертво пропускает неоднозначные персональные данные. Хуже того: проверяющим в ряде задач отдают user memories summary — выжимку из долгосрочной памяти профиля с примерным местоположением и бэкграундом пользователя.

Вендоры обожают прикрываться сказками про «телеметрию, контроль качества и полировку безопасности». Но если математики хотя бы возмущаются тем, что их закрытые идеи переварил гигантский алгоритмический комбайн, то рядовые пользователи на голубом глазу сливают интимные подробности жизни прямо на экран стороннему фрилансеру.

И отдельный цимес — ради чего это делается. В гайдлайнах Project Lily разметчиков просят дрессировать модель:
— не поддакивать пользователю;
— не имитировать человеческие эмоции;
— и беспощадно штрафовать ответы за... чрезмерное использование эмодзи и «AI-спик».

То есть весь этот «невероятный AGI», о скором наступлении которого из каждого утюга вещает Сэм Альтман, до сих пор в полуручном режиме допиливают напильником обычные белковые специалисты.

Кстати, в Anthropic и Google подтвердили, что занимаются ровно тем же самым. Так что бежать некуда. 🙂

947 1 23 2 20
Catalog
Channels and groups catalog Channels compilations Search for channels Add a channel/group
Ratings
Rating of Telegram channels Rating of Telegram groups Posts rating Ratings of brands and people
API
API statistics Search API of posts API Callback
Our channels
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Read
Академия TGStat Telegram Research 2019 Telegram Research 2021 Telegram Research 2023
Contacts
Справочный центр Support Email Jobs
Miscellaneous
Terms and conditions Privacy policy Public offer
Our bots
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot