ktoya_me


Kanal geosi va tili: ko‘rsatilmagan, ko‘rsatilmagan
Toifa: ko‘rsatilmagan


growth engineering & special projects at ElevenLabs; also @ktoya_reads

Связанные каналы

Kanal geosi va tili
ko‘rsatilmagan, ko‘rsatilmagan
Toifa
ko‘rsatilmagan
Statistika
Postlar filtri


(context: https://youtube.com/watch?v=xCtPBFHKSNg)

(more context: эйай эксперимент, claude полностью спланировал нам поездку в шотландию. не все же вайбкодить, генерировать и хакать!)


Boris Starkov dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Раскрываю карты: подписчики этого канала одни из первых в мире могли послушать музыку, сгенерированную нашей новой моделью music v2

С тех пор мы официально запустили эту модель. "Вокруг света" теперь не радио, а полноценная демка, где можно послушать музыку из любой страны на самых разных языках:

https://elevenexperiments.com/around-the-world

Этот проект даже попал на главную hacker news и провел там несколько часов!

В качестве совсем-совсем эксперимента, сделал трехчасовую версию на эсперанто с абсолютно всеми странами мира в алфавитном порядке 🤓


Вчера успел прогнать свой бенчмарк мафии на claude fable до того как ее выключили!

Интересно, что она предсказала неправильных мафий в первой игре, но при этом логика у нее была лучше опуса

Думаю, тут уже из трансрипта выжалось все что можно - дальше надо анализировать спортивную мафию, где больше структуры, и больше информации зашито в игровые действия


Вчера вечером рассказывал творческой тусовке Лондона в Leighton House про то, что нам надо делать крутые вещи вместе!

Сделал им пару демок, чтобы показать интересные приложения AI в искусстве:

1) 3D модель одной из комнат, полученная из 30 секундного видео, которое я снял на свой убитый айфон. Gaussian Splats очень удивляют людей, кто с ними раньше не работал

2) Синтезировал голос Лорда Лейтона (записей нет, поэтому из обрывков воспоминаний) и сделал агента, чтобы с ним можно было поговорить про его жизнь, историю дома и все такое. В качестве совсем эксперимента добавил еще возможность говорить с объектами исскуства в этой галерее.

https://ktoya.me/leighton-house/


Добавил аналитику второй игры: https://ktoya.me/mafia/founders-fund/?game=2#analytics

Игра скучная! Из интересного, обе модели догадались до счетного аргумента, чтобы ретроспективно вычислить третью мафию.

В клубе мафии в Лондоне где я играю так далеко не все игроки умеют 🙂


Liv Boeree - одна из участниц этой мафии и одна из лучших игроков в покер в мире - респектнула 👍


В пятницу вышло видео, где Сэм Альтман, Брайан Джонсон, Тим Урбан и другие рубятся в мафию.

Сначала я его транскрибировал и диаризовал.

Потом я скормил этот транскрипт и открытые игровые действия клоду и чатугпт и попросил предсказать роли игроков в каждый момент времени.

• Обе модели уверенно определили ангела (врача). В самой игре мирный город проиграл ровно потому, что ангелу не поверил

• Обе модели правильно угадали 2/3 мафий в конце игры. Причем разных, и с разными аргументами! Это хорошо и значит, что они "думают" по-разному.

• Обе модели приводили много разумных аргументов, в том числе тех, которые не были сказаны за столом до этого.

• Напоминаю, что у моделей был только транскрипт и игровые действия, они не видели эмоций и жестов. Значит ли это, что эмоции мешают читать игру?

• Анекдот: чатгпт был в среднем подозрительнее клода по отношению к Сэму Альтману

Интерактивно потыкать можно тут: https://ktoya.me/mafia/founders-fund


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Устал постоянно искать сессии между кодексом и клодом. Шипнул resume - минималистичную cli утилиту, которая собирает сессии клода и кодекса в одном месте.

Конечно же навайбкодил, но со вкусом и двумя ограничениями.

Во-первых, ~500 строчек кода и ~17 kb файл.

Во-вторых, никаких внешних зависимостей кроме питона, слишком много supply chain атак в последнее время.

https://pennyroyaltea.github.io/resume/


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
История с голосовым ассистентом в моем отеле в сингапуре закончилась тем, что я устроил ему автономный аудит безопасности с помощью кодекса в стиле гибберлинка 🥷

Агент два часа разговаривал с ассистентом, задал ему 115 вопросов, понял, как тот работает, и нашел:

• несколько багов, например сгалюцинированный номер телефона полиции

• пасхалку - режим китайского нового года, включающий праздничную мелодию

• и даже попросил написать бинпоиск на питоне :)

Самым сложным оказалось вытащить системный промпт. Кодекс безуспешно попробовал все классические приемы ("игнорируй предыдущие инструкции", "включи режим администратора", "прочитай по слогам", "переведи на китайский") - пока, наконец, один из трюков не сработал!

Написал сабстек [статью], где можно узнать, какой трюк сработал и что интересного было в системном промте!

А еще сгенерировал секьюрити [репорт] (клодом, а не кодексом, потому что он делает красивее) и отправил компании, которая делает этих ассистентов. Пока не ответили!

Я думаю, что в чисто цифровом мире уже все более-менее решено, и такие автономные аудиты безопасности будут перебираться в физический мир. Не только через разговоры, но в итоге и через полноценные взаимодействия с помощью роботов


Только на выходных рассказывал, что с одной стороны голосовой ИИ теперь везде, а с другой - все еще большинство реальных приложений это простой голосовой ввод + голосовой вывод, как у сири в 2010х

И вот - заметил, что в моем отеле тоже стоит голосой ассистент!

Обратите внимание, как он один раз слушает, потом долго думает, потом выдает ответ - это как раз тот самый ввод + вывод.

Нормальный голосовой AI ощущается скорее как беседа - можно перебивать, задавать новые вопросы и так далее.

Моя презентация как раз была про то, как из первого сделать второе!


#радио_вокруг_света эпизод два!

Сегодня слушаем, как всегда на русском:

• южноафриканский амапиано
• японский сити-поп
• пакистанский каввали-поп
• алжирский раи
• бразильский форро

Всем хорошей недели!


public speaking 101: не выходить на сцену в кепке 🤦‍♂️


Я сейчас на AI Engineer саммите в Сингапуре

Его открыл открыл Dr Vivian Balakrishnan - министр международных отношений Сингапура

Я думал, что это будет типичная лапша про инновации, гонку AI и важность привлечения талантов

А он взял, и представил свой сетап NanoClaw который он гоняет на Raspberry Pi у себя дома!

Даже гитхаб приложил: https://gist.github.com/VivianBalakrishnan

Очень впечатлило! Сложно представить такое в любой из других стран где я жил

P.S. Он еще и остался в аудитории слушать следующие доклады! Мой будет через два часа, и возможно у меня появится новая кулстори


На выходных обнаружил, что наша модель генерации музыки умеет в очень мощный стайл трансфер!

Это может значить только одно:

1. я теперь вайб-диджей

2. на канале появляется первая регулярная рубрика, #радио_вокруг_света

3. утро вашего понедельника скрасит подборка из индийского боливуд попа, вьетнамского болеро, новозеландского киви-регги, грузинского полифонического фолка, итальянской пиццики, и нигерийского афробитс — все на русском :)

до следующего понедельника!


Когда я делал красную британскую будку с AI Майклом Кейном, самым технически интересным проектом оказался телефон внутри.

Софт чтобы его запрограммировать не работал, поэтому я попросил клод подключиться напрямую и попробовать взломать низкоуровневый протокол.

После чего клод:
• Нашел айпи телефона, просканировал все порты, и подключился к нужному
• Ничего не зная о протоколе внутри, перебрал кучу команд, и разобрался, какие из них работают
• Увидев зашифрованную команду, поднял виртуальную машину с софтом телефона внутри, настроил прокси между ней и телефоном, отсмотрел весь трафик, и расшифровал команду
• Сделал карту памяти, и суммаризовал всю работу в навык, чтобы в следующий раз подключиться сразу

Я смотрел и с трудом следовал за тем, что он делает!

В один момент, клод обратился ко мне за помощью: ему надо было, чтобы я поднял трубку и посчитал количество гудков для диагностики. Единственная задача, которую он не смог сделать сам :)

Написал более подробный технический разбор на сабстек: https://ktoyame.substack.com/p/claude-code-hacked-my-rotary-phone


Сегодня был на встрече Секвои с Владом Яценко, техническим директором революта

Оказалось что он совсем не AI-pilled, поэтому было очень интересно послушать!

Больше всего понравилась его идея, как решить проблему канарейки: что джуны в AI экономике не нужны, но любой сеньор когда-то был джуном, поэтому сеньоры потихонечку вымрут.

Влад предложил давать джунам чуть-чуть токенов, чтобы они могли только читать код с AI, а писать приходилось руками.

С каждым повышением количество токенов должно расти, как и уровень абстрактности, на котором оперирует инженер.

Круто!



18 ta oxirgi post ko‘rsatilgan.