Искра Мы с другом не смогли удержаться от тестирования. Мы говорили с ним на нашем родном языке, почти ожидая, что оно начнет что-то путать. Это не так. Он следовал за нами и бегло отвечал, и этот небольшой момент «подожди, он действительно нас понял»…
Искра
Все началось обычным утром в июне 2024 года. Я проснулся от новости о том, что OpenAI представила новую возможность — модели GPT теперь могут вести настоящие, естественно звучащие разговоры. Не неестественный пошаговый обмен текстовыми сообщениями, к которым я привык, а что-то, что было ближе к реальному разговору с кем-то.
Мы с другом не смогли удержаться от тестирования. Мы говорили с ним на нашем родном языке, почти ожидая, что оно начнет что-то путать. Это не так. Он следовал за мной и бегло отвечал, и этот небольшой момент «подожди, он действительно нас понял» запомнился мне до конца дня.
К тому времени, когда я вернулся домой, у меня возникла идея: что, если бы та же самая разговорная способность могла быть встроена в музыкальное приложение — как диджей, раскручивающий домашнюю вечеринку, или радиожокей, разговаривающий между песнями? Что-то, что реагировало на то, что играло, и поддерживало энергию, как это делает хороший RJ на радио во время поездки.
От идеи до первого прототипа
Я не стал долго ждать, чтобы начать. Я начал разговор с самим ChatGPT, чтобы продумать подход — какие части мне понадобятся, как они должны будут взаимодействовать друг с другом, что реально построить в одиночку. Грубый план включал получение данных о воспроизводимом в данный момент треке, плате