Если вы просите языковую модель написать в вашем стиле, обычным способом является загрузка большого архива ваших текстов на размещенный сервис. Это создает две проблемы: сигнал стиля смешивается с ненужным материалом, и исходный корпус...
Если вы просите языковую модель написать в вашем стиле, обычным способом является загрузка большого архива ваших текстов на размещенный сервис. Это создает две проблемы: сигнал стиля смешивается с ненужным материалом, и исходный корпус покидает вашу машину.
idioleto использует меньший подход, ориентированный на локальность. Он считывает папку с Markdown, обычными текстовыми файлами или PDF-файлами и записывает проверенный профиль .idiolect JSON. Профиль содержит совокупные измерения записи и выбранные семантические привязки, которые рабочий процесс локальной модели может использовать позже.
В этом руководстве создается профиль на основе выборочного корпуса, проверяется результат и объясняется, где проходит граница конфиденциальности. Проект находится на ранней стадии разработки, поэтому целью является воспроизводимый вертикальный срез, а не претензия на имитацию стиля человеческого уровня.
Что вы построите
В итоге у вас будет файл такой структуры:
идиолето/
примеры/
корпус/
образец.md
образец.идиолект
Результатом является JSON, но расширение .idiolect четко определяет его роль. Текущая версия схемы — 0.1.0. Профиль включает в себя резюме источника, стилометрику и семантические якоря. Компилятору не требуется Ollama или размещенный API.
Репозиторий в настоящее время документируется