Чувашский
CHUVASHПилот · подготовка корпуса
ЛОКАЛЬНЫЙ ИИ. ЖИВЫЕ ЯЗЫКИ.
Дадим знаниям звучать
на родном языке.
YasnoCore LLM — локальная ИИ-платформа с программой развития десяти тюркских языков. Начинаем с чувашского: собираем корпус вместе с партнёрами и языковыми экспертами.
ЯЗЫКОВАЯ ПРОГРАММА / 10
Язык — не просто настройка интерфейса. Для каждого нужны свой корпус, экспертиза носителей и отдельная проверка качества.
От материалов и переводов — к проверенным данным. От данных — к адаптации модели. Затем — к независимым тестам на каждом языке.
Пилот · подготовка корпуса
Планируемая адаптация
Планируемая адаптация
Планируемая адаптация
Планируемая адаптация
Планируемая адаптация
Планируемая адаптация
Планируемая адаптация
Планируемая адаптация
Планируемая адаптация
Расширяем языки по мере готовности материалов и экспертизы. Качество работы на всех десяти языках ещё предстоит подтвердить отдельными тестами.
ПЛАТФОРМА YASNOCORE
Собственная программная система, локальная языковая модель и управляемый процесс подготовки данных — в одном проекте.
Локальный backend 27B на сервере Astra Linux. Внутренний API не публикуется через этот сайт.
Локальный запускТекст, перевод, источник и разрешение связаны в одной записи. История правок и решений сохраняется.
Прослеживаемые источникиЯзыковой эксперт проверяет материал. Администратор отдельно подтверждает право на обучение перед выгрузкой.
Раздельные допускиЧУВАШСКИЙ / РУССКИЙ · СТАРТ ПРОГРАММЫ
Первый этап — подготовка чувашского корпуса для обучения. В закрытом кабинете НТРК добавляет материалы, эксперт проверяет язык, а администратор допускает записи к выгрузке.
Рабочий кабинет ↗Язык выбираем вручную. Распознавание речи не требуется. Сейчас кабинет работает с текстами; аудио, видео и PDF остаются в Архивариусе НТРК.
ОТ МАТЕРИАЛА К МОДЕЛИ
Один процесс для каждого нового языка. Чёткое разделение: что уже работает в кабинете и что станет следующим этапом.
Текст, перевод, источник
В кабинетеСмысл и орфография
В кабинетеРазрешение на обучение
В кабинетеTrain / validation / test
Выгрузка JSONLДообучение и тесты
Следующий этапЗагрузка текста сама по себе не обучает модель. Источники разделяются между выборками, а качество после адаптации проверяется отдельно.
ПО СУЩЕСТВУ
Нет. Десять языков — программа поэтапного развития YasnoCore LLM. Сейчас готовим чувашский корпус. Дообучение и лингвистические тесты — следующие этапы; готовый переводчик на всех языках пока не заявляется.
Партнёры, предоставляющие согласованные материалы, и языковые эксперты. Для НТРК, эксперта и администратора предусмотрены отдельные роли. Учётные данные выдаются персонально.
Последовательное расширение на татарский, башкирский, казахский, кыргызский, азербайджанский, турецкий, узбекский, уйгурский и саха. Очерёдность определяется готовностью корпуса, разрешений и экспертизы, а не обещанной датой.
Нет. Рабочий кабинет закрыт паролем; загрузка не публикует тексты на главной странице. Для включения записи в учебную выгрузку нужны отдельные проверки текста и прав.
YASNOCORE LLM / НАЧНЁМ ВМЕСТЕ
Присоединяйтесь к подготовке первого языкового корпуса.
Ваши материалы и знания носителей — основа следующего этапа.