ЛОКАЛЬНЫЙ ИИ. ЖИВЫЕ ЯЗЫКИ.

10 языков.
Одна платформа.

Дадим знаниям звучать
на родном языке.

YasnoCore LLM — локальная ИИ-платформа с программой развития десяти тюркских языков. Начинаем с чувашского: собираем корпус вместе с партнёрами и языковыми экспертами.

Сейчас: чувашский пилотПодготовка данных для обучения
10тюркских языков
в программе развития
01первый языковой пилот —
чувашский
Локальномодель на своём сервере,
материалы в закрытом кабинете

ЯЗЫКОВАЯ ПРОГРАММА / 10

От первого пилота —
к многоязычному ядру.

Язык — не просто настройка интерфейса. Для каждого нужны свой корпус, экспертиза носителей и отдельная проверка качества.

АРХИТЕКТУРА ЯЗЫКОВОЙ ПРОГРАММЫ10
Десять языков вокруг платформы YasnoCore LLM Схема программы, не географическая карта. Чувашский — текущий пилот. Татарский, башкирский, казахский, кыргызский, азербайджанский, турецкий, узбекский, уйгурский и саха — следующие направления адаптации. YasnoCoreLLM CV TT BA KK KY AZ TR UZ UG SAH
Текущий пилотНаправления адаптации
01 → 10

Не десять отдельных проектов.
Одна методика развития.

От материалов и переводов — к проверенным данным. От данных — к адаптации модели. Затем — к независимым тестам на каждом языке.

Язык регионаРусский
Русский — язык-посредник для параллельных корпусов. Он не входит в число десяти тюркских языков программы.Посмотреть первый этап ↗
CVПЕРВЫЙ ЭТАП

Чувашский

CHUVASH

Пилот · подготовка корпуса

TTПРОГРАММА РАЗВИТИЯ

Татарский

TATAR

Планируемая адаптация

BAПРОГРАММА РАЗВИТИЯ

Башкирский

BASHKIR

Планируемая адаптация

KKПРОГРАММА РАЗВИТИЯ

Казахский

KAZAKH

Планируемая адаптация

KYПРОГРАММА РАЗВИТИЯ

Кыргызский

KYRGYZ

Планируемая адаптация

AZПРОГРАММА РАЗВИТИЯ

Азербайджанский

AZERBAIJANI

Планируемая адаптация

TRПРОГРАММА РАЗВИТИЯ

Турецкий

TURKISH

Планируемая адаптация

UZПРОГРАММА РАЗВИТИЯ

Узбекский

UZBEK

Планируемая адаптация

UGПРОГРАММА РАЗВИТИЯ

Уйгурский

UYGHUR

Планируемая адаптация

SAHПРОГРАММА РАЗВИТИЯ

Саха (якутский)

SAKHA

Планируемая адаптация

Расширяем языки по мере готовности материалов и экспертизы. Качество работы на всех десяти языках ещё предстоит подтвердить отдельными тестами.

ПЛАТФОРМА YASNOCORE

Ваши знания.
Ваша инфраструктура.

Собственная программная система, локальная языковая модель и управляемый процесс подготовки данных — в одном проекте.

ИНФРАСТРУКТУРА

Модель рядом
с вашими данными

Локальный backend 27B на сервере Astra Linux. Внутренний API не публикуется через этот сайт.

Локальный запуск
ЗНАНИЯ ПАРТНЁРОВ

Корпус,
а не набор файлов

Текст, перевод, источник и разрешение связаны в одной записи. История правок и решений сохраняется.

Прослеживаемые источники
ЭКСПЕРТИЗА ЧЕЛОВЕКА

Проверка смысла.
Не только букв.

Языковой эксперт проверяет материал. Администратор отдельно подтверждает право на обучение перед выгрузкой.

Раздельные допуски

ЧУВАШСКИЙ / РУССКИЙ · СТАРТ ПРОГРАММЫ

Большой путь
начинается
с родного языка.

Первый этап — подготовка чувашского корпуса для обучения. В закрытом кабинете НТРК добавляет материалы, эксперт проверяет язык, а администратор допускает записи к выгрузке.

Рабочий кабинет ↗

Язык выбираем вручную. Распознавание речи не требуется. Сейчас кабинет работает с текстами; аудио, видео и PDF остаются в Архивариусе НТРК.

ӐӖҪӲ
ЧУВАШСКИЙ · ПИЛОТCV ↔ RU

Человек сохраняет смысл.
Технология помогает масштабировать.

01
НТРК / партнёрМатериал и русский перевод
02
Языковой экспертОрфография, смысл, соответствие
03
Администратор ЯСНОКОРДопуск по правам и выгрузка

ОТ МАТЕРИАЛА К МОДЕЛИ

Обучение начинается
задолго до кнопки «обучить».

Один процесс для каждого нового языка. Чёткое разделение: что уже работает в кабинете и что станет следующим этапом.

  1. 01

    Материал

    Текст, перевод, источник

    В кабинете
  2. 02

    Эксперт

    Смысл и орфография

    В кабинете
  3. 03

    Допуск

    Разрешение на обучение

    В кабинете
  4. 04

    Корпус

    Train / validation / test

    Выгрузка JSONL
  5. 05

    Адаптация

    Дообучение и тесты

    Следующий этап
Качественные данные → проверяемый результат

Загрузка текста сама по себе не обучает модель. Источники разделяются между выборками, а качество после адаптации проверяется отдельно.

ПО СУЩЕСТВУ

Что важно знать
о программе.

Модель уже проверена на всех десяти языках?

Нет. Десять языков — программа поэтапного развития YasnoCore LLM. Сейчас готовим чувашский корпус. Дообучение и лингвистические тесты — следующие этапы; готовый переводчик на всех языках пока не заявляется.

Кто может участвовать в первом пилоте?

Партнёры, предоставляющие согласованные материалы, и языковые эксперты. Для НТРК, эксперта и администратора предусмотрены отдельные роли. Учётные данные выдаются персонально.

Что будет после чувашского?

Последовательное расширение на татарский, башкирский, казахский, кыргызский, азербайджанский, турецкий, узбекский, уйгурский и саха. Очерёдность определяется готовностью корпуса, разрешений и экспертизы, а не обещанной датой.

Материалы сразу становятся публичными?

Нет. Рабочий кабинет закрыт паролем; загрузка не публикует тексты на главной странице. Для включения записи в учебную выгрузку нужны отдельные проверки текста и прав.

YASNOCORE LLM / НАЧНЁМ ВМЕСТЕ

У языка есть будущее.
Давайте создавать его.

Присоединяйтесь к подготовке первого языкового корпуса.
Ваши материалы и знания носителей — основа следующего этапа.

Войти в пилот ↗Обсудить участие ↗Персональный доступ для партнёров и экспертов