Перейти к содержимому
Новости
Исследования
Все новости

Исследования · ORCNEIT

На ORCNEIT Lab появился раздел «Исследования»

Начинаем с двух работ о реальном обучении нашей языковой модели: базовом запуске и дообучении для диалога. Внутри — измерения, графики, методика и ограничения результатов.

Опубликовано:

От рассказа о планах — к измерениям

Страница ORCNEITGPT рассказывает, какую систему мы хотим создать. Новый раздел отвечает на другой вопрос: что уже проверили экспериментом и какой результат получили. Эти два рассказа нельзя подменять друг другом.

В «Исследованиях» каждая работа оформлена отдельно: вопрос, условия проверки, измерения, выводы и ограничения. Указаны даты самого эксперимента и публикации на сайте. Значения графиков можно посмотреть в таблице или скачать в CSV.

Первый материал: обучение базовой модели

Публикуем результаты запуска 22–23 августа 2026 года. Модель обучалась с новой случайной инициализации и прошла 80 000 шагов. Объём работы — 327,68 млн предъявленных обучающих токенов, включая повторные проходы, а не столько же уникального текста.

В статье показано изменение train и dev loss и результат отдельной проверки способностей. Обучение завершилось, однако совокупный критерий качества модель не прошла. Мы оставили этот вывод рядом с графиком, потому что снижение ошибки предсказания ещё не означает готовности ассистента.

Второй материал: что дало дообучение для диалога

Во второй работе сравниваем исходную и дообученную модели на одинаковых заданиях. После дообучения ответы стали лучше завершаться и реже распадаться в повторы. Но правильно решённых задач всё ещё недостаточно для приёмки ассистента.

Это не история о готовом продукте. Это результат конкретного эксперимента с изменением весов, измеренными улучшениями и оставшимися проблемами.

Две работы с методикой, графиками и таблицами результатов.

Открыть исследования