Исследования · ORCNEIT
На ORCNEIT Lab появился раздел «Исследования»
Начинаем с двух работ о реальном обучении нашей языковой модели: базовом запуске и дообучении для диалога. Внутри — измерения, графики, методика и ограничения результатов.
Опубликовано:
От рассказа о планах — к измерениям
Страница ORCNEITGPT рассказывает, какую систему мы хотим создать. Новый раздел отвечает на другой вопрос: что уже проверили экспериментом и какой результат получили. Эти два рассказа нельзя подменять друг другом.
В «Исследованиях» каждая работа оформлена отдельно: вопрос, условия проверки, измерения, выводы и ограничения. Указаны даты самого эксперимента и публикации на сайте. Значения графиков можно посмотреть в таблице или скачать в CSV.
Первый материал: обучение базовой модели
Публикуем результаты запуска 22–23 августа 2026 года. Модель обучалась с новой случайной инициализации и прошла 80 000 шагов. Объём работы — 327,68 млн предъявленных обучающих токенов, включая повторные проходы, а не столько же уникального текста.
В статье показано изменение train и dev loss и результат отдельной проверки способностей. Обучение завершилось, однако совокупный критерий качества модель не прошла. Мы оставили этот вывод рядом с графиком, потому что снижение ошибки предсказания ещё не означает готовности ассистента.
Второй материал: что дало дообучение для диалога
Во второй работе сравниваем исходную и дообученную модели на одинаковых заданиях. После дообучения ответы стали лучше завершаться и реже распадаться в повторы. Но правильно решённых задач всё ещё недостаточно для приёмки ассистента.
Это не история о готовом продукте. Это результат конкретного эксперимента с изменением весов, измеренными улучшениями и оставшимися проблемами.
Две работы с методикой, графиками и таблицами результатов.
Открыть исследования