Перейти к содержимому
Новости
Исследования
← Все исследования

ORCNEIT Lab / № 04 / Обзор результатов · В работе

ORCNEITGPT: с чего начался проект и к чему пришёл

Период наблюдений
—
Опубликовано

Аннотация

От первых экспериментов с собственной языковой моделью до пересмотра обучения и подготовки нового корпуса. Что удалось проверить, какие подходы не дали нужного результата и почему проект менял направление.

Постановка задачи

Как менялся подход к созданию ORCNEITGPT после первых работающих прототипов, расширения проверок и неудачных попыток улучшить модель?

Условия и методика

Рассказ охватывает подтверждённые работы с 13 июня по 30 сентября 2026 года. Даты обозначают эксперименты и решения, а не даты появления статей. Ранние работы над проектом предшествовали регистрации компании. Это обзор результатов, не перечень всех изменений разработки.

В каждом сравнении различаем три вещи: собственную языковую модель, внешние правила управления ответами и инструмент измерения. Показатели разных моделей, заданий и режимов нельзя складывать в общую кривую прогресса.

Приведённые ниже числа проверены по сохранённым итогам экспериментов. Для отдельных вопросов опубликованы самостоятельные работы с методикой, таблицами и числовыми приложениями. Общий обзор связывает эти результаты и объясняет решения, но не заменяет их ограничения.

Состояние подготовки нового большого корпуса зафиксировано по последним завершённым записям сентября. Незавершённая обработка не считается принятой выборкой. Целевой объём не выдаётся за уже готовые данные или выполненное обучение.

Измерения

Результат

Проект прошёл путь от небольшого прототипа к собственному обучению и более строгой проверке результата. Готовая разговорная модель пока не получена.

ORCNEITGPT: с чего начался проект и к чему пришёл — Результат
ПоказательНаблюдениеИнтерпретация
Начало работ13 июня 2026Собственная обработка текста, обучение и генерация
Расширенная ранняя проверка29 / 79 → 72 / 79Модель → система с правилами; не рост способностей весов
Финальная проверка обучения памяти0 / 246 заданийПосле исправления обработки многострочных ответов
Короткая проверка округления7,76 × 10⁻⁸ → 8,58 × 10⁻¹⁰Модуль среднего знакового отклонения записи обновления
Завершённое базовое обучение в августе80 000 шагов; 327 680 000 предъявлений токеновПроверка качества не пройдена
Диалоговое дообучение0 → 43 правильных ответа из 256Улучшение есть, критерии приёмки не выполнены
Новый большой корпусПодготовка продолжается4 млрд токенов — цель, не принятый объём

Обсуждение

Июнь: проект начался с собственного небольшого ядра. Были реализованы представление текста, обучение предсказанию следующего токена, генерация и общение через интерфейс. Первые тесты проверяли, что цепочка работает; они не доказывали широкий круг знаний или устойчивое выполнение новых инструкций.

Расширение проверки изменило картину: сама ранняя модель прошла 29 из 79 заданий, система с внешними правилами — 72. В некоторых сценариях правила вообще заменяли вызов модели заранее подготовленным ответом. Именно поэтому удачный ответ интерфейса нельзя автоматически считать способностью нейросети. Позднее внешнюю защиту измеряли отдельно, сохраняя результат исходной модели.

Следующий вопрос — память. Отдельная система хранения могла подтверждать, удалять и предоставлять записи, но это ещё не означало, что модель умеет выбирать сведения и соблюдать протокол их изменения. Три попытки дообучения показали потерю прежних навыков и частичную пользу их повторения. В финальной корректно измеренной проверке ни одно из 246 заданий памяти не было выполнено успешно. Направление потребовало пересмотра, а не заявления о готовой памяти.

В конце июня была проверена собственная архитектура миллиардного масштаба, затем проведены более крупные обучающие эксперименты. Увеличение масштаба само по себе не сняло проблем. В июле исследовали исчезновение малых обновлений при округлении и сравнивали токенизацию через пробное обучение на одинаковом исходном тексте, а не только через степень сжатия.

Август: продолжение одной из ранних моделей почти не изменило суммарный результат генерации — 497 и 499 тяжёлых нарушений из 1 600 ответов. Короткие контрольные вмешательства не дали принятого исправления. Решили заново проверить данные и обработку текста, а следующую модель обучать с новой случайной инициализации.

22–23 августа завершилось базовое обучение на 80 000 шагов. На отдельной проверке получен 161 правильный ответ из 640, при требуемом минимуме 167; дополнительно превышен допустимый уровень регрессий. Дообучение для диалога улучшило завершение ответов и сократило повторы, но дало лишь 43 правильных ответа из 256. Оба результата опубликованы как завершённые эксперименты, а не выпуск готового ассистента.

Сентябрь: основной вопрос сместился к подготовке более разнообразных данных. Источники проверяют по содержанию и происхождению, исключают дубликаты и пересечения с контрольными выборками. На конец сентября окончательная приёмка большого корпуса не завершена. Следующее обучение должно опираться на принятые данные и заранее определённые критерии качества; дата готовности модели этим обзором не обещается.

Ограничения

Это ретроспектива собственных экспериментов, не независимая экспертиза и не сравнение с ведущими коммерческими моделями. Успешное исполнение обучения и снижение ошибки не доказывают готовность продукта.

Числа из ранних, поздних и диалоговых проверок имеют разные выборки и определения. Их нельзя сравнивать как один и тот же тест. Подробности и оговорки приведены в соответствующих исследованиях.

Обзор не объявляет все перечисленные методы новыми научными открытиями. Он показывает измеренные результаты проекта, включая отрицательные, и причины принятых решений. Работы после 30 сентября в эту фиксацию состояния не включены.

Источник данных: итоговые измерения и проверки ORCNEIT.