DeepSeek V4 Flash, обрезанный под задачу разработки в 1С

03.09.26

Интеграция - Нейросети

Обрезанная на 25% версия DeepSeek V4 Flash с попыткой сохранения способностей в кодинге на 1С.

Введение

Развертывание локальных LLM является распространённой практикой в наше время.

Существуют компактные модели вроде Qwen 3.6 или Gemma 4, которые можно запустить даже на потребительских видеокартах, но их возможностей часто не хватает.

Для тех, у кого немного больше VRAM, хорошим вариантом будет DeepSeek V4 Flash. Полноценная, без квантования, версия весит 167 ГБ. Модель достаточно умная и при этом относительно экономичная в плане KV-кеша. Для написания кода на 1С, конечно, будет заметно хуже топовых моделей, но явно сильно лучше, чем небольшие Qwen и Gemma.

Однако, 167 ГБ тоже немало.

 

Что можно сделать?

В современных моделях с архитектурой MoE модель разделена на множество отдельных "экспертов" и на каждый токен активируется только часть из них.

Для решения задач определённого типа не все эксперты нужны, и часть из них в целом может быть удалена. И, соответственно, это я и попробовал сделать.

 

Что получилось?

Модель доступна на HF: https://huggingface.co/kn322/DeepSeek-V4-Flash-0731-os-192e

Из 256 экспертов было удалено 25%, то есть 64. Осталось 192 эксперта.

Для упрощения задачи в процессе прунинга из модели был убран модуль DSpark, поэтому эта версия будет работать медленней, чем 0731. На уровне изначальной модели без спекулятивного декодирования. Но, так как из-за этого модель потеряла ещё где-то 6 ГБ, то удаление DSpark тоже способствует основной цели - уменьшению размера чекпоинта.

Для проверки результата я использовал бенчмарк PRISM (genlab-1c на github). Кажется, он единственный, который активно развивается, и его можно прогнать самостоятельно у себя на машине. 

В PRISM уже есть оригинальный DeepSeek Flash, с результатами которого можно сравнить результат пруненой модели.

Модель со 192 экспертами весит 119 ГБ. Тестировал я на видеокарте H200 с 141 ГБ VRAM.

Результаты моего тестирования и результаты оригинальной модели с сайта бенчмарка:

 

Модель Категория задач % решеных задач Итоговый балл
Оригинальная А, алгоритмика 67% 7.96
Пруненая A, алгоритмика 40%

7.28

       
Оригинальная B, платформенные 45% 7.08
Пруненая B, платформенные 55% 7.34

 

Результаты получились, кажется, примерно на уровне оригинальной модели. Категория B, почему-то, даже стала немного лучше) 

Подробно сравнивать код и приводить примеры я не стал. Бенчмарк оценивает код, сгенерированный с первой попытки, без проверки синтаксиса и доступа к синтаксис-помощнику. Думаю, если дать модели ещё проверку синтаксиса и доступ к справке, то результаты будут сильно лучше.

 

ВНИМАНИЕ!

Это не дообученная модель, а обрезанная оригинальная. Модель не получила новые знания, а потеряла ту часть, которая не должна была влиять на работу с кодом в 1С.

 

Заключение

Данный проект - это больше эксперимент, проведенный "на скорую руку". Потому что арендовать под это карты по 10$ в час выходит дороговато. А результат получился, в целом, нормальный.

Буду рад любой обратной связи и тестам. Если у вас есть возможность сравнить работу моделей - делитесь результатами в комментариях.

 

____________________________________________________________________

Возможно, вам будут интересны мои предыдущие публикации:

1. Редактор кода для "1С:Документооборот 3"

2. Проверка запросов на лишнюю выборку и разыменование полей составного типа

3. Редактор форм в режиме предприятия

4. Soratnik 0.1: LLM, которая немного знает 1С:Элемент

Вступайте в нашу телеграмм-группу Инфостарт

Вы можете заказать платную адаптацию этой статьи под ваши задачи на «Бирже заказов».

  • 0% комиссии — оплата напрямую исполнителю;
  • Исполнители любого масштаба — от отдельных специалистов до команд под проект;
  • Прямой обмен контактами между заказчиком и исполнителем;
  • Безопасная сделка — при необходимости;
  • Рейтинги, кейсы и прозрачная система откликов.

См. также

SALE! %

Банковские операции Обмен с интернет-банком Мастера заполнения Нейросети Программист Бухгалтер Пользователь 1С:Предприятие 8 1C:ERP 1С:Бухгалтерия 3.0 1С:ERP Управление предприятием 2 1С:Управление холдингом 1С:ERP. Управление холдингом 1С:Комплексная автоматизация 2.х 1С:Управление нашей фирмой 3.0 1С:Управление торговлей 11 1С:Розница 3.0 Платные (руб)

Корректируйте банковские документы быстро и легко! Создайте правило обработки — и оно автоматически применится при загрузке выписки (отбор по любому реквизиту или регулярному выражению). Решение заполняет расшифровку платежа, комиссию эквайринга, подбирает ведомости на выплату зарплаты, помечает дубли из банка на удаление и многое другое. Доплачивать за алгоритмы не нужно — они включены в решение. Обработка работает при загрузке из файлов клиент-банка и через DirectBank. Новое — искусственный интеллект: модель приводит нестандартные назначения платежа к виду, понятному алгоритмам, а ИИ-ассистент прямо в 1С консультирует по решению и разбирает код правил и алгоритмов. Поддерживаются локальные и облачные OpenAI-совместимые модели — данные могут не покидать ваш контур.

15250 руб.

20.12.2024    18656    95    29    

80

Инструментарий разработчика Нейросети Платные (руб)

Первые попытки разработки на 1С с использованием больших языковых моделей (LLM) могут разочаровать. LLMки сильно галлюцинируют, потому что не знают устройства конфигураций 1С, не знают нюансов синтаксиса. Но если дать им подсказки с помощью MCP, то результат получается кардинально лучше. Далее в публикации: MCP для поиска по метаданным 1С, справке синтакс-помощника и проверки синтаксиса.

15250 руб.

25.08.2025    68980    139    41    

145

Нейросети Программист Бесплатно (free)

Первая часть подборки простых приёмов для работы с ИИ-агентами. Без «секретных техник» — скорее сверим часы и посмотрим, какие подходы действительно помогают экономить время, лимиты и нервы. Разберём шесть практических приёмов: как выбирать модель под задачу и не тратить дорогую модель на мелочи; зачем сначала составлять план сложной работы; как сохранять агентские сессии на VPS с помощью tmux и Herdr; почему голосовой ввод даёт больше контекста, но требует проверки; как перепроверять решения одного агента другим; и как организовать параллельную работу через Git worktree. Большинство этих вещей опытным пользователям наверняка знакомо. Но иногда именно «очевидная» мелочь оказывается той, о которой узнаёшь слишком поздно. Возможно, из этой подборки вам пригодится хотя бы один приём.

04.09.2026    734    Ibrogim    1    

10

Нейросети Программист 1С:Предприятие 8 Россия Бесплатно (free)

Как связать 1С и Cursor через MCP так, чтобы AI-агент сам получал актуальную конфигурацию из информационной базы, находил нужный BSL-код, вносил изменения, загружал конфигурацию обратно и запускал 1С:Предприятие. В статье — настройка 1C: Platform Tools, 1C: Platform Tools MCP, OneScript, vanessa-runner и env.json, а также важные нюансы при работе с несколькими проектами, IPC-портами, большими конфигурациями и длительными операциями загрузки. Покажу полный практический цикл на тестовой базе без ручной выгрузки и загрузки XML через Конфигуратор.

28.08.2026    14276    rinat1c    16    

30

Нейросети Программист 1С:Предприятие 8 Бесплатно (free)

Новый UI-контур CodexTestBridge запускает штатные TestClient/TestManager и даёт ИИ-агенту семантические действия вместо координат. Результаты возвращаются по шагам, долгие операции сопровождаются heartbeat. На реальной БП 3.0 открываем и заполняем приходную накладную без записи.

26.08.2026    2162    Aleksandr    3    

9

Нейросети Программист Бесплатно (free)

Практический эксперимент по использованию ИИ при обновлении расширений 1С. Сравниваются GigaChat-2-Pro и локальный Qwen3-Coder 30B на реальных конфликтах BSL-кода. Показано, как модели анализируют изменения типовой конфигурации, где могут ошибаться даже с высокой уверенностью и почему рекомендации AI необходимо дополнительно проверять алгоритмически и в тестовой базе 1С.

24.08.2026    1675    aldar    13    

8

Нейросети Программист 1С:Предприятие 8 Бесплатно (free)

В этой статье расскажу, как реализовал с помощью LLM полноценную генерацию кода для 1С (BSL) в популярном Open Source API-клиенте Bruno.

21.08.2026    1736    malikov_pro    9    

11

Нейросети Программист 1С 8.3 Бесплатно (free)

Один проход модели по вопросу из 28 знаков стоит 631 296 умножений и 4,8 секунды. Столько берёт языковая модель на 21 920 параметров, посчитанная прямо в 1С средствами самой платформы. На ней разбираю по шагам, что стоит за каждым словом из модного словаря: токен, словарь, вектор символа, вес, слой, голова внимания, контекст, softmax, температура, KV-кэш. Отдельно про температуру - она вообще не про креативность и управляет выбором буквы уже после того, как модель закончила работу. Отдельно про галлюцинацию - показываю в цикле генерации место, куда физически невозможно вставить "не знаю". Плюс расчёт потолка для встроенного языка, замер цены размера модели и история про метод платформы, которого не существует.

20.08.2026    5827    nedomolkov.ivan    16    

24
Комментарии
Подписаться на ответы Инфостарт бот Сортировка: Древо развёрнутое
Свернуть все
1. aximo 2751 03.09.26 18:20 Сейчас в теме
очень плохо работает с языком 1с... находит какие-то фейковые сайты и от туда предлагает за истину....
4. krasnov322 117 04.09.26 09:10 Сейчас в теме
(1) если я правильно понял, вы описали работу в чате через веб-интерфейс. А я тут про работу в кодинговых и прочих агентах с он прем моделью.

Для разворачивания на своих серверах, лучше, пока что, чем DS Flash, в этой весовой категории я не знаю.
2. gybson 13 03.09.26 20:45 Сейчас в теме
Давно с этой моделькой работаю, она и так стоит копейки, но если кому нужна именно локальная, то хороший выход.
Конечно не грок, но получить от неё толк очень даже можно, особенно в хорошо настроенной агентской среде.
3. andrew.ab 273 04.09.26 08:23 Сейчас в теме
Автор, погоняй на бенчмарке prism эти модели https://infostart.ru/1c/articles/2753290/.

Я почитал про prism, но так и не смог развернуть у себя.
krasnov322; +1 Ответить
Для отправки сообщения требуется регистрация/авторизация