DeepSeek V4 Flash, обрезанный под задачу разработки в 1С

03.09.26

Интеграция - Нейросети

Обрезанная на 25% версия DeepSeek V4 Flash с попыткой сохранения способностей в кодинге на 1С.

Введение

Развертывание локальных LLM является распространённой практикой в наше время.

Существуют компактные модели вроде Qwen 3.6 или Gemma 4, которые можно запустить даже на потребительских видеокартах, но их возможностей часто не хватает.

Для тех, у кого немного больше VRAM, хорошим вариантом будет DeepSeek V4 Flash. Полноценная, без квантования, версия весит 167 ГБ. Модель достаточно умная и при этом относительно экономичная в плане KV-кеша. Для написания кода на 1С, конечно, будет заметно хуже топовых моделей, но явно сильно лучше, чем небольшие Qwen и Gemma.

Однако, 167 ГБ тоже немало.

 

Что можно сделать?

В современных моделях с архитектурой MoE модель разделена на множество отдельных "экспертов" и на каждый токен активируется только часть из них.

Для решения задач определённого типа не все эксперты нужны, и часть из них в целом может быть удалена. И, соответственно, это я и попробовал сделать.

 

Что получилось?

Модель доступна на HF: https://huggingface.co/kn322/DeepSeek-V4-Flash-0731-os-192e

Из 256 экспертов было удалено 25%, то есть 64. Осталось 192 эксперта.

Для упрощения задачи в процессе прунинга из модели был убран модуль DSpark, поэтому эта версия будет работать медленней, чем 0731. На уровне изначальной модели без спекулятивного декодирования. Но, так как из-за этого модель потеряла ещё где-то 6 ГБ, то удаление DSpark тоже способствует основной цели - уменьшению размера чекпоинта.

Для проверки результата я использовал бенчмарк PRISM (genlab-1c на github). Кажется, он единственный, который активно развивается, и его можно прогнать самостоятельно у себя на машине. 

В PRISM уже есть оригинальный DeepSeek Flash, с результатами которого можно сравнить результат пруненой модели.

Модель со 192 экспертами весит 119 ГБ. Тестировал я на видеокарте H200 с 141 ГБ VRAM.

Результаты моего тестирования и результаты оригинальной модели с сайта бенчмарка:

 

Модель Категория задач % решеных задач Итоговый балл
Оригинальная А, алгоритмика 67% 7.96
Пруненая A, алгоритмика 40%

7.28

       
Оригинальная B, платформенные 45% 7.08
Пруненая B, платформенные 55% 7.34

 

Результаты получились, кажется, примерно на уровне оригинальной модели. Категория B, почему-то, даже стала немного лучше) 

Подробно сравнивать код и приводить примеры я не стал. Бенчмарк оценивает код, сгенерированный с первой попытки, без проверки синтаксиса и доступа к синтаксис-помощнику. Думаю, если дать модели ещё проверку синтаксиса и доступ к справке, то результаты будут сильно лучше.

 

ВНИМАНИЕ!

Это не дообученная модель, а обрезанная оригинальная. Модель не получила новые знания, а потеряла ту часть, которая не должна была влиять на работу с кодом в 1С.

 

Заключение

Данный проект - это больше эксперимент, проведенный "на скорую руку". Потому что арендовать под это карты по 10$ в час выходит дороговато. А результат получился, в целом, нормальный.

Буду рад любой обратной связи и тестам. Если у вас есть возможность сравнить работу моделей - делитесь результатами в комментариях.

 

____________________________________________________________________

Возможно, вам будут интересны мои предыдущие публикации:

1. Редактор кода для "1С:Документооборот 3"

2. Проверка запросов на лишнюю выборку и разыменование полей составного типа

3. Редактор форм в режиме предприятия

4. Soratnik 0.1: LLM, которая немного знает 1С:Элемент

Вступайте в нашу телеграмм-группу Инфостарт

Вы можете заказать платную адаптацию этой статьи под ваши задачи на «Бирже заказов».

  • 0% комиссии — оплата напрямую исполнителю;
  • Исполнители любого масштаба — от отдельных специалистов до команд под проект;
  • Прямой обмен контактами между заказчиком и исполнителем;
  • Безопасная сделка — при необходимости;
  • Рейтинги, кейсы и прозрачная система откликов.

См. также

SALE! %

Банковские операции Обмен с интернет-банком Мастера заполнения Нейросети Разработчик Бухгалтер Пользователь 1С:Предприятие 8 1C:ERP 1С:Бухгалтерия 3.0 1С:ERP Управление предприятием 2 1С:Управление холдингом 1С:ERP. Управление холдингом 1С:Комплексная автоматизация 2.х 1С:Управление нашей фирмой 3.0 1С:Управление торговлей 11 1С:Розница 3.0 Платные (руб)

Корректируйте банковские документы быстро и легко! Создайте правило обработки — и оно автоматически применится при загрузке выписки (отбор по любому реквизиту или регулярному выражению). Решение заполняет расшифровку платежа, комиссию эквайринга, подбирает ведомости на выплату зарплаты, помечает дубли из банка на удаление и многое другое. Доплачивать за алгоритмы не нужно — они включены в решение. Обработка работает при загрузке из файлов клиент-банка и через DirectBank. Новое — искусственный интеллект: модель приводит нестандартные назначения платежа к виду, понятному алгоритмам, а ИИ-ассистент прямо в 1С консультирует по решению и разбирает код правил и алгоритмов. Поддерживаются локальные и облачные OpenAI-совместимые модели — данные могут не покидать ваш контур.

17500 руб.

20.12.2024    19812    104    32    

85

Нейросети Системный администратор Разработчик Аналитик Бухгалтер Пользователь Руководитель проекта 1С 8.3 1С:Документооборот 1С:Бухгалтерия 3.0 1С:Зарплата и Управление Персоналом 3.x Россия Платные (руб)

Задавайте вопросы базе 1С обычными словами: получайте данные, находите ошибки и связанные документы, проверяйте права, работайте с вложениями и контролируемо вносите изменения. Всё это работает в самой программе, а Codex и Claude подключаются по желанию.

16990 руб.

30.07.2026    13678    29    4    

28

Инструментарий разработчика Нейросети Платные (руб)

Первые попытки разработки на 1С с использованием больших языковых моделей (LLM) могут разочаровать. LLMки сильно галлюцинируют, потому что не знают устройства конфигураций 1С, не знают нюансов синтаксиса. Но если дать им подсказки с помощью MCP, то результат получается кардинально лучше. Далее в публикации: MCP для поиска по метаданным 1С, справке синтакс-помощника и проверки синтаксиса.

15250 руб.

25.08.2025    71758    142    41    

150

Распознавание документов и образов Нейросети 1С:Предприятие 8 1С 8.3 1С 8.5 1C:Бухгалтерия 1С:Зарплата и Управление Персоналом 3.x Беларусь Россия Казахстан Армения Платные (руб)

ИИ-сканер документов с REST API для интеграции с 1С и корпоративными системами. Извлекайте данные из счетов, паспортов, дипломов, патентов и трудовых книжек за секунды. Точность человека - скорость машины. Приложение поддерживает восемь типов документов, четырех провайдеров ИИ (имеется возможность использования локальных ИИ), локальный REST API и экспорт в JSON. Важно! модель должна поддерживать функцию Vision (распознавание файлов и картинок). Запускайте используя локальные ИИ, без подписок и ограничений

6100 руб.

24.08.2026    629    3    0    

1

Нейросети Разработчик 1С 8.3 Бесплатно (free)

Как устроен ИИ-агент, который работает в открытом сеансе пользователя 1С: показывает найденные документы в штатных списках, считает суммы типовыми отчётами, меняет данные только после подтверждения в форме предпросмотра и не передаёт модели персональные данные. Архитектура на MCP внутри тонкого клиента, приёмы и подводные камни, проверка на «Бухгалтерии предприятия 3.0».

вчера в 15:30    438    oyti    26    

11

Инструментарий разработчика Нейросети Разработчик 1С:Предприятие 8 Абонемент ($m)

MCP-сервер даёт модели всю цепочку правки кода: найти метод, показать изменения построчно, внести, загрузить в базу с проверкой синтаксиса и проверить результат на живых данных. Плюс перенос данных между базами со сверкой остатков, поиск по коду и по смыслу, проверка выдуманных вызовов и аргументов, обезличивание персональных данных на выходе. И главное: пока не выполнено обновление из хранилища, сервер отказывается править и загружать. Инструмент умеет говорить «нет» — в статье есть кадр с таким отказом.

6 стартмани

24.09.2026    4949    7    Rafael-87    16    

12

Нейросети 1С:Управление торговлей 11 Бесплатно (free)

Я не считаю покупку специализированных платных инструментов обязательной для разработки с ИИ: нужную обвязку тоже можно создать с агентом. Показываю этот подход на расширении УТ 11 с динамическим списком остатков. Одно задание Codex, 37 минут до проверки, работающая форма. Рассказываю, как устроено окружение, почему первую попытку пришлось переснять и что получилось в повторном прогоне.

17.09.2026    6315    107    Ibrogim    63    

20

Нейросети Разработчик Руководитель проекта 1C:ERP Бесплатно (free)

Служба на Rust, через которую Claude Code, Cursor или другой MCP-клиент вызывает узких ИИ-агентов. Агент — папка с prompt.md и config.toml, модель — строка в конфиге: DeepSeek, Claude Code по подписке, Codex или локальная модель. Агент получает MCP-инструменты, работает в фоне, каждый ход записывается. Внутри — цифры за три месяца: 10 351 вызов, 78 агентов.

17.09.2026    1902    0    Sorm    10    

11
Комментарии
Подписаться на ответы Инфостарт бот Сортировка: Древо развёрнутое
Свернуть все
1. aximo 2751 03.09.26 18:20 Сейчас в теме
очень плохо работает с языком 1с... находит какие-то фейковые сайты и от туда предлагает за истину....
4. krasnov322 119 04.09.26 09:10 Сейчас в теме
(1) если я правильно понял, вы описали работу в чате через веб-интерфейс. А я тут про работу в кодинговых и прочих агентах с он прем моделью.

Для разворачивания на своих серверах, лучше, пока что, чем DS Flash, в этой весовой категории я не знаю.
2. gybson 13 03.09.26 20:45 Сейчас в теме
Давно с этой моделькой работаю, она и так стоит копейки, но если кому нужна именно локальная, то хороший выход.
Конечно не грок, но получить от неё толк очень даже можно, особенно в хорошо настроенной агентской среде.
3. andrew.ab 294 04.09.26 08:23 Сейчас в теме
Автор, погоняй на бенчмарке prism эти модели https://infostart.ru/1c/articles/2753290/.

Я почитал про prism, но так и не смог развернуть у себя.
krasnov322; +1 – Ответить
5. KNOSSOS 07.09.26 06:24 Сейчас в теме
Полноценная, без квантования, версия весит 167 ГБ. А на какое оборудование рассчитана ваша модель, учитывая, что для более-менее полноценной разработки (личное наблюдение) нужно хотя бы полмиллиона контекста?
6. krasnov322 119 17.09.26 13:59 Сейчас в теме
(5) Так как архитектура и количество активных параметров не изменилось, то требования по KV-кешу как у обычного дипсика. Поэтому лучше будет посмотреть сколько с вашей нагрузкой нужно будет VRAM для обычного дипсика (который весит 167 ГБ) и вычесть 48 ГБ (так как этот вариант весит 119).
То есть веса весят меньше, но остальные все требования не изменились.
Для отправки сообщения требуется регистрация/авторизация