российские нейросети против западных: матрица выбора для бизнеса
российские модели против западных: матрица комплаенс/качество/цена, когда закон реально требует рф-модель, и гибридные схемы, где не надо выбирать.
неправильный вопрос
«российские или западные?» — постановка, которая сразу ведёт не туда. правильная: «какие мои задачи требуют рф-модели по закону, а какие нет». потому что ответ почти никогда не «всё в одну корзину» — у нормальной компании часть задач обязана жить на российской модели, а часть выигрывает от западной, и это спокойно совмещается. разберём по трём осям, потом соберём в схему.
ось 1: комплаенс — где закон реально требует рф
тут важно отделить реальные требования от самозапугивания.
рф-модель обязательна или почти обязательна:
- персональные данные в промптах. 152-фз требует обработки персданных россиян на территории рф. если в запрос к модели уходят фио, телефоны, адреса клиентов — западный api ставит вас в серую зону. оговорка: я не юрист, трактовки бывают разные — на границе случаев спросите своего.
- госсектор, кии, оборонка. внутренние политики и регуляторика чаще всего прямо запрещают зарубежные api — выбор идёт между российскими моделями и on-premise.
- банки и страхование. регуляторные требования и внутренняя безопасность обычно дожимают до рф-контура, даже где формально есть люфт.
рф-модель не обязательна:
- обезличенные данные — категоризация без имён, тексты без реквизитов;
- внутренние черновики, код, аналитика без персданных;
- публичный контент — посты, статьи, описания товаров.
это большая часть типовых бизнес-задач. если вам говорят «по закону всё должно быть на российской модели» — просят уточнить, какая статья. чаще всего окажется, что перестраховка.
ось 2: качество
честно и коротко: на простых типовых задачах (классификация, извлечение, шаблонные тексты на русском) разрыв между российскими и западными моделями небольшой и на практике часто не важен. на сложных (многошаговые рассуждения, агентные сценарии, нетривиальный код, длинные документы целиком) — западные флагманы впереди ощутимо, и промптами это компенсируется лишь частично.
следствие: чем проще задача, тем спокойнее её отдавать российской модели без потери качества. чем сложнее — тем дороже обходится принципиальность.
ось 3: цена и удобство оплаты
порядки цен на api сопоставимы — и там и там счёт идёт на сотни рублей за миллион токенов у старших версий и заметно дешевле у лёгких (точные тарифы проверяйте у провайдеров, они меняются). реальная разница — в оплате: российские модели — рубли, счёт, закрывающие документы; западные из рф — vpn, зарубежные карты, посредники или api-агрегаторы с рублёвой оплатой. это не блокер, но постоянные операционные трения плюс риск, что схема оплаты отвалится в неудобный момент.
матрица: собираем вместе
| ваша ситуация | что брать |
|---|---|
| персданные в промптах, задачи простые | российская модель, точка |
| персданные, задачи сложные | российская модель + упрощение задачи, либо обезличивание и гибрид |
| данные обезличенные, задачи простые | что дешевле на вашем объёме — включая deepseek и лёгкие версии |
| данные обезличенные, задачи сложные | западный флагман |
| госсектор / кии | российская on-premise, других вариантов обычно нет |
гибридные схемы — как не выбирать
рабочий паттерн, который я собираю чаще всего: маршрутизация по чувствительности данных. перед отправкой в модель запрос проходит фильтр: есть персданные — идёт в российскую модель, нет — в западную или дешёвую. обезличивание (вырезать фио, телефоны, реквизиты и подставить метки) делается автоматически отдельным шагом — после него даже задача с клиентскими письмами может уехать во флагман легально.
второй паттерн — по сложности: массовый поток на дешёвой модели, сложные случаи эскалируются флагману. экономит деньги и не жертвует качеством там, где оно критично.
оба паттерна требуют одного архитектурного решения в начале: логика и промпты живут отдельно от вызова конкретного api, смена модели стоит день. заложите — и вопрос «российская или западная» из религиозного становится настроечным.
что пойдёт не так
- перестраховка. всё загнать на рф-модель «на всякий случай» — потерять качество на сложных задачах без юридической необходимости.
- бравада. гнать персданные в западный api «да кто проверит» — до первой жалобы или проверки.
- вечный выбор. полгода сравнивать вместо того, чтобы построить схему, где модели заменяемы.
какие из ваших задач в какую клетку матрицы попадают — это разбирается на конкретных процессах, не в теории. разбор за 25 000 ₽ ровно это и делает: смотрю данные, задачи и ограничения, отдаю схему «что куда» — подбор моделей входит в неё по умолчанию.
прошли гайд и понимаете: руками — некогда
нормальный исход: инструмент понятен, но заниматься им некому — у вас бизнес. за 2–3 недели соберу агента под ваш процесс: на ваших данных, с вашими правилами и метрикой, по которой видно, окупился он или нет.