Microsoft нашла способ срезать $600 млн расходов на ИИ. Американский гигант присматривается к китайской модели Kimi K3 от Moonshot AI для замены дорогостоящих GPT-4o и Claude в Copilot. При этом полный переход на азиатскую нейросеть грозит геополитическими проблемами.
По данным источников, компания уже проводит тесты. Kimi K3 обрабатывает до миллиона токенов контекста — в восемь раз больше, чем GPT-4o. Но стоит ли экономия рисков?
Цифры, которые заставляют нервничать OpenAI
Базовая Kimi K2.6 стоит $0.95 за миллион входных токенов против $2.50 у GPT-4o. Разница кажется небольшой, пока не умножишь на объемы Microsoft. Флагманская K3 дороже — $3.00 за вход и $15.00 за выход, но встроенное кэширование снижает стоимость повторных запросов на 90%.
Как отмечают аналитики, при текущих масштабах Copilot даже 10-процентная экономия на инференсе выливается в сотни миллионов долларов. При этом Kimi K3 с её 2.8 триллиона параметров уступает только Claude Fable 5 и GPT-5.6 Sol, обходя Claude Opus 4.8 в логических задачах.
Китайский ИИ в американском продукте: парадокс 2026 года
Сам Copilot заблокирован в материковом Китае. Но Microsoft уже интегрирует китайские нейросети в свою экосистему. Ранее сообщалось о подключении DeepSeek V4 в Azure для корпоративных агентов Copilot. Теперь на очереди Kimi.
В GitHub Copilot уже доступна открытая модель Kimi K2.7 Code от пекинской Moonshot AI. Это первый open-weight ассистент в пикере ИИ-помощника. Однако полный переход на Kimi K3 в основном Copilot — другая история.
«Мы не комментируем слухи о конкретных моделях», — заявил представитель Microsoft. При этом компания подтвердила курс на «оптимизацию затрат на инференс».
Технические преимущества, которые нельзя игнорировать
Kimi K3 превращает работу с длинным контекстом в инфраструктурное решение. Модель удерживает фокус на протяжении миллиона токенов, не теряя логических связей. Это критично для:
- Анализа целых кодовых репозиториев
- Обработки многотомной документации
- Сложных агентных сценариев
В то же время, на сложных математических бенчмарках Kimi K3 минимально отстает от GPT-5.6 Sol и Claude Fable 5. Бесплатные веб-серверы Moonshot AI часто выдают предупреждения о перегрузке из-за ажиотажа.
Геополитическая мина замедленного действия
Использование китайской модели в продукте Microsoft — это не только технический, но и политический вызов. Санкции, экспортный контроль, вопросы безопасности данных — все эти факторы могут перечеркнуть экономическую выгоду.
Китайские чипы Huawei Ascend, на которых обучались GLM-5 и другие конкуренты Claude, стали символом технологической независимости КНР. Интеграция таких решений в западные продукты выглядит как минимум странно на фоне торговой войны.
Альтернативы уже в работе
Microsoft не ставит все яйца в одну корзину. Параллельно тестируются:
- Qwen 3.7 Max от Alibaba — самая быстрая мультимодальная модель
- GLM-5.2 от Zhipu AI — обучена полностью на китайском железе
- Собственные разработки на базе открытых весов
Как отмечают инсайдеры, окончательное решение зависит не от технических характеристик, а от того, как сложится ситуация с экспортом ИИ-технологий к концу 2026 года.
| Модель | Вход (за 1 млн токенов) | Выход (за 1 млн токенов) | Контекст |
|---|---|---|---|
| GPT-4o | $2.50 | $10.00 | 128K |
| Kimi K2.6 | $0.95 | $4.00 | 1M |
| Kimi K3 | $3.00 | $15.00 | 1M |
| Claude 3.5 Sonnet | $3.00 | $15.00 | 200K |
Ситуация остается открытой. Microsoft продолжает переговоры. Moonshot AI наращивает серверные мощности. А $600 млн так и висят в воздухе — то ли экономия, то ли упущенная выгода.