GPT-OSS 120B или Kimi K3 — что лучше?
GPT-OSS 120B и Kimi K3 решают похожие задачи, но впечатление от них сильно отличается. По текущему баллу КьюВи впереди Kimi K3, а разница особенно заметна в программировании и работе с длинными материалами.
Баллы 0–10 по шкале КьюВи: сводная оценка по направлению с учётом наших замеров скорости и надёжности.
А лучше не выбирать
В КьюВи GPT-OSS 120B и Kimi K3 отвечают вместе — вы сразу видите, где они согласны, а где спорят.
Сравнение GPT-OSS 120B и Kimi K3 в КьюВи — это случай, когда название и размер модели могут запутать. У GPT-OSS 120B огромный контекст и очень сильный показатель рассуждений, но итоговая оценка заметно ниже. Kimi K3 выглядит практичнее для ежедневной работы: она быстрее, лучше пишет код и удерживает гораздо больше текста в одном запросе.
Мы добавили её в день релиза и сразу прогнали через обычные сценарии: объяснение сложной темы, разбор кода, редактирование длинного документа и вопросы на русском. Впечатление подтвердилось цифрами рейтинга КьюВи. Это не лабораторный чемпионат и не обещание идеального ответа на каждый запрос, а ориентир для выбора модели в реальной работе.
Качество: разрыв в пользу Kimi K3
Текущий балл GPT-OSS 120B в КьюВи — 5.2, место в рейтинге — 22. У Kimi K3 — 9.4 и позиция 3. Поэтому на вопрос «кто лучше по общей оценке?» ответ прямой: впереди Kimi K3.
Особенно показательно сравнение по отдельным задачам. В программировании GPT-OSS 120B получает 5.1, а Kimi K3 — 9.7. Для генерации функций, поиска ошибки в Python или объяснения SQL-запроса преимущество сейчас у Kimi K3. Она чаще выдает рабочую структуру решения с первого раза, тогда как GPT-OSS 120B может быть полезнее как собеседник для проверки идеи и поиска слабых мест.
С рассуждениями картина иная: GPT-OSS 120B показывает 9.9, Kimi K3 — 9.2. Это сильная сторона модели OpenAI. В задачах, где нужно разобрать условие, сопоставить несколько ограничений или последовательно проверить вывод, GPT-OSS 120B нельзя списывать со счетов. Но общий рейтинг складывается из нескольких измерений, и здесь Kimi K3 выигрывает за счет более ровного результата.
Скорость и цена в тенге
Медианная скорость ответа GPT-OSS 120B сейчас обозначается как — секунд, а у Kimi K3 — 29 секунд. Для GPT-OSS 120B данных пока недостаточно, поэтому сравнивать задержку напрямую было бы нечестно. По Kimi K3 уже видно, чего ждать в обычном чате: ответ может занять ощутимое время, особенно если запрос требует кода или длинного анализа.
Средний вопрос к GPT-OSS 120B стоит примерно ≈10 ₸, к Kimi K3 — примерно ≈13 ₸. Разница небольшая на одном запросе, но заметная при постоянной работе. Если вы задаете несколько коротких вопросов в день, более дешевая модель может оказаться разумным выбором. Когда цена ошибки выше стоимости нескольких тенге, Kimi K3 оправдывает доплату качеством кода и объемом контекста.
Обе модели доступны в КьюВи из Казахстана: оплата проходит в тенге, есть интерфейс на русском и казахском, а новым пользователям дают три бесплатных вопроса на старте. Их хватит, чтобы проверить одну и ту же задачу в двух окнах, а не выбирать вслепую по названию.
Контекст и типы задач
Контекст GPT-OSS 120B — 131K, у Kimi K3 — 1M. На практике это влияет не только на размер файла, который можно отправить. Большой контекст удобен, когда нужно помнить условия проекта, выдержки из нескольких документов и историю правок одновременно.
Когда выбрать GPT-OSS 120B
GPT-OSS 120B разумно брать для задач на последовательное мышление: разобрать спорное условие, проверить аргументацию, найти противоречие в техническом описании. Студент может попросить её пошагово объяснить доказательство или разобрать ошибку в решении, а аналитик — проверить логику выводов в отчете. В программировании это скорее модель для ревью и обсуждения архитектуры, чем первый выбор для быстрого написания большого фрагмента кода.
Когда выбрать Kimi K3
Kimi K3 сильнее там, где нужно сделать результат руками. Например, собрать REST-эндпоинт из технического задания, переписать SQL-запрос и объяснить план выполнения или обработать длинный документ с требованиями. Контекст 1M полезен для дипломной работы, большого репозитория и многостраничного договора. Но КьюВи — помощник, а не медицинский, юридический или финансовый консультант: важные выводы нужно перепроверять.
В КьюВи обе модели можно запустить на одном вопросе и увидеть, где они согласны, а где расходятся. Такой режим полезнее абстрактного спора о брендах: разница между ответами быстро проявляется на вашем коде, учебном материале или рабочем документе.
Честный вердикт
Для программирования победитель — Kimi K3: её текущий показатель 9.7 против 5.1 у GPT-OSS 120B. Для задач на чистое рассуждение выбирайте GPT-OSS 120B, если вам важнее именно эта характеристика: 9.9 против 9.2.
Для длинных документов и регулярной работы впереди Kimi K3 благодаря контексту 1M и более высокой общей оценке 9.4. GPT-OSS 120B имеет смысл выбрать, если нужен более дешевый средний вопрос — ≈10 ₸ — и вы готовы самостоятельно проверять код и факты. По текущему баллу впереди Kimi K3, а лидер всего рейтинга КьюВи — Claude Fable 5 с результатом 9.8.
Мой выбор для большинства пользователей из Казахстана — Kimi K3. GPT-OSS 120B не провал, а более нишевый вариант: сильный в рассуждениях, доступный по цене, но пока слишком неровный, чтобы рекомендовать его вместо Kimi K3 для всех сценариев.
Частые вопросы
Что лучше для программирования: GPT-OSS 120B или Kimi K3?
Какая модель лучше для учебы и сложных рассуждений?
Что дешевле: GPT-OSS 120B или Kimi K3?
Можно ли попробовать GPT-OSS 120B и Kimi K3 в Казахстане?
Kimi K3 лучше ChatGPT?
Стоит ли выбирать GPT-OSS 120B вместо Kimi K3?
А лучше не выбирать
В КьюВи GPT-OSS 120B и Kimi K3 отвечают вместе — вы сразу видите, где они согласны, а где спорят.
Начать бесплатно →3 вопроса бесплатно, без карты