Kimi k2.5 техникалық сипаттамалары
| Элемент | Мәні / ескертпелер |
|---|---|
| Модель атауы / өндіруші | Kimi-K2.5 (v1.0) — Moonshot AI (ашық салмақтар). |
| Архитектура отбасы | Эксперттер қоспасы (MoE) гибридті пайымдау моделі (DeepSeek стиліндегі MoE). |
| Параметрлер (жалпы / белсенді) | ≈ 1 триллион жалпы параметр; ~32B әр токенге белсенді (384 эксперт, әр токен үшін 8-і таңдалады деп хабарланған). |
| Модалдылықтар (енгізу / шығару) | Енгізу: мәтін, суреттер, видео (көпмодальды). Шығару: негізінен мәтін (кеңейтілген пайымдау іздері), қосымша түрде құрылымдалған құрал шақырулары / көпқадамды нәтижелер. |
| Контекстік терезе | 256k токен |
| Оқыту деректері | Шамамен 15 триллион аралас визуал + мәтін токендері бойынша үздіксіз алдын ала үйрету (өндіруші хабарлаған). Оқыту белгілері/деректер жиынының құрамы: жарияланбаған. |
| Режимдер | Thinking режимі (ішкі пайымдау іздерін қайтарады; ұсынылатын temp=1.0) және Instant режимі (пайымдау іздері жоқ; ұсынылатын temp=0.6). |
| Агент мүмкіндіктері | Agent Swarm / параллель қосалқы агенттер: оркестратор 100-ге дейін қосалқы агент іске қоса алады және көптеген құрал шақыруларын орындай алады (өндіруші шамамен ~1,500 құрал шақыруына дейін деп мәлімдейді; параллель орындау уақытты қысқартады). |
Kimi K2.5 деген не?
Kimi K2.5 — Moonshot AI-дың ашық салмақты флагмандық үлкен тілдік моделі, ол қосымша компоненттері бар тек мәтіндік LLM емес, бастапқыдан-ақ тумысынан көпмодальды және агентке бағытталған жүйе ретінде жасалған. Ол тілдік пайымдауды, көруді түсінуді және ұзақ контексті өңдеуді бір архитектурада біріктіріп, құжаттар, суреттер, видеолар, құралдар және агенттерді қамтитын күрделі көпқадамды тапсырмаларды орындауға мүмкіндік береді.
Ол ұзақ көкжиекті, құралдармен толықтырылған жұмыс үрдістеріне (кодтау, көпқадамды іздеу, құжат/видео түсіну) арналған және тиімді инференс үшін тумысынан INT4 кванттаумен, сондай-ақ екі өзара әрекеттесу режимімен (Thinking және Instant) жеткізіледі.
Kimi K2.5 негізгі мүмкіндіктері
- Тумысынан көпмодальды пайымдау
Көру және тіл pretraining кезеңінен бастап бірлесіп үйретіледі. Kimi K2.5 сыртқы көру адаптерлеріне сүйенбей суреттер, скриншоттар, диаграммалар және видео кадрлары бойынша пайымдай алады. - Өте ұзын контекстік терезе (256K токен)
Толық код қорлары, ұзын ғылыми мақалалар, заң құжаттары немесе көпсағаттық әңгімелер бойынша контекстті қырқусыз тұрақты пайымдауды қамтамасыз етеді. - Agent Swarm орындалу моделі
Параллель жоспарлау, құралдарды пайдалану және тапсырмаларды декомпозициялау үшін ~100 маманданған қосалқы агентті динамикалық құру және үйлестіруді қолдайды. - Бірнеше инференс режимдері
- Instant режимі — төмен кідіріс
- Thinking режимі — терең көпқадамды пайымдау
- Agent / Swarm режимі — автономды орындау және оркестрация
- Көруден кодқа мықты мүмкіндіктер
UI mockup-тарын, скриншоттарды немесе видео демонстрацияларды жұмыс істейтін front-end коды-на айналдыра алады және визуалды контекстті пайдаланып бағдарламалық жасақтаманы жөндейді. - MoE тиімді масштабталуы
Архитектура әр токен үшін тек кейбір эксперттерді белсендіреді, бұл тығыз модельдермен салыстырғанда инференс құнын басқарылатын деңгейде ұстай отырып, триллион параметрлік сыйымдылыққа мүмкіндік береді.
Kimi K2.5 бенчмарк өнімділігі
Жарияланған бенчмарк нәтижелері (негізінен пайымдауға баса назар аударылған баптауларда):
Пайымдау және білім бенчмарктары
| Бенчмарк | Kimi K2.5 | GPT-5.2 (xhigh) | Claude Opus 4.5 | Gemini 3 Pro |
|---|---|---|---|---|
| HLE-Full (құралдармен) | 50.2 | 45.5 | 43.2 | 45.8 |
| AIME 2025 | 96.1 | 100 | 92.8 | 95.0 |
| GPQA-Diamond | 87.6 | 92.4 | 87.0 | 91.9 |
| IMO-AnswerBench | 81.8 | 86.3 | 78.5 | 83.1 |
Көру және видео бенчмарктары
| Бенчмарк | Kimi K2.5 | GPT-5.2 | Claude Opus 4.5 | Gemini 3 Pro |
|---|---|---|---|---|
| MMMU-Pro | 78.5 | 79.5* | 74.0 | 81.0 |
| MathVista (Mini) | 90.1 | 82.8* | 80.2* | 89.8* |
| VideoMMMU | 87.4 | 86.0 | — | 88.4 |
Жұлдызшамен белгіленген көрсеткіштер бастапқы дереккөздер хабарлаған бағалау баптауларындағы айырмашылықтарды көрсетеді.
Жалпы алғанда, Kimi K2.5 көпмодальды пайымдау, ұзақ контексттік тапсырмалар және агенттік жұмыс үрдістері бойынша жоғары бәсекеге қабілеттілікті көрсетеді, әсіресе қысқа жауапты QA-дан тыс бағалауларда.
Kimi K2.5 және басқа алдыңғы қатарлы модельдер
| Өлшем | Kimi K2.5 | GPT-5.2 | Gemini 3 Pro |
|---|---|---|---|
| Көпмодалдылық | Тумысынан (көру + мәтін) | Интеграцияланған модульдер | Интеграцияланған модульдер |
| Контекст ұзындығы | 256K токен | Ұзақ (нақты шегі жарияланбаған) | Ұзақ (әдетте <256K) |
| Агенттерді үйлестіру | Көпагентті swarm | Бір агентке фокус | Бір агентке фокус |
| Модельге қолжетімділік | Ашық салмақтар | Меншікті | Меншікті |
| Қолдану/орналастыру | Жергілікті / бұлт / арнайы | Тек API | Тек API |
Модельді таңдау бойынша нұсқаулық:
- Ашық салмақпен орналастыру, зерттеу, ұзақ контекстті пайымдау немесе күрделі агенттік жұмыс үрдістері үшін Kimi K2.5 таңдаңыз.
- Күшті құрал экожүйесі бар өндірістік деңгейдегі жалпы интеллект үшін GPT-5.2 таңдаңыз.
- Google өнімділігі мен іздеу стегіне терең интеграция үшін Gemini 3 Pro таңдаңыз.
Типтік қолдану жағдайлары
- Үлкен көлемді құжаттар мен кодты талдау
Толық репозиторийлерді, заң корпусын немесе зерттеу архивтерін бір контекст терезесінде өңдеу. - Визуалды бағдарламалық инженерия жұмыс үрдістері
Скриншоттар, UI дизайндар немесе жазылған интеракциялар негізінде кодты генерациялау, рефакторлау немесе жөндеу. - Автономды агенттік конвейерлер
Жоспарлау, іздеу, құрал шақырулары және синтезді қамтитын ұштан-ұшқа дейінгі жұмыс үрдістерін agent swarm арқылы орындау. - Кәсіпорындық білімді автоматтандыру
Ішкі құжаттар, кестелер, PDF және презентацияларды талдап, құрылымдалған есептер мен инсайттар шығару. - Зерттеу және модельді баптау
Ашық модель салмақтары арқасында fine-tuning, туралау зерттеулері және эксперименттер.
Шектеулер мен ескертулер
- Жоғары аппараттық талаптар: Толық дәлдікпен орналастыру елеулі GPU жадын қажет етеді; өндірістік қолдануда әдетте кванттау (мыс., INT4) пайдаланылады.
- Agent Swarm жетілу деңгейі: Жетекші көпагентті мінез-құлықтар әлі дамуда және мұқият оркестрация дизайнын талап етуі мүмкін.
- Инференс күрделілігі: Оңтайлы өнімділік инференс қозғалтқышына, кванттау стратегиясына және маршруттау конфигурациясына тәуелді.
CometAPI арқылы Kimi k2.5 API-іне қалай қол жеткізуге болады
1-қадам: API кілтін алу үшін тіркелу
cometapi.com сайтына кіріңіз. Егер сіз әлі пайдаланушы емес болсаңыз, алдымен тіркеліңіз. CometAPI консоліне кіріңіз. Интерфейстің рұқсат беру API кілтін алыңыз. Жеке кабинеттегі API token бөлімінде “Add Token” түймесін басып, токен кілтін алыңыз: sk-xxxxx және жіберіңіз.

2-қадам: Kimi k2.5 API-іне сұраулар жіберу
API сұрауын жіберу үшін “kimi-k2.5” endpoint-ін таңдаңыз және сұрау денесін орнатыңыз. Сұрау әдісі мен сұрау денесін біздің сайттағы API құжатынан алыңыз. Ыңғайлылық үшін сайтымыз Apifox тестін де ұсынады. Аккаунтыңыздағы нақты CometAPI кілтімен ауыстырыңыз. Негізгі URL — Chat Completions.
Сұрақты немесе өтінішті content өрісіне енгізіңіз — модель осыған жауап береді. Жасалған жауапты алу үшін API жауабын өңдеңіз.
3-қадам: Нәтижелерді алу және тексеру
Жасалған жауапты алу үшін API жауабын өңдеңіз. Өңделгеннен кейін API тапсырма күйі мен шығыс деректерін қайтарады.