promptu gidas-model

Kaip promptinti Kimi K3

Kimi K3 yra atviro svorio modelis su 1 mln. tokenų konteksto langu ir visada įjungtu mąstymu. Didžioji dalis klaidų čia kyla ne dėl prompto, o dėl to, kaip sudėliota API užklausa.

Kada rinktis Kimi K3

Šeši principai, kuriuos verta žinoti

Mąstymo išjungti negalima, tik sureguliuoti

K3 mąstymo režimas visada įjungtas ir jo išjungti neįmanoma. Vienintelė svirtis yra reasoning_effort laukas su reikšmėmis low, high ir max, kur numatytoji yra max.

Tai reiškia, kad kainą ir laukimo laiką valdai tik šiuo lauku. Jei užduotis paprasta, max yra brangus numatytasis pasirinkimas ir jį verta nuleisti sąmoningai.

Dalies parametrų siųsti negalima

temperature, top_p, n, presence_penalty ir frequency_penalty yra fiksuoti ir juos reikia praleisti užklausoje. Fiksuotos reikšmės yra temperature=1.0 ir top_p=0.95.

Stiliaus ir įvairovės čia nesuderinsi parametrais. Viską valdo sisteminis promptas.

Atsakymo tokenų riba pagal nutylėjimą yra 131 072, o didžiausia galima 1 048 576.

Grąžink pilną žinutę su mąstymo istorija

Tai dažniausia techninė klaida su K3. Kelių ėjimų pokalbiuose ir įrankių kvietimuose privalai grąžinti visą modelio žinutę nepakeistą, o ne vien content lauką.

Jei mąstymo istoriją praleisi arba persijungsi į K3 sesijos viduryje, atsakymų kokybė tampa nestabili. Modelis šiai istorijai jautrus.

Įrankių kvietimą nurodyk aiškiai

Jei nori, kad pirmame ėjime modelis būtinai iškviestų bent vieną įrankį, naudok tool_choice="required".

K3 gali būti per daug iniciatyvus, todėl agentiniuose srautuose verta aiškiai apibrėžti, ką jam leidžiama daryti savarankiškai, o kur reikia sustoti.

Iniciatyvumo ribojimas agentiniame darbe

Do only what the current task requires. Do not start adjacent work, refactors, or cleanups that were not requested. If you believe additional work is needed, say so in one sentence and wait.

Struktūruotą atsakymą imk tik iš content lauko

Srautiniame atsakyme K3 atskirai siunčia reasoning_content ir galutinį content. Kai naudoji struktūruotą išvestį, apdorok tik content lauką.

Jei bandysi ieškoti JSON mąstymo turinyje, gausi nenuoseklius rezultatus.

Paveikslėlius siųsk kaip duomenis, ne kaip nuorodas

K3 supranta paveikslėlius ir vaizdo įrašus, bet viešų paveikslėlių nuorodų nepriima. Failus reikia siųsti base64 formatu arba per ms://<file-id> identifikatorių.

Konteksto langas yra 1 mln. tokenų, todėl į vieną sesiją telpa didelė kodų bazė kartu su žurnalais ir ekrano nuotraukomis.

Konteksto podėlis įsijungia tik tada, kai ankstesnės užklausos prompto tokenų skaičius viršija 256.

Šaltinis

Kimi API Platform, Kimi K3 quickstart. Turinys su šaltiniu sulygintas 2026-07-24.

Skirtingai nuo „Anthropic", „OpenAI" ir „Google", „Moonshot AI" atskiro promptavimo gido neskelbia. Šis skyrius remiasi oficialia API dokumentacija, todėl jame daugiau techninių taisyklių nei prompto formuluočių.

Dažni klausimai apie Kimi K3

Kodėl atsakymų kokybė šokinėja tarp ėjimų?
Greičiausiai tarp ėjimų nesaugai pilnos modelio žinutės su mąstymo istorija. K3 jai jautrus, o praradus istoriją rezultatas tampa nestabilus.
Ar galiu sumažinti kainą per temperature ar top_p?
Ne. Šie parametrai fiksuoti ir jų siųsti negalima. Vienintelė svirtis yra reasoning_effort su reikšmėmis low, high ir max.
Kaip išjungti mąstymą paprastoms užduotims?
Niekaip. Mąstymas visada įjungtas. Paprastoms užduotims nuleisk reasoning_effort iki low, nes numatytasis max yra brangus.
Kodėl neveikia paveikslėlio nuoroda?
K3 nepriima viešų paveikslėlių nuorodų. Failą reikia siųsti base64 formatu arba per ms://<file-id> identifikatorių.