Lehmus AI alustalla on tällä hetkellä saatavilla seuraavat kielimallit. Alla olevasta listauksesta näet kunkin mallin tyypilliset käyttötarkoitukset sekä tärkeimmät tuetut ominaisuudet.
Gemma 4 31B
Käyttötarkoitus: yleiskäyttö, analyysi, päättely, koodaus
- google/gemma-4-31b-it
- public model id: jwwqblcgkizlhxjjbkcp
- enable-auto-tool-choice
- reasoning-parser=gemma4
- tool-call-parser=gemma4
- max-model-len=262144
- kv-cache-dtype=fp8
Gemma 4 26B MoE
Käyttötarkoitus: pitkät aineistot, tiivistäminen, analyysi, koodaus
- google/gemma-4-26B-A4B-it
- public model id: wnofibsjlomanbprgbdp
- enable-auto-tool-choice
- reasoning-parser=gemma4
- tool-call-parser=gemma4
- max-model-len=262144
GPT OSS 120B
Käyttötarkoitus: analyysi, ongelmanratkaisu, agentit, työkalut
- openai/gpt-oss-120b
- public model id: azsydsttjnlbfjbgqnwd
- enable-auto-tool-choice
- reasoning-parser=openai_gptoss
- tool-call-parser=openai
- kv-cache-dtype=fp8
Qwen3.6-35B-A3B
Käyttötarkoitus: koodaus, agentit, päättely, työkalukutsut
- qwen/qwen3.6-35B-A3B
- public model id: ctraxdkjuwfrlivzrhgt
- enable-auto-tool-choice
- reasoning-parser=qwen3
- tool-call-parser=qwen3_xml
- max-model-len=262144
- max-num-batched-tokens=4096
Qwen3.8-27B
Käyttötarkoitus: yleiskäyttö, keskustelu, analyysi, koodaus
- qwen/qwen3.8-27B
- public model id: Qwen3.8-27B
- enable-auto-tool-choice
- reasoning-parser=qwen3
- tool-call-parser=qwen3_coder
- max-model-len=262144
- speculative-config.num_speculative_tokens=3
- speculative-config.method=mtp
- kv-cache-dtype=fp8
DeepSeek R1 Distill Llama 70B FP8 dynamic
Käyttötarkoitus: koodaus, agentit, päättely, työkalukutsut
- neuralmagic-deepseek-r1-distill-llama-70b-fp8-dynamic
- public model id: neuralmagic/DeepSeek-R1-Distill-Llama-70B-FP8-dynamic
- enable-auto-tool-choice
- reasoning-parser=deepseek_r1
- tool-call-parser=hermes
- max-model-len=32768
- max-num-seqs=2
- max-num-batched-tokens=8192
- trust-remote-code
- tokenizer-mode=auto
- tensor-parallel-size=1
- dtype=auto
- tokenizer=neuralmagic/DeepSeek-R1-Distill-Llama-70B-FP8-dynamic
- kv-cache-dtype=fp8
ICT-palvelut pyrkivät pitämään mallikatalogin mahdollisimman monipuolisena ja lisäämään uusia malleja mahdollisuuksien mukaan. Kapasiteetti on kuitenkin rajallinen, joten kaikkia malleja ei voida tarjota, vaan valikoimaa kehitetään vastaamaan mahdollisimman moneen käyttötarkoitukseen.
Eikö haluamasi kielimalli ole saatavilla?
Tarkistathan ensin, voisitko hyödyntää jotain jo olemassa olevaa kielimallia käyttötarkoituksessasi. Voit pyytää uutta kielimallia alustalle seuraavalla lomakkeella: uuden kielimallin pyytäminen. Kun olet lähettänyt pyynnön uudesta kielimallista, tiimimme arvioi sen seuraavien kriteerien perusteella:
- Laitteistoyhteensopivuus: VRAM-vaatimusten arviointi suhteessa käytettävissä oleviin resursseihin
- Tietosuoja: Varmistamme, että mallia voidaan ajaa turvallisesti ympäristössämme ilman tunnettuja sivuvaikutuksia