Qwen3.8-27B open weights
NieuwDens multimodaal model van 27 miljard parameters (14 augustus 2026) onder Apache 2.0, inclusief FP8-variant.
Open-weight LLM-familie van Alibaba — Qwen3.8-27B draait multimodaal op één GPU onder Apache 2.0
Qwen is Alibaba's LLM-familie met een open en een proprietary spoor. De Qwen3.8-lijn (augustus 2026) is de huidige generatie. Qwen3.8-Max verscheen op 3 augustus als vlaggenschip: een mixture-of-experts van 2,4 biljoen parameters met circa 95 miljard actieve, tekst-only, met open weights vanaf 12 augustus onder een eigen Alibaba-licentie. Qwen3.8-27B volgde op 14 augustus en is het model dat de meeste teams daadwerkelijk kunnen draaien: een dens multimodaal model van 27 miljard parameters onder Apache 2.0, met 262.144 tokens context (via YaRN op te rekken naar 1 miljoen) dat tekst, beeld en video als invoer neemt. Er is ook een FP8-variant die het geheugenbeslag ruwweg halveert. Self-hosting via vLLM, SGLang, Ollama en Hugging Face; daarnaast de gratis Qwen Chat-app.
Feiten geverifieerd op 24 augustus 2026 · hoe wij beoordelen
Qwen van Alibaba levert sterke meertalige modellen, met name voor Aziatische talen. Met Qwen3.8-27B is er sinds augustus 2026 een multimodaal open-weight model onder Apache 2.0 dat op één GPU past — voor wie gevoelige data binnen de eigen muren wil houden is dat het serieuste alternatief tot nu toe.
Waarom op de site: Qwen groeide uit tot een van de sterkste open-weight LLM-families voor meertalig gebruik. Qwen3.8-27B werd in het eerste weekend na de release meer dan drie miljoen keer gedownload.
Beste alternatief: llama
Qwen is vooral waardevol voor teams die een sterk open-weight model willen self-hosten, meertalige of multimodale toepassingen bouwen, of goedkope agentic API-modellen zoeken.
Dens multimodaal model van 27 miljard parameters (14 augustus 2026) onder Apache 2.0, inclusief FP8-variant.
Vlaggenschip (3 augustus 2026): mixture-of-experts van 2,4 biljoen parameters, circa 95 miljard actief, tekst-only.
Native venster van 262.144 tokens; de uitbreiding naar een miljoen kan op korte invoer nauwkeurigheid kosten.
Brede meertaligheid, met name sterk in Aziatische talen waar westerse modellen achterblijven.
Qwen3.8-27B is een native vision language model: tekst, afbeeldingen en video erin, tekst eruit.
Past volgens Alibaba op één high-end consumenten- of workstation-GPU; FP8 halveert het geheugenbeslag ruwweg.
Serveerrecepten gepubliceerd voor vLLM en SGLang; weights op Hugging Face en ModelScope.
Qwen3.8-27B gratis onder Apache 2.0 (eigen hosting); Qwen Chat gratis. Gehost endpoint voor de 27B loopt vooralsnog via OpenRouter: $0,45 in / $3,20 uit per miljoen tokens. Qwen3.8-Max via Alibaba Cloud: circa $2,00 in / $6,00 uit per miljoen tokens op het internationale (Singapore) endpoint; het endpoint in China is fors goedkoper.
Prijzen indicatief — controleer altijd de actuele tarieven bij de aanbieder.
Hands-on tutorials en uitleg om snel productief te worden met Qwen.
Typ een toolnaam, categorie of use case
Zoeken...
Geen tools gevonden
Wat de wereld er van zegt
In het nieuws
I Used Qwen to Run My First AI Agent. Here’s What Actually Worked (and What Didn’t)
<div data-sanitized-class="medium-feed-item"><p data-sanitized-class="medium-feed-image"><a href="https://medium.com/@liunuohuiliu/i-used-qwen-to-run-my-first-ai-agent-heres-what-actually-worked-and-w