Qwen3.8-27B open weights
NieuwDens multimodaal model van 27 miljard parameters (14 augustus 2026) onder Apache 2.0, inclusief FP8-variant.
Open-weight LLM-familie van Alibaba — Qwen3.8-27B draait multimodaal op één GPU onder Apache 2.0
Qwen is Alibaba's LLM-familie met een open en een proprietary spoor. De Qwen3.8-lijn (augustus 2026) is de huidige generatie. Qwen3.8-Max verscheen op 3 augustus als vlaggenschip: een mixture-of-experts van 2,4 biljoen parameters met circa 95 miljard actieve, tekst-only, met open weights vanaf 12 augustus onder een eigen Alibaba-licentie. Qwen3.8-27B volgde op 14 augustus en is het model dat de meeste teams daadwerkelijk kunnen draaien: een dens multimodaal model van 27 miljard parameters onder Apache 2.0, met 262.144 tokens context (via YaRN op te rekken naar 1 miljoen) dat tekst, beeld en video als invoer neemt. Er is ook een FP8-variant die het geheugenbeslag ruwweg halveert. Self-hosting via vLLM, SGLang, Ollama en Hugging Face; daarnaast de gratis Qwen Chat-app.
Feiten geverifieerd op 24 augustus 2026 · hoe wij beoordelen
Qwen van Alibaba levert sterke meertalige modellen, met name voor Aziatische talen. Met Qwen3.8-27B is er sinds augustus 2026 een multimodaal open-weight model onder Apache 2.0 dat op één GPU past — voor wie gevoelige data binnen de eigen muren wil houden is dat het serieuste alternatief tot nu toe.
Waarom op de site: Qwen groeide uit tot een van de sterkste open-weight LLM-families voor meertalig gebruik. Qwen3.8-27B werd in het eerste weekend na de release meer dan drie miljoen keer gedownload.
Beste alternatief: llama
Qwen is vooral waardevol voor teams die een sterk open-weight model willen self-hosten, meertalige of multimodale toepassingen bouwen, of goedkope agentic API-modellen zoeken.
Dens multimodaal model van 27 miljard parameters (14 augustus 2026) onder Apache 2.0, inclusief FP8-variant.
Vlaggenschip (3 augustus 2026): mixture-of-experts van 2,4 biljoen parameters, circa 95 miljard actief, tekst-only.
Native venster van 262.144 tokens; de uitbreiding naar een miljoen kan op korte invoer nauwkeurigheid kosten.
Brede meertaligheid, met name sterk in Aziatische talen waar westerse modellen achterblijven.
Qwen3.8-27B is een native vision language model: tekst, afbeeldingen en video erin, tekst eruit.
Past volgens Alibaba op één high-end consumenten- of workstation-GPU; FP8 halveert het geheugenbeslag ruwweg.
Serveerrecepten gepubliceerd voor vLLM en SGLang; weights op Hugging Face en ModelScope.
Qwen3.8-27B gratis onder Apache 2.0 (eigen hosting); Qwen Chat gratis. Gehost endpoint voor de 27B loopt vooralsnog via OpenRouter: $0,45 in / $3,20 uit per miljoen tokens. Qwen3.8-Max via Alibaba Cloud: circa $2,00 in / $6,00 uit per miljoen tokens op het internationale (Singapore) endpoint; het endpoint in China is fors goedkoper.
Prijzen indicatief — controleer altijd de actuele tarieven bij de aanbieder.
Hands-on tutorials en uitleg om snel productief te worden met Qwen.
Typ een toolnaam, categorie of use case
Zoeken...
Geen tools gevonden
Wat de wereld er van zegt
In het nieuws
Alibaba Qwen Releases Qwen-Audio-3.1-Realtime: A Full-Duplex Voice Model Trained to Think, Act, and Decide When to Speak
Alibaba’s Qwen team has released Qwen-Audio-3.1, a 5-model audio stack spanning ASR, TTS and realtime interaction. The main model is …
Alibaba Qwen Releases Qwen-Audio-3.1-Realtime: A Full-Duplex Voice Model Trained to Think, Act, and Decide When to Speak
Alibaba’s Qwen team has released Qwen-Audio-3.1 , a 5-model audio stack spanning ASR, TTS and realtime interaction. The main model is Qwen-Audio-3.1-Realtime , a full-duplex speech model built for voi
Alibaba Qwen Releases Qwen-Image-2.1: A 7B Open-Weight Model for Image Generation and Editing
Alibaba’s Qwen team has released Qwen-Image-2.1 , a unified text-to-image generation and image editing model. Its visual generation component has 7B parameters across 32 single-stream DiT layers. One
Alibaba Qwen Team Releases Qwen3.8-LiveTranslate: A Real-Time Interpretation Model That Cuts Average Lag to 2.3 Seconds Across 60 Languages
Qwen has released Qwen3.8-LiveTranslate , its next-generation real-time simultaneous interpretation model. It listens to live speech, with optional video frames, and returns translated text and speech
Qwen 4.0 Is Coming — And Your Gaming GPU Already Runs Its Architecture
Alibaba announced the Qwen 4 family at Apsara. The open-weights tier is “very soon.” Here is what is confirmed, what is rumor, and why the… Continue reading on Medium »