Uploaded June 2025 | Updated September 2026, 2 hours ago
đŻ Deepseek Qwen3-8B perfekt einstellen â auf deiner RTX 5090!
In diesem Video erfĂ€hrst du alles ĂŒber das neue Modell deepseek-r1-0528-qwen3-8b (q8_0) â inklusive optimaler LM Studio Einstellungen, realem VRAM-Verbrauch und einer kritischen Analyse der StĂ€rken und SchwĂ€chen.
đ§ Inhalt des Videos:
- Wie du das Modell schnell & stabil in LM Studio lÀdst
- Welche Settings (inkl. Draft-Model) du einstellen musst, um beste Performance zu erhalten
- Benchmark-Ergebnisse auf einer RTX 5090
- Warum die DateigröĂe (8.71 GB) tĂ€uscht â der VRAM-Bedarf liegt deutlich höher
- Wie sich das Modell gegenĂŒber anderen LLMs schlĂ€gt
Ideal fĂŒr lokale KI-Nutzung ohne Cloud-Zwang!
đĄ Tipp: Dieses Setup funktioniert auch auf schwĂ€cheren RTX-Karten mit weniger VRAM â im Video zeige ich wie!
đ„ Verwendetes Modell:
deepseek/deepseek-r1-0528-qwen3-8b (q8_0) auf HuggingFace
đ„ïž Testsystem:
GPU: RTX 5090 (32 GB VRAM)
OS: Windows 11
Tool: LM Studio (aktuellste Version)
đ§ Fazit:
Deepseek Qwen 8B ist extrem schnell â mit bis zu 88 Token/s â aber nur mit den richtigen Tweaks. Ich zeige dir genau, wieâs geht!
đŻ Deepseek Qwen3-8B perfekt einstellen â auf deiner RTX 5090!
In diesem Video erfĂ€hrst du alles ĂŒber das neue Modell deepseek-r1-0528-qwen3-8b (q8_0) â inklusive optimaler LM Studio Einstellungen, realem VRAM-Verbrauch und einer kritischen Analyse der StĂ€rken und SchwĂ€chen.
đ§ Inhalt des Videos:
- Wie du das Modell schnell & stabil in LM Studio lÀdst
- Welche Settings (inkl. Draft-Model) du einstellen musst, um beste Performance zu erhalten
- Benchmark-Ergebnisse auf einer RTX 5090
- Warum die DateigröĂe (8.71 GB) tĂ€uscht â der VRAM-Bedarf liegt deutlich höher
- Wie sich das Modell gegenĂŒber anderen LLMs schlĂ€gt
Ideal fĂŒr lokale KI-Nutzung ohne Cloud-Zwang!
đĄ Tipp: Dieses Setup funktioniert auch auf schwĂ€cheren RTX-Karten mit weniger VRAM â im Video zeige ich wie!
đ„ Verwendetes Modell:
deepseek/deepseek-r1-0528-qwen3-8b (q8_0) auf HuggingFace
đ„ïž Testsystem:
GPU: RTX 5090 (32 GB VRAM)
OS: Windows 11
Tool: LM Studio (aktuellste Version)
đ§ Fazit:
Deepseek Qwen 8B ist extrem schnell â mit bis zu 88 Token/s â aber nur mit den richtigen Tweaks. Ich zeige dir genau, wieâs geht!










