Modell-Informationen
- Name
- Qwen 3.5 9B Q4
- Familie
- Qwen
- Variante
- 3.5
- Parameter
- 9B
- Quantisierung
- Q4_K_M
- Provider
- local
- Runner
- llama.cpp (ROCm)
- Erw. Hardware
- 16 GB GPU VRAM
Hardware (falls lokal)
- GPU
- AMD Radeon RX 9060 XT
- VRAM
- 16 GB
- Stack
- ROCm (llama.cpp)
Benchmark
ROCm
5.28 GB
- Prompt-Verarbeitung
- 1880 t/s
- Text-Generierung
- 48.6 t/s
- VRAM genutzt
- 8.5 GB
- VRAM total
- 15.9 GB
Start-Befehl
llama-server.exe -m "C:\AI\Models\models--unsloth--Qwen3.5-9B-GGUF\Qwen3.5-9B-Q4_K_M.gguf" --host 0.0.0.0 --port 8080 --temp 0.7 --top-p 0.8 --top-k 20 --min-p 0.00
PHPStan
SUCCESS
- PHP Version
- 8.4
- Laufzeit
- 430 ms
- Speicher
- 72.5 MB
PHPUnit
PHPUnit wurde in diesem Run nicht ausgefuhrt.
Test-Details
- Projekt
- nb_headless_content_blocks
- Branch
test/local-qwen3.5-9b-Q4- Test-Prompt
- suggest additional unit tests for our project
- Warmup-Prompts
- Can you check AGENTS.md, is it up to date?; run phpstan
- Session
ses_06241794fffeoe7nArfxq8noN4- Screenshots
- 5
- Effektive Modell-Dauer
- 56 min 18 s Session-Zeit minus User-Wartezeit
- User-Wartezeit
- 1 min 29 s
- Session gesamt
- 58 min
Finales Branch-Ergebnis
Tests schlagen fehl
- Tests
- 0
- Assertions
- 0
- Fehler
- 0
Issues
- Marker: errors.txt — Aufgabe konnte nicht abgeschlossen werden
Notizen
Warmup: Can you check AGENTS.md, is it up to date?, run phpstan | Aufgabe konnte nicht abgeschlossen werden | Marker: errors.txt — Aufgabe konnte nicht abgeschlossen werden