(Laatst bijgewerkt:
10-10-2026)
— Geschreven door
SimeonOnSecurity— 9 minuten leestijd
Een benchmarkvergelijking van twee RTX 5060 Ti-kaarten met 16 GB en een NVIDIA GB10-systeem voor Qwen 3 27B en lokale inferentie met een lange context.
(Laatst bijgewerkt:
10-10-2026)
— Geschreven door
SimeonOnSecurity— 9 minuten leestijd
Bepaal de omvang van een lokale LLM-configuratie met 16 GB op basis van modelgewichten, KV-cache en promptverwerking. Vergelijk geheugenbudgetten, GPU-bandbreedte en eigendomskosten voor Qwen3.8 27B.
(Laatst bijgewerkt:
10-10-2026)
— Geschreven door
SimeonOnSecurity— 9 minuten leestijd
Vergelijk lokale AI met ChatGPT en Claude aan de hand van benchmarkscores, geheugenschattingen, servicesnelheid en agentverificatie. Met scenario’s voor RTX 5090, DGX Spark en Mac Studio.
(Laatst bijgewerkt:
10-10-2026)
— Geschreven door
SimeonOnSecurity— 10 minuten leestijd
Een praktische gids voor oktober 2026 voor het kiezen van lokale AI-modellen voor programmeeragents. Vergelijk GPU-geheugen, groei van de KV-cache, contextgrootte, quantisatiekwaliteit, promptverwerking, redeneerniveaus en cloudhuurkosten.
(Laatst bijgewerkt:
10-10-2026)
— Geschreven door
SimeonOnSecurity— 10 minuten leestijd
Praktische gids voor oktober 2026 om een Qwen 27B-model te draaien met 32 GB bruikbaar acceleratorgeheugen. Vergelijk losse GPU’s, systemen met twee kaarten, unified memory, gebruikte datacenterkaarten, gehuurde rekenkracht, softwareondersteuning en limieten bij volledige context.
(Laatst bijgewerkt:
10-10-2026)
— Geschreven door
SimeonOnSecurity— 8 minuten leestijd
De 64GB-laag van NVIDIA’s DGX Spark laat zien hoe druk op het geheugenaanbod lokale AI-hardware vormt. Deze gids bespreekt de capaciteitsverlaging, de afwegingen van gedeeld geheugen en waarom verlichting op de DRAM-markt voor eind 2027 onwaarschijnlijk is.
(Laatst bijgewerkt:
10-10-2026)
— Geschreven door
SimeonOnSecurity— 14 minuten leestijd
Gemeten Ollama-benchmarks van Llama 3.1 8B en Qwen3.8 27B op belangrijke Vast.ai-GPU’s. Vergelijk decodeersnelheid, lange context, huurkosten, self-hosting, API-tegoed en abonnementen.