AI hjørne
We Built a 576 GB AI Server That Runs GLM 5.2 i...
Kentino's on-premise AI server packs six NVIDIA RTX PRO 6000 Blackwell Max-Q cards, dual EPYC CPUs and enough redundancy to survive a pulled power supply — so frontier-class models run...
We Built a 576 GB AI Server That Runs GLM 5.2 i...
Kentino's on-premise AI server packs six NVIDIA RTX PRO 6000 Blackwell Max-Q cards, dual EPYC CPUs and enough redundancy to survive a pulled power supply — so frontier-class models run...
Komplet teknisk guide: Inddækning af CMP 170HX & ...
# Komplet teknisk guide: Flashing af CMP 170HX og oplåsning af 64 GB HBM2e på Ubuntu 22.04 LTS Denne guide gennemgår den komplette procedure for at omgå fabriks-OTP-begrænsninger på...
Komplet teknisk guide: Inddækning af CMP 170HX & ...
# Komplet teknisk guide: Flashing af CMP 170HX og oplåsning af 64 GB HBM2e på Ubuntu 22.04 LTS Denne guide gennemgår den komplette procedure for at omgå fabriks-OTP-begrænsninger på...
Låser op for fremtiden for AI-beregning: Hvordan budget...
Den globale eksplosion af kunstig intelligens har skabt en hidtil uset efterspørgsel efter GPU-beregning med høj tæthed. For startups, virksomhedsudviklere og cloud-infrastrukturudbydere er det vigtigt at anskaffe sig førsteklasses virksomhedsacceleratorer som NVIDIA...
Låser op for fremtiden for AI-beregning: Hvordan budget...
Den globale eksplosion af kunstig intelligens har skabt en hidtil uset efterspørgsel efter GPU-beregning med høj tæthed. For startups, virksomhedsudviklere og cloud-infrastrukturudbydere er det vigtigt at anskaffe sig førsteklasses virksomhedsacceleratorer som NVIDIA...
Casestudie: 4x RTX 4090 AI-arbejdsstation
Denne artikel dokumenterer en komplet byggeproces bestilt til en forskningskunde, der havde brug for en rackmonterbar, 24/7-kompatibel LLM-inferensarbejdsstation med tilstrækkelig VRAM til at hoste modeller i 70B-klassen uden cloudafhængighed. Alt...
Casestudie: 4x RTX 4090 AI-arbejdsstation
Denne artikel dokumenterer en komplet byggeproces bestilt til en forskningskunde, der havde brug for en rackmonterbar, 24/7-kompatibel LLM-inferensarbejdsstation med tilstrækkelig VRAM til at hoste modeller i 70B-klassen uden cloudafhængighed. Alt...
TurboQuant: Læsning af KV Cache-komprimeringsbr...
Læsetid: 10 min | Hvordan Googles 3-bit komprimering gør langkontekst-LLM'er billigere, og hvad det fortæller os om de næste 18 måneders AI-inferens Der er en stille...
TurboQuant: Læsning af KV Cache-komprimeringsbr...
Læsetid: 10 min | Hvordan Googles 3-bit komprimering gør langkontekst-LLM'er billigere, og hvad det fortæller os om de næste 18 måneders AI-inferens Der er en stille...
AI Model VRAM-krav på tværs af forskellige GPU...
AI Model VRAM-krav på tværs af forskellige GPU-konfigurationer Denne tabel giver et overblik over omtrentlige modelstørrelser (i milliarder af parametre), der kan køres på forskellige VRAM-konfigurationer, sammen...
AI Model VRAM-krav på tværs af forskellige GPU...
AI Model VRAM-krav på tværs af forskellige GPU-konfigurationer Denne tabel giver et overblik over omtrentlige modelstørrelser (i milliarder af parametre), der kan køres på forskellige VRAM-konfigurationer, sammen...