AI hjørne

We Built a 576 GB AI Server That Runs GLM 5.2 i...

Kentino's on-premise AI server packs six NVIDIA RTX PRO 6000 Blackwell Max-Q cards, dual EPYC CPUs and enough redundancy to survive a pulled power supply — so frontier-class models run...

We Built a 576 GB AI Server That Runs GLM 5.2 i...

Kentino's on-premise AI server packs six NVIDIA RTX PRO 6000 Blackwell Max-Q cards, dual EPYC CPUs and enough redundancy to survive a pulled power supply — so frontier-class models run...

Komplet teknisk guide: Flashing af CMP 170HX og oplåsning af 64 GB HBM2e på Ubuntu 22.04 LTS

Komplet teknisk guide: Inddækning af CMP 170HX & ...

# Komplet teknisk guide: Flashing af CMP 170HX og oplåsning af 64 GB HBM2e på Ubuntu 22.04 LTS Denne guide gennemgår den komplette procedure for at omgå fabriks-OTP-begrænsninger på...

Komplet teknisk guide: Inddækning af CMP 170HX & ...

# Komplet teknisk guide: Flashing af CMP 170HX og oplåsning af 64 GB HBM2e på Ubuntu 22.04 LTS Denne guide gennemgår den komplette procedure for at omgå fabriks-OTP-begrænsninger på...

Låser op for fremtiden for AI-beregning: Hvordan budgetvenlige GPU'er og ulåst CMP 170HX revolutionerer LLM-hosting

Låser op for fremtiden for AI-beregning: Hvordan budget...

Den globale eksplosion af kunstig intelligens har skabt en hidtil uset efterspørgsel efter GPU-beregning med høj tæthed. For startups, virksomhedsudviklere og cloud-infrastrukturudbydere er det vigtigt at anskaffe sig førsteklasses virksomhedsacceleratorer som NVIDIA...

Låser op for fremtiden for AI-beregning: Hvordan budget...

Den globale eksplosion af kunstig intelligens har skabt en hidtil uset efterspørgsel efter GPU-beregning med høj tæthed. For startups, virksomhedsudviklere og cloud-infrastrukturudbydere er det vigtigt at anskaffe sig førsteklasses virksomhedsacceleratorer som NVIDIA...

Casestudie: 4x RTX 4090 AI-arbejdsstation

Denne artikel dokumenterer en komplet byggeproces bestilt til en forskningskunde, der havde brug for en rackmonterbar, 24/7-kompatibel LLM-inferensarbejdsstation med tilstrækkelig VRAM til at hoste modeller i 70B-klassen uden cloudafhængighed. Alt...

Casestudie: 4x RTX 4090 AI-arbejdsstation

Denne artikel dokumenterer en komplet byggeproces bestilt til en forskningskunde, der havde brug for en rackmonterbar, 24/7-kompatibel LLM-inferensarbejdsstation med tilstrækkelig VRAM til at hoste modeller i 70B-klassen uden cloudafhængighed. Alt...

TurboQuant: Læsning af KV Cache-komprimeringsbr...

Læsetid: 10 min | Hvordan Googles 3-bit komprimering gør langkontekst-LLM'er billigere, og hvad det fortæller os om de næste 18 måneders AI-inferens Der er en stille...

TurboQuant: Læsning af KV Cache-komprimeringsbr...

Læsetid: 10 min | Hvordan Googles 3-bit komprimering gør langkontekst-LLM'er billigere, og hvad det fortæller os om de næste 18 måneders AI-inferens Der er en stille...

AI Model VRAM-krav på tværs af forskellige GPU...

AI Model VRAM-krav på tværs af forskellige GPU-konfigurationer Denne tabel giver et overblik over omtrentlige modelstørrelser (i milliarder af parametre), der kan køres på forskellige VRAM-konfigurationer, sammen...

AI Model VRAM-krav på tværs af forskellige GPU...

AI Model VRAM-krav på tværs af forskellige GPU-konfigurationer Denne tabel giver et overblik over omtrentlige modelstørrelser (i milliarder af parametre), der kan køres på forskellige VRAM-konfigurationer, sammen...