AI hjørne

Vi byggede en 576 GB AI-server, der kører GLM 5.2 i...

Kentinos lokale AI-server har seks NVIDIA RTX PRO 6000 Blackwell Max-Q-kort, to EPYC-CPU'er og nok redundans til at overleve en strømafbrydelse — så modeller i frontlinjen kører...

Vi byggede en 576 GB AI-server, der kører GLM 5.2 i...

Kentinos lokale AI-server har seks NVIDIA RTX PRO 6000 Blackwell Max-Q-kort, to EPYC-CPU'er og nok redundans til at overleve en strømafbrydelse — så modeller i frontlinjen kører...

Komplet teknisk guide: Flashing af CMP 170HX og oplåsning af 64 GB HBM2e på Ubuntu 22.04 LTS

Komplet teknisk guide: Inddækning af CMP 170HX & ...

# Komplet teknisk guide: Flashing af CMP 170HX og oplåsning af 64 GB HBM2e på Ubuntu 22.04 LTS Denne guide gennemgår den komplette procedure for at omgå fabriks-OTP-begrænsninger på...

Komplet teknisk guide: Inddækning af CMP 170HX & ...

# Komplet teknisk guide: Flashing af CMP 170HX og oplåsning af 64 GB HBM2e på Ubuntu 22.04 LTS Denne guide gennemgår den komplette procedure for at omgå fabriks-OTP-begrænsninger på...

Låser op for fremtiden for AI-beregning: Hvordan budgetvenlige GPU'er og ulåst CMP 170HX revolutionerer LLM-hosting

Låser op for fremtiden for AI-beregning: Hvordan budget...

Den globale eksplosion af kunstig intelligens har skabt en hidtil uset efterspørgsel efter GPU-beregning med høj tæthed. For startups, virksomhedsudviklere og cloud-infrastrukturudbydere er det vigtigt at anskaffe sig førsteklasses virksomhedsacceleratorer som NVIDIA...

Låser op for fremtiden for AI-beregning: Hvordan budget...

Den globale eksplosion af kunstig intelligens har skabt en hidtil uset efterspørgsel efter GPU-beregning med høj tæthed. For startups, virksomhedsudviklere og cloud-infrastrukturudbydere er det vigtigt at anskaffe sig førsteklasses virksomhedsacceleratorer som NVIDIA...

Casestudie: 4x RTX 4090 AI-arbejdsstation

Denne artikel dokumenterer en komplet byggeproces bestilt til en forskningskunde, der havde brug for en rackmonterbar, 24/7-kompatibel LLM-inferensarbejdsstation med tilstrækkelig VRAM til at hoste modeller i 70B-klassen uden cloudafhængighed. Alt...

Casestudie: 4x RTX 4090 AI-arbejdsstation

Denne artikel dokumenterer en komplet byggeproces bestilt til en forskningskunde, der havde brug for en rackmonterbar, 24/7-kompatibel LLM-inferensarbejdsstation med tilstrækkelig VRAM til at hoste modeller i 70B-klassen uden cloudafhængighed. Alt...

TurboQuant: Læsning af KV Cache-komprimeringsbr...

Læsetid: 10 min | Hvordan Googles 3-bit komprimering gør langkontekst-LLM'er billigere, og hvad det fortæller os om de næste 18 måneders AI-inferens Der er en stille...

TurboQuant: Læsning af KV Cache-komprimeringsbr...

Læsetid: 10 min | Hvordan Googles 3-bit komprimering gør langkontekst-LLM'er billigere, og hvad det fortæller os om de næste 18 måneders AI-inferens Der er en stille...

AI Model VRAM-krav på tværs af forskellige GPU...

AI Model VRAM-krav på tværs af forskellige GPU-konfigurationer Denne tabel giver et overblik over omtrentlige modelstørrelser (i milliarder af parametre), der kan køres på forskellige VRAM-konfigurationer, sammen...

AI Model VRAM-krav på tværs af forskellige GPU...

AI Model VRAM-krav på tværs af forskellige GPU-konfigurationer Denne tabel giver et overblik over omtrentlige modelstørrelser (i milliarder af parametre), der kan køres på forskellige VRAM-konfigurationer, sammen...