[{"data":1,"prerenderedAt":1006},["ShallowReactive",2],{"blog-post-nl-\u002Fblog\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x":3,"blog-posts-sidebar-nl":587},{"id":4,"title":5,"body":6,"categories":561,"date":575,"description":576,"extension":577,"image":578,"meta":579,"navigation":580,"originalUrl":581,"path":582,"seo":583,"slug":584,"stem":585,"__hash__":586},"blogNl\u002Fblog\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x.md","Paiton FP8 verslaat NVIDIA's H200 op AMD's MI300X",{"type":7,"value":8,"toc":553},"minimark",[9,13,16,19,27,30,33,74,80,83,86,92,95,98,469,475,482,489,495,534,537,540,543,546],[10,11,12],"p",{},"AI evolueert razendsnel en efficiënte inferentie is essentieel om krachtige modellen in praktijksituaties in te zetten. Bij Eliovp verleggen we voortdurend de grenzen van AI-prestaties. In eerdere artikelen toonden we al aanzienlijke inferentieversnellingen met FP16 en BF16. Nu zetten we opnieuw een grote stap: Paiton behaalt met FP8 sterkere inferentieprestaties op AMD MI300X-GPU's dan NVIDIA's H200. Zowel AMD als NVIDIA ondersteunt FP8, maar onze zorgvuldig geoptimaliseerde kernels maken hier het verschil.",[10,14,15],{},"Het verhaal rond AI-hardware werd lang door één speler gedomineerd. AMD's MI300-serie verandert dat met bijzonder veel rekenkracht. De uitdaging blijft om die capaciteit volledig te benutten. Daar komt Paiton in beeld.",[10,17,18],{},"Onze kernmissie met Paiton is bestaande AI-modellen optimaliseren door de kernels voor inferentie nauwkeurig af te stemmen op AMD-architecturen. We analyseren de onderliggende bewerkingen, herschrijven en fuseren ze en stemmen ze af op de specifieke sterke punten van AMD-hardware. Het resultaat is een aanzienlijk hogere inferentiesnelheid en een efficiënter gebruik van resources.",[20,21,23],"h3",{"id":22},"testopstelling-en-methodologie",[24,25,26],"strong",{},"Testopstelling en methodologie",[10,28,29],{},"Voor transparante en reproduceerbare resultaten documenteren we onze benchmarkopstelling:",[10,31,32],{},"Zoals altijd kozen we voor de best mogelijke configuratie om de vergelijking eerlijk te houden.",[34,35,36,50,56,62,68],"ul",{},[37,38,39,42,43],"li",{},[24,40,41],{},"Inferentiebibliotheek:"," vLLM v0.9.0 + ",[44,45,49],"a",{"href":46,"rel":47},"https:\u002F\u002Fhuggingface.co\u002Famd\u002FLlama-3.1-70B-Instruct-FP8-KV",[48],"nofollow","amd\u002FLlama-3.1-70B-Instruct-FP8-KV",[37,51,52,55],{},[24,53,54],{},"Hardware:"," AMD MI300X (192GB HBM3) versus NVIDIA H200 (141GB HBM3e)",[37,57,58,61],{},[24,59,60],{},"Softwarestack:"," ROCm 6.3.1 op Ubuntu 22.04 (een upgrade naar 6.4 kan nog betere resultaten opleveren); CUDA 12.x op Ubuntu 22.04",[37,63,64,67],{},[24,65,66],{},"Metingen:"," Gemiddelden over 10 inferentieruns, met zowel cold-start- als steady-state-Time to First Token (TTFT) en end-to-end-latency (van API-oproep tot laatste token)",[37,69,70,73],{},[24,71,72],{},"Batchgroottes:"," 1 tot 128, voor zowel interactieve AI-workloads (1 tot 64) als het uiterste voor batchverwerking (128)",[20,75,77],{"id":76},"het-voordeel-van-fp8-het-tijdperk-van-efficiëntie",[24,78,79],{},"Het voordeel van FP8: het tijdperk van efficiëntie",[10,81,82],{},"De introductie van FP8-precisie (8-bit floating point) was een belangrijke stap naar efficiëntere AI-inferentie. FP8 verkleint de geheugenvoetafdruk en verlaagt de rekenintensiteit. Daardoor kunnen grotere modellen worden ingezet of kunnen bestaande modellen met een veel hogere throughput draaien terwijl ze minder geheugen gebruiken. Moderne AI-hardware van zowel AMD als NVIDIA ondersteunt FP8, maar om het volledige potentieel te benutten is sterk geoptimaliseerde software nodig.",[10,84,85],{},"We hebben intensief gewerkt aan de integratie en optimalisatie van onze FP8-kernels voor AMD. Onze recente benchmarks laten een duidelijke overwinning zien voor de AMD MI300X met Paiton's geoptimaliseerde kernels.",[20,87,89],{"id":88},"paiton-op-amd-mi300x-een-nieuwe-standaard-zetten",[24,90,91],{},"Paiton op AMD MI300X: een nieuwe standaard zetten",[10,93,94],{},"Uit onze interne tests blijkt dat de AMD MI300X-GPU met Paiton's geoptimaliseerde kernels aantoonbaar betere resultaten behaalt dan de NVIDIA H200-GPU bij FP8-inferentie met het amd\u002FLlama-3.1-70B-Instruct-FP8-KV-model.",[10,96,97],{},"Hier zijn de benchmarkresultaten waarin de prestaties van NVIDIA H200 en AMD MI300X worden vergeleken met de geoptimaliseerde kernels van Paiton:",[99,100,101,138],"table",{},[102,103,104],"thead",{},[105,106,107,111,114,117,120,123,126,129,132,135],"tr",{},[108,109,110],"th",{},"Batch",[108,112,113],{},"H200 (req\u002Fs)",[108,115,116],{},"MI300X + Paiton (req\u002Fs)",[108,118,119],{},"H200 (tok\u002Fs)",[108,121,122],{},"MI300X + Paiton (tok\u002Fs)",[108,124,125],{},"H200 E2E (ms)",[108,127,128],{},"MI300X E2E (ms)",[108,130,131],{},"H200 TTFT (ms)",[108,133,134],{},"MI300X TTFT (ms)",[108,136,137],{},"Winnaar",[139,140,141,184,225,266,307,348,389,429],"tbody",{},[105,142,143,147,150,155,158,163,166,171,176,179],{},[144,145,146],"td",{},"1",[144,148,149],{},"0,16",[144,151,152],{},[24,153,154],{},"0,17",[144,156,157],{},"39,9",[144,159,160],{},[24,161,162],{},"43,4",[144,164,165],{},"640,7",[144,167,168],{},[24,169,170],{},"589,5",[144,172,173],{},[24,174,175],{},"136,3",[144,177,178],{},"138,6",[144,180,181],{},[24,182,183],{},"Paiton",[105,185,186,189,192,197,200,205,208,213,216,221],{},[144,187,188],{},"2",[144,190,191],{},"0,31",[144,193,194],{},[24,195,196],{},"0,34",[144,198,199],{},"78,5",[144,201,202],{},[24,203,204],{},"87,0",[144,206,207],{},"518,5",[144,209,210],{},[24,211,212],{},"477,7",[144,214,215],{},"133,6",[144,217,218],{},[24,219,220],{},"122,4",[144,222,223],{},[24,224,183],{},[105,226,227,230,233,238,241,246,249,254,257,262],{},[144,228,229],{},"4",[144,231,232],{},"0,60",[144,234,235],{},[24,236,237],{},"0,67",[144,239,240],{},"129,6",[144,242,243],{},[24,244,245],{},"172,0",[144,247,248],{},"562,2",[144,250,251],{},[24,252,253],{},"441,6",[144,255,256],{},"134,3",[144,258,259],{},[24,260,261],{},"132,6",[144,263,264],{},[24,265,183],{},[105,267,268,271,274,279,282,287,290,295,300,303],{},[144,269,270],{},"8",[144,272,273],{},"1,18",[144,275,276],{},[24,277,278],{},"1,31",[144,280,281],{},"225,0",[144,283,284],{},[24,285,286],{},"252,1",[144,288,289],{},"587,6",[144,291,292],{},[24,293,294],{},"493,3",[144,296,297],{},[24,298,299],{},"269,9",[144,301,302],{},"280,9",[144,304,305],{},[24,306,183],{},[105,308,309,312,315,320,323,328,331,336,341,344],{},[144,310,311],{},"16",[144,313,314],{},"2.21",[144,316,317],{},[24,318,319],{},"2,45",[144,321,322],{},"343,1",[144,324,325],{},[24,326,327],{},"470,1",[144,329,330],{},"560,6",[144,332,333],{},[24,334,335],{},"502,5",[144,337,338],{},[24,339,340],{},"461,3",[144,342,343],{},"513,8",[144,345,346],{},[24,347,183],{},[105,349,350,353,356,361,364,369,372,377,380,385],{},[144,351,352],{},"32",[144,354,355],{},"3,93",[144,357,358],{},[24,359,360],{},"4,07",[144,362,363],{},"591,8",[144,365,366],{},[24,367,368],{},"814,5",[144,370,371],{},"659,1",[144,373,374],{},[24,375,376],{},"640,6",[144,378,379],{},"1188,7",[144,381,382],{},[24,383,384],{},"1187,5",[144,386,387],{},[24,388,183],{},[105,390,391,394,399,402,407,410,415,418,421,426],{},[144,392,393],{},"64",[144,395,396],{},[24,397,398],{},"6,64",[144,400,401],{},"6,24",[144,403,404],{},[24,405,406],{},"1297,4",[144,408,409],{},"1179,7",[144,411,412],{},[24,413,414],{},"789,3",[144,416,417],{},"812,2",[144,419,420],{},"2362,3",[144,422,423],{},[24,424,425],{},"1880,3",[144,427,428],{},"Gelijkspel",[105,430,431,434,439,442,447,450,455,458,461,466],{},[144,432,433],{},"128",[144,435,436],{},[24,437,438],{},"9,75",[144,440,441],{},"9.01",[144,443,444],{},[24,445,446],{},"1821,9",[144,448,449],{},"1655,8",[144,451,452],{},[24,453,454],{},"607,7",[144,456,457],{},"635,5",[144,459,460],{},"3633,3",[144,462,463],{},[24,464,465],{},"3502.0",[144,467,468],{},"H200",[10,470,471,474],{},[24,472,473],{},"Opmerking:"," In voorlopige tests presteerden Paiton's FP8-kernels ook beter dan AMD's eigen Aiter-engine op MI300X.",[10,476,477],{},[478,479],"img",{"alt":480,"src":481},"","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fh200vsmi300xfp8.webp",[10,483,484,485,488],{},"De resultaten zijn duidelijk: ",[24,486,487],{},"met Paiton verwerkt de AMD MI300X Llama-3.1-70B-Instruct-FP8-KV-verzoeken bij kleine tot middelgrote batchgroottes met een hogere throughput en lagere latency dan de NVIDIA H200. Ook de Time to First Token (TTFT) is vaak beter."," Dat toont rechtstreeks de kracht van gerichte kerneloptimalisatie. De NVIDIA H200 blijft sterk bij de hoogste batchgroottes, maar Paiton heeft een duidelijk voordeel in courante praktijkscenario's met kleinere, frequentere verzoeken, zoals bij interactieve AI-applicaties. Voor eindgebruikers betekent dat snellere antwoorden en een efficiënter gebruik van AMD-hardware.",[20,490,492],{"id":491},"waarom-dit-voor-u-belangrijk-is",[24,493,494],{},"Waarom dit voor u belangrijk is",[34,496,497,503,514,524],{},[37,498,499,502],{},[24,500,501],{},"Benut het volledige potentieel van AMD:"," Wie in geavanceerde hardware zoals AMD MI300X-GPU's investeert, wil die capaciteit volledig benutten en geen prestaties verliezen door generieke software. Paiton haalt zoveel mogelijk uit elke rekencyclus. Onze nauwkeurig afgestemde kernels beperken inactieve tijd en maximaliseren de nuttige rekenkracht voor AI-inferentieworkloads.",[37,504,505,508,509,513],{},[24,506,507],{},"Kosteneffectieve AI-implementatie:"," Hogere inferentie-efficiëntie vertaalt zich direct in tastbare kostenbesparingen. Wanneer uw modellen sneller en efficiënter werken, kunt u meer aanvragen verwerken of bestaande workloads in minder tijd voltooien. Dit heeft een directe invloed op uw operationele kosten, of u nu een lokaal datacenter beheert of gebruikmaakt van cloudgebaseerde GPU-instances. Na verloop van tijd kunnen deze optimalisaties leiden tot ",[510,511,512],"em",{},"substantiële verlagingen van uw totale eigendomskosten"," voor de AI-infrastructuur.",[37,515,516,519,520,523],{},[24,517,518],{},"Maak uw deployments toekomstbestendig:"," AI-modellen evolueren voortdurend naar grotere, complexere architecturen en precisieformaten zoals FP8. Naarmate hun rekenbehoeften groeien, worden sterk geoptimaliseerde inferentieoplossingen essentieel om prestaties en schaalbaarheid te behouden. ",[510,521,522],{},"De voortdurende ontwikkeling van Paiton"," helpt uw AI-deployments klaar te maken voor de volgende generatie modellen en precisievereisten.",[37,525,526,529,530,533],{},[24,527,528],{},"Bredere hardwarekeuze:"," Ons werk met Paiton stelt ontwikkelaars en organisaties in staat om met vertrouwen AMD te kiezen voor hun veeleisende behoeften op het gebied van AI-inferentie. Door ",[510,531,532],{},"superieure prestaties te demonstreren op AMD MI210, MI250X, MI300X, MI325X",", MI355X, bevorderen we een competitiever en innovatiever hardware-ecosysteem, waardoor u meer flexibiliteit en opties krijgt bij het ontwerpen van uw AI-infrastructuur. Deze concurrentie stimuleert innovatie in de hele sector, waar uiteindelijk alle gebruikers van profiteren.",[10,535,536],{},"Het tijdperk van uniforme AI-optimalisatie loopt snel ten einde. Paiton loopt voorop met gespecialiseerde, krachtige oplossingen die zorgvuldig voor AMD-GPU's zijn ontworpen. Met onze nieuwste verbeteringen, waaronder de FP8-optimalisaties, optimaliseren we niet alleen bestaande prestaties, we verleggen de grens van wat mogelijk is voor AI-inferentie op AMD-hardware.",[10,538,539],{},"Blijf op de hoogte voor meer diepgaande technische uitsplitsingen en verdere benchmarkreleases terwijl we de grenzen van AI-prestaties blijven verleggen. Tijdens deze FP8-benchmarks hebben we aanvullende optimalisatietechnieken ontdekt die we zullen laten zien in komende diepgaande posts! We zullen binnenkort opwindende resultaten delen over Tensor Parallelism (TP), waarbij Paiton superieure prestaties en schaalbaarheid blijft demonstreren en zelfs AMD's eigen AITER-engine overtreft in onze interne tests. Als u AI-modellen op AMD-hardware gebruikt, is het tijd om het Paiton-verschil te ervaren en te zien hoe onze kerneloptimalisaties uw mogelijkheden voor AI-inferentie kunnen verbeteren.",[10,541,542],{},"Als u AI-modellen op AMD-hardware gebruikt, is het tijd om het Paiton-verschil te ervaren en te zien hoe onze kerneloptimalisaties uw mogelijkheden voor AI-inferentie kunnen verbeteren.",[10,544,545],{},"Neem contact op voor een demo en verbeter uw AI-inferentieprestaties.",[10,547,548],{},[510,549,550],{},[24,551,552],{},"Het Paiton-team",{"title":480,"searchDepth":554,"depth":554,"links":555},2,[556,558,559,560],{"id":22,"depth":557,"text":26},3,{"id":76,"depth":557,"text":79},{"id":88,"depth":557,"text":91},{"id":491,"depth":557,"text":494},[562,563,183,564,565,566,567,568,569,570,571,572,573,574],"Alle","Kunstmatige intelligentie","Niet gecategoriseerd","AMD MI300X","Koude startoptimalisatie","Bedrijfs-AI","Generatieve AI","GPU-prestaties","Inferentielatentie","Grote taalmodellen","Llama 3.1 405B","Model serving","vLLM-optimalisatie","2025-06-08T19:12:40","AI evolueert razendsnel en efficiënte inferentie is essentieel om krachtige modellen in praktijksituaties in te zetten. Paiton levert nu sterkere FP8-inferentieprestaties op AMD MI300X-GPU's dan NVIDIA's H200, dankzij zorgvuldig geoptimaliseerde kernels.","md","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fblognewfp8.webp",{},true,"https:\u002F\u002Feliovp.com\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x\u002F","\u002Fblog\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x",{"title":5,"description":576},"paiton-fp8-beats-nvidias-h200-on-amds-mi300x","blog\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x","fbCfxJPqU-U2rLKk0atts0sQNhdFByKlFNK2TMsdblU",[588,602,616,647,658,680,698,716,735,753,769,781,797,812,823,832,840,854,856,867,878,888,901,911,924,935,945,956,965,977,988,997],{"path":589,"title":590,"description":591,"date":592,"slug":593,"image":594,"originalUrl":595,"categories":596},"\u002Fblog\u002Fpaiton-qwen38-radeon-ai-pro-r9700","Paiton: 21% meer Qwen3.8-doorvoer op Radeon AI PRO R9700","Paiton draait AMD's Qwen3.8 27B op één Radeon AI PRO R9700 met 39,77 outputtokens per seconde. Dat levert 21% meer throughput en 17,4% lagere gemodelleerde kosten op.","2026-09-04T09:00:00","paiton-qwen38-radeon-ai-pro-r9700","\u002Fasset\u002Fimages\u002Fblog\u002Fpaiton-r9700\u002F00-featured-paiton-r9700.webp","https:\u002F\u002Feliovp.com\u002Fblog\u002Fpaiton-qwen38-radeon-ai-pro-r9700",[183,563,597,598,569,570,599,571,600,601],"AMD Radeon","AI-inferentie","Inferentie-optimalisatie","vLLM","Kostenefficiëntie",{"path":603,"title":604,"description":605,"date":606,"slug":607,"image":608,"originalUrl":609,"categories":610},"\u002Fblog\u002Fai-data-center-power-requirements-gpu-per-megawatt","Stroomvereisten voor AI-datacenters: de GPU-per-MW-illusie","Waarom vermelden offertes voor AI-datacenters verschillende GPU-capaciteiten? Ontdek hoe PUE, piekbelasting, opslag, netwerken en koeling bepalen hoeveel compute werkelijk inzetbaar is.","2026-07-27T23:52:00","ai-data-center-power-requirements-gpu-per-megawatt","\u002Fasset\u002Fimages\u002Fblog\u002Fai-data-center-power-requirements-gpu-per-megawatt\u002Fgpu-per-megawatt-illusion.webp",null,[562,611,612,613,614,615],"AI-infrastructuur","Datacenters","ModFlex","HPC","AMD Helios",{"path":617,"title":618,"description":619,"date":620,"slug":621,"image":622,"originalUrl":623,"categories":624},"\u002Fblog\u002Fpaiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x","Paiton keert terug naar zijn diffusiewortels: optimalisatie van Wan2.2-T2V-A14B op AMD MI355X","Toen we begonnen met het bouwen van Paiton, was een van onze eerste aandachtsgebieden het optimaliseren van diffusiemodellen. Stable Diffusion XL was een van de eerste grote modellen waarin we lieten zien dat gefuseerde operators, efficiënte uitvoering en hardwarebewuste kernels een echt verschil konden maken. Nu keren we terug naar die oorsprong. Met de groeiende belangstelling voor het genereren van tekst-naar-video, ...","2026-06-10T14:04:04","paiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonwan2.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x\u002F",[562,563,183,625,626,627,628,629,630,631,632,568,633,634,635,636,637,638,639,640,183,641,642,643,644,645,646],"14B","AMD","B200","Benchmarks","Blackwell","Compute","Diffusie","Eliovp","GPU","Hardware","Inferentie","Instinct","MI355x","NVidia","On-premises","Optimalisatie","Soevereine AI","T2V","Tekst-naar-video","Tuning","Video-generatie","Wan2.2",{"path":648,"title":649,"description":650,"date":651,"slug":652,"image":653,"originalUrl":654,"categories":655},"\u002Fblog\u002Ffrom-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure","Van zolder tot voorpagina: ElioVP erkend als pionier op het gebied van chipoptimalisatie en datacenterinfrastructuur","Het waren bijzondere weken voor het team van Eliovp. Ons bedrijf haalde de voorpagina van De Tijd, de toonaangevende zakenkrant van België. Ons verhaal begon bij een oprichter die op zolder aan hardware sleutelde en groeide uit tot een onderneming met 215 miljoen euro omzet.","2026-02-10T20:48:12","from-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fphysicalnewspaper.webp","https:\u002F\u002Feliovp.com\u002Ffrom-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure\u002F",[562,563,656,564,626,657,656,638],"Modulaire DC","De Tijd",{"path":659,"title":660,"description":661,"date":662,"slug":663,"image":664,"originalUrl":665,"categories":666},"\u002Fblog\u002Fprivacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit","Privacy is geen IT-probleem meer, het is een strategische prioriteit","Privacyrisico's, psychologische valkuilen en de operationele realiteit van generatieve AI in de Benelux. Waarom bedrijven gevoelige gegevens, governance en lokale AI strategisch moeten benaderen.","2026-01-29T13:51:11","privacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fheaderimage.webp","https:\u002F\u002Feliovp.com\u002Fprivacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit\u002F",[562,563,667,564,668,669,670,671,672,673,674,675,632,676,568,677,678,679],"Trending","AI Act","Antropomorfisme","AVG","Benelux","ChatGPT","Cyberbeveiliging","Databeheer","Gegevensbeveiliging","GDPR","Microsoft Copilot","Privacy","Shadow AI",{"path":681,"title":682,"description":683,"date":684,"slug":685,"image":686,"originalUrl":687,"categories":688},"\u002Fblog\u002Fitsme-bij-ons-is-het-its-not-me-en-dit-is-waarom","Itsme? Bij ons is het “it's not me”, en dit is waarom.","Waarom Eliovp itsme niet gebruikt voor medewerkers en interne processen: een analyse van datasoevereiniteit, cloudjurisdictie, metadata, eigendomsstructuur en technische risico's.","2025-11-27T09:32:14","itsme-bij-ons-is-het-its-not-me-en-dit-is-waarom","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffrontimage.webp","https:\u002F\u002Feliovp.com\u002Fitsme-bij-ons-is-het-its-not-me-en-dit-is-waarom\u002F",[562,689,690,691,673,692,693,694,676,695,696,697,678],"AWS","Belgian Mobile ID","CLOUD Act","Datasoevereiniteit","Digitale identiteit","eIDAS","itsme","Liberty Global","MyGov.be",{"path":699,"title":700,"description":701,"date":702,"slug":703,"image":704,"originalUrl":705,"categories":706},"\u002Fblog\u002Ffield-report-the-reality-of-building-agentic-ai-in-2025","Praktijkrapport: de realiteit van Agentic AI bouwen in 2025","De verwachtingen rond Agentic AI staan vaak ver af van de technische realiteit. Dit praktijkrapport beschrijft wat er nodig is om betrouwbare, lokale AI-agents voor bedrijfsworkflows te bouwen, van modulaire architectuur en observability tot modeltraining, VRAM en soevereine infrastructuur.","2025-11-25T14:03:39","field-report-the-reality-of-building-agentic-ai-in-2025","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffieldreport.webp","https:\u002F\u002Feliovp.com\u002Ffield-report-the-reality-of-building-agentic-ai-in-2025\u002F",[562,563,707,667,708,709,710,711,567,712,713,714,641,715],"Oplossingen","Agentic AI","AI-techniek","AI-strategie","Autonome agenten","Lokale LLM","Modelverfijning","AI op locatie","VRAM-optimalisatie",{"path":717,"title":718,"description":719,"date":720,"slug":721,"image":722,"originalUrl":723,"categories":724},"\u002Fblog\u002Fthe-synthetic-unicorn-bubble","De synthetische unicornzeepbel","Hoe AI-neocloudinfrastructuur circulaire kasstromen omzet in schijngroei. Tussen 2023 en 2025 stroomden miljarden aan durfkapitaal naar het neocloudecosysteem. Onze analyse onderzoekt hoe circulaire financiering, vaporware-infrastructuur en roofzuchtige contracten onderliggende activawaarden kunstmatig kunnen opbouwen.","2025-11-24T19:22:28","the-synthetic-unicorn-bubble","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fsyntheticunicorn.webp","https:\u002F\u002Feliovp.com\u002Fthe-synthetic-unicorn-bubble\u002F",[562,563,667,725,726,727,728,729,730,731,732,733,734],"AI Infrastructure","AI Neocloud","Circulaire financiering","GPU Cloud","Beleggingsrisico's","Opstartwaardering","Synthetische bubbel","Technische analyse","Vaporware","Durfkapitaal",{"path":736,"title":737,"description":738,"date":739,"slug":740,"image":741,"originalUrl":742,"categories":743},"\u002Fblog\u002Fbuilding-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power","De motor voor de AI-race bouwen: in vier maanden klaar voor NVIDIA GB300 NVL72","Bij AI-infrastructuur is snelheid een concurrentieel voordeel. Traditionele datacenterprojecten duren vaak 18 tot 24 maanden. Onze modulaire aanpak levert in vier maanden een operationele faciliteit die specifiek is ontworpen voor de NVIDIA GB300 NVL72.","2025-11-20T14:10:19","building-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fsuperpodmodflexfrontimage.webp","https:\u002F\u002Feliovp.com\u002Fbuilding-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power\u002F",[562,656,564,744,611,745,746,747,748,749,750,751,752],"150 kW rek","DLC","Hoge dichtheid","Vloeistofkoeling","Modulair datacenter","NVIDIA Blackwell Ultra","NVIDIA GB300","NVL72","Snelle implementatie",{"path":754,"title":755,"description":756,"date":757,"slug":758,"image":759,"originalUrl":760,"categories":761},"\u002Fblog\u002Fwhy-cuda-translation-wont-unlock-amds-real-potential","Waarom de “CUDA”-vertaling het echte potentieel van AMD niet zal ontsluiten","Om de paar jaar verschijnt een oplossing met dezelfde belofte: behoud uw CUDA-code, wissel van toolchain en draai plots op verschillende GPU-platforms. Dat kan nuttig zijn voor compatibiliteit, maar ontsluit niet automatisch AMD's echte prestatiepotentieel. Daarvoor zijn AMD-first kernels, libraries en tuning nodig.","2025-11-12T14:48:37","why-cuda-translation-wont-unlock-amds-real-potential","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fchatgpt-image-nov-11-2025-09_16_10-pm-1.webp","https:\u002F\u002Feliovp.com\u002Fwhy-cuda-translation-wont-unlock-amds-real-potential\u002F",[562,563,183,564,565,563,762,763,764,765,766,767,183,768],"CUDA-vertaling","FP8","GPU-optimalisatie","Hoogwaardige computers","HIP","Kerneltuning","ROCm",{"path":770,"title":771,"description":772,"date":773,"slug":774,"image":775,"originalUrl":776,"categories":777},"\u002Fblog\u002Fpaiton-the-simplest-way-to-supercharge-ai-inference","Paiton: de eenvoudigste manier om AI-inferentie een boost te geven","Laten we eerlijk zijn: marketing is niet onze sterkste kant. We namen nooit extern kapitaal aan, verbrandden geen budget aan advertentiecampagnes en bouwden geen verkoopleger. We bouwen gewoon technologie die werkt. Paiton versnelt uw bestaande inferentiestack zonder migratie, nieuwe API's of modelconversie.","2025-11-11T10:31:22","paiton-the-simplest-way-to-supercharge-ai-inference","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaiton-powaaah.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-the-simplest-way-to-supercharge-ai-inference\u002F",[562,563,183,598,778,565,601,779,599,767,183,780,600],"AMD Instinct","Hoge throughput","SGLang",{"path":782,"title":783,"description":784,"date":785,"slug":786,"image":787,"originalUrl":788,"categories":789},"\u002Fblog\u002Fstop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens","Stop met te veel betalen: Paiton MI300X MoE verslaat H200\u002FB200 in kosten per 1 miljoen tokens","We benchmarkten Paiton's nieuwe MoE-ondersteuning met Qwen\u002FQwen3-30B-A3B-Instruct-2507 en vergeleken de inferentieprestaties van verschillende opstellingen. Elke configuratie draaide vijf keer per batchgrootte. We rapporteren het gemiddelde van die runs op basis van realistische conversationele workloads.","2025-09-26T13:36:18","stop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fhulkvshulkpaitonwins.webp","https:\u002F\u002Feliovp.com\u002Fstop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens\u002F",[562,563,183,790,565,791,599,792,793,794,795,183,796],"AI-benchmarks","Kosten per token","Mixture of Experts","MoE","NVIDIA B200","NVIDIA H200","Qwen3",{"path":798,"title":799,"description":800,"date":801,"slug":802,"image":803,"originalUrl":804,"categories":805},"\u002Fblog\u002Fagentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en","Agentic AI, maar dan lokaal: van inbox naar inzicht en actie","We bouwen productieklare, local-first AI-agents die aansluiten op uw bestaande e-mailomgeving. Ze maken tickets aan, classificeren berichten, lezen documenten, herkennen facturen en offertes, analyseren beelden en sturen gestructureerde rapporten naar uw systemen, zonder verplichte afhankelijkheid van externe AI-API's.","2025-09-16T13:09:00","agentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffrontfotoblog.webp","https:\u002F\u002Feliovp.com\u002Fagentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en\u002F",[562,563,707,564,708,806,807,808,809,712,714,641,810,811],"Schadedetectie","Documentverwerking","E-mailautomatisering","Factuurextractie","Ticketautomatisering","Workflowautomatisering",{"path":813,"title":814,"description":815,"date":816,"slug":817,"image":818,"originalUrl":819,"categories":820},"\u002Fblog\u002Fmi300x-fp8-data-parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach","MI300X FP8 data-parallelle benchmarks (8 tot 64 GPU's): H200 achter zich, B200 binnen bereik","We schalen Llama-3.1-8B-Instruct-FP8-KV met Paiton op een gepartitioneerde AMD MI300X-server van 8 fysieke GPU's naar 64 virtuele GPU's. De resultaten tonen sterke multi-tenant throughput, veel lagere latency en een bijna gelijkspel met NVIDIA's B200.","2025-07-31T13:32:57","mi300x-fp8-data-parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fimage-2-1.webp","https:\u002F\u002Feliovp.com\u002Fmi300x-fp8-data%e2%80%91parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach\u002F",[562,563,183,564,821,626,627,468,822,637,638,183,600],"AI","MI300X",{"path":824,"title":825,"description":826,"date":827,"slug":828,"image":829,"originalUrl":830,"categories":831},"\u002Fblog\u002Fapplicable-ai-for-businesses","Toepasbare AI voor bedrijven","Bij Eliovp blijven we innoveren om praktische oplossingen te bouwen. Een van onze grootste sterktes is het vermogen om buiten de gebaande paden te denken. Daarom ontwikkelen we toepasbare AI-oplossingen die dagelijks bruikbaar zijn en precies aansluiten op de behoeften van onze klanten.","2025-07-09T21:35:30","applicable-ai-for-businesses","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fscherm_afbeelding-2025-07-09-om-23.30.17.webp","https:\u002F\u002Feliovp.com\u002Fapplicable-ai-for-businesses\u002F",[562,563,707,708,806,807,808,809,712,714,641,810,811],{"path":833,"title":834,"description":835,"date":836,"slug":837,"image":480,"originalUrl":838,"categories":839},"\u002Fblog\u002Fintroducing-paitons-free-evaluation-models","Maak kennis met de gratis evaluatiemodellen van Paiton","AI verandert elke sector in hoog tempo, maar grote modellen efficiënt uitvoeren blijft een aanzienlijke technische en financiële uitdaging. ElioVP specialiseert zich in optimalisatie voor AMD-accelerators en helpt organisaties het volledige potentieel van hun hardware te benutten. Met onze gratis evaluatiemodellen kunt u de optimalisaties van Paiton vooraf op uw eigen workloads testen.","2025-07-07T11:26:13","introducing-paitons-free-evaluation-models","https:\u002F\u002Feliovp.com\u002Fintroducing-paitons-free-evaluation-models\u002F",[562,563,183],{"path":841,"title":842,"description":843,"date":844,"slug":845,"image":846,"originalUrl":847,"categories":848},"\u002Fblog\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b","Paiton: veel sneller opstarten en betere prestaties voor Llama-3.1-405B","Met Paiton streven we niet alleen naar maximale inferentiesnelheden. We verbeteren de volledige levenscyclus van de deployment van grote taalmodellen. Onze nieuwste test combineert AMD MI300X-GPU's met het omvangrijke Llama-3.1-405B-Instruct-FP8-KV-model en levert baanbrekende resultaten op voor zowel opstartsnelheid als runtimeprestaties.","2025-06-12T20:15:23","paiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fservingscreenshot.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b\u002F",[562,563,183,564,598,565,849,763,850,572,851,183,852,853],"Koude start","Grafiekcompilatie","LLM-optimalisatie","Opstartlatentie","Tensor-parallellisme",{"path":582,"title":5,"description":576,"date":575,"slug":584,"image":578,"originalUrl":581,"categories":855},[562,563,183,564,565,566,567,568,569,570,571,572,573,574],{"path":857,"title":858,"description":859,"date":860,"slug":861,"image":862,"originalUrl":863,"categories":864},"\u002Fblog\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm","MI300X versus H200 versus RX 7900 XTX versus Tenstorrent n300s met vLLM","Nu grote taalmodellen een fundamenteel onderdeel worden van moderne toepassingen, is de juiste server voor deployment belangrijker dan ooit. We vergelijken AMD MI300X, NVIDIA H200, AMD RX 7900 XTX en Tenstorrent n300s met vLLM op throughput en kosten.","2025-05-09T14:03:58","mi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fcomparisontenstor.webp","https:\u002F\u002Feliovp.com\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm\u002F",[562,563,183,707,564,626,822,638,865,866],"RX7900XTX","tenstorrent",{"path":868,"title":869,"description":870,"date":871,"slug":872,"image":873,"originalUrl":874,"categories":875},"\u002Fblog\u002Fclusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights","ClusterP&L: financiële inzichten voor investeerders in GPU-clusters","Eliovp ontwerpt, bouwt en optimaliseert al jaren GPU-clusters in heel Europa. Omdat klanten ons telkens opnieuw vroegen om een P&L-model voor hun investering, bundelden we onze praktijkkennis in ClusterP&L: een toegankelijke, voortdurend bijgewerkte tool voor financiële prognoses van GPU-infrastructuur.","2025-05-03T10:52:22","clusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fcomparisonscenarios.webp","https:\u002F\u002Feliovp.com\u002Fclusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights\u002F",[562,563,656,707,627,468,876,638,877],"MI325x","pnl-rekenmachine",{"path":879,"title":880,"description":881,"date":882,"slug":883,"image":884,"originalUrl":885,"categories":886},"\u002Fblog\u002Fcranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200","Snellere tokens voor minder geld: AMD MI300X tegenover NVIDIA H200","We vergelijken Qwen3-32B op een AMD MI300X, geoptimaliseerd met Paiton, met de NVIDIA H200. De resultaten tonen hoe Paiton vergelijkbare of betere prestaties kan leveren tegen lagere hardwarekosten en met aantrekkelijke kosten per miljoen tokens.","2025-05-02T21:10:30","cranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002F3ac59a73-2466-4422-b7e5-ef2e4a8ca58e.webp","https:\u002F\u002Feliovp.com\u002Fcranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200\u002F",[562,563,183,821,626,468,887,638,183,600],"MI300",{"path":889,"title":890,"description":891,"date":892,"slug":893,"image":894,"originalUrl":895,"categories":896},"\u002Fblog\u002Fpower-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw","Waar vermogen en precisie samenkomen: modulair high-density datacenter voor NVIDIA NVL-deployments (1 tot 2 MW)","Eliovp ontwikkelt modulaire high-density infrastructuur voor AI-workloads van Blackwell-klasse. Het platform ondersteunt NVIDIA NVL-configuraties van NVL4 tot NVL72, van gedistribueerde edge-inferentie tot modeltraining op hyperscale, met 1 tot 2 MW IT-vermogen per module.","2025-05-02T14:09:59","power-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Feliovp_critical-1mw-pod_rev-2_transparent.webp","https:\u002F\u002Feliovp.com\u002Fpower-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw\u002F",[562,656,897,725,746,614,747,748,898,899,751,900],"1-2MW datacenter","NVIDIA Blackwell","NVIDIA NVL","Precisiekoeling",{"path":902,"title":903,"description":904,"date":905,"slug":906,"image":907,"originalUrl":908,"categories":909},"\u002Fblog\u002Fexamining-ai-agents-in-the-medical-field-ai-that-speaks-dicom","AI-agents in de medische wereld: AI die DICOM spreekt","Eliovp ontwikkelde een medische AI-agent die rechtstreeks met DICOM-servers in ziekenhuizen communiceert. De assistent kan patiënten en onderzoeken opzoeken, relevante beelden ophalen en medische beeldanalyse ondersteunen binnen de lokale ziekenhuisinfrastructuur.","2025-04-11T14:45:48","examining-ai-agents-in-the-medical-field-ai-that-speaks-dicom","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fhealthcareblog-1.webp","https:\u002F\u002Feliovp.com\u002Fexamining-ai-agents-in-the-medical-field-ai-that-speaks-dicom\u002F",[562,563,707,564,821,626,910],"Zorg",{"path":912,"title":913,"description":914,"date":915,"slug":916,"image":917,"originalUrl":918,"categories":919},"\u002Fblog\u002Feliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs","Eliovp BV: uw partner voor een veerkrachtige supply chain bij nieuwe Amerikaanse invoerheffingen","Het internationale handelslandschap verandert snel. Nieuwe Amerikaanse invoerheffingen zorgen voor onzekerheid, vooral bij bedrijven die afhankelijk zijn van high-performance computing en AI-infrastructuur. Eliovp helpt klanten hun supply chain veerkrachtig, betrouwbaar en kostenefficiënt te houden.","2025-04-04T10:01:27","eliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ftariffsshipping.webp","https:\u002F\u002Feliovp.com\u002Feliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs\u002F",[562,667,821,626,920,921,922,923],"importeren","Taiwan","Tarieven","Trump",{"path":925,"title":926,"description":927,"date":928,"slug":929,"image":930,"originalUrl":931,"categories":932},"\u002Fblog\u002Fwhy-ai-agents-are-the-future","Waarom AI-agenten de toekomst zijn","AI-agenten integreren met uw bestaande ERP-, CRM- en marketingplatforms. Ze vullen uw huidige systemen aan, nemen intelligentere beslissingen en schalen mee met uw organisatie. Zo verlaagt u kosten, beperkt u fouten en maakt u medewerkers vrij voor werk met meer toegevoegde waarde.","2025-03-23T22:06:59","why-ai-agents-are-the-future","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ferp2.jpeg","https:\u002F\u002Feliovp.com\u002Fwhy-ai-agents-are-the-future\u002F",[562,563,707,821,933,934],"AI-agenten","ERP",{"path":936,"title":937,"description":938,"date":939,"slug":940,"image":941,"originalUrl":942,"categories":943},"\u002Fblog\u002Fthe-rise-of-open-source-ai-model-optimization","De opkomst van open-source AI-modeloptimalisatie","In het snel evoluerende AI-landschap zijn opensourceoplossingen belangrijke aanjagers van innovatie en betere prestaties. Deze door de gemeenschap gedragen platforms maken geavanceerde technologie breder toegankelijk, stimuleren samenwerking en versnellen de optimalisatie van AI-modellen.","2025-03-22T20:59:23","the-rise-of-open-source-ai-model-optimization","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Friseofopensource.jpeg","https:\u002F\u002Feliovp.com\u002Fthe-rise-of-open-source-ai-model-optimization\u002F",[562,563,667,944,626,633,638],"AI-nieuws",{"path":946,"title":947,"description":948,"date":949,"slug":950,"image":951,"originalUrl":952,"categories":953},"\u002Fblog\u002Fintroducing-our-benchmarking-tool-powered-by-dstack","Maak kennis met onze benchmarktool, gebouwd op dstack","Betrouwbare benchmarks zijn essentieel om AI-modellen en software te optimaliseren. Onze nieuwe tool integreert met dstack en maakt geautomatiseerde, reproduceerbare en schaalbare benchmarkworkflows mogelijk, zowel op lokale GPU's als in de cloud.","2025-03-20T14:21:59","introducing-our-benchmarking-tool-powered-by-dstack","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fbenchmarktool.jpeg","https:\u002F\u002Feliovp.com\u002Fintroducing-our-benchmarking-tool-powered-by-dstack\u002F",[562,563,183,821,626,954,955,822,183],"benchmark","LLM",{"path":957,"title":958,"description":959,"date":960,"slug":961,"image":962,"originalUrl":963,"categories":964},"\u002Fblog\u002Foptimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200","QwQ-32B optimaliseren (door Qwen): AMD MI300X versus NVIDIA H200","De meeste LLM-benchmarks richten zich op afgeleiden van Llama of DeepSeek. Met QwQ-32B verbreden we die vergelijking en testen we hoe Paiton de AMD MI300X optimaliseert tegenover NVIDIA's H200, van throughput en concurrency tot TTFT en end-to-end-latency.","2025-03-19T21:41:44","optimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaiton4.jpeg","https:\u002F\u002Feliovp.com\u002Foptimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200\u002F",[562,563,183],{"path":966,"title":967,"description":968,"date":969,"slug":970,"image":971,"originalUrl":972,"categories":973},"\u002Fblog\u002Feliovp-featured-on-amd-tech-talk-podcast","Eliovp te gast in de AMD Tech Talk-podcast","Eliovp was onlangs te gast in de AMD Tech Talk-podcast. Onze CEO Elio Van Puyvelde sprak met Jim Greene over het ontstaan van Eliovp, de passie en expertise achter het bedrijf en de geïntegreerde oplossingen die we vandaag aanbieden.","2025-03-19T07:53:39","eliovp-featured-on-amd-tech-talk-podcast","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ftechtalkjimgreene.jpeg","https:\u002F\u002Feliovp.com\u002Feliovp-featured-on-amd-tech-talk-podcast\u002F",[562,626,974,975,976],"Jim Greene","Podcast","Tech Talk",{"path":978,"title":979,"description":980,"date":981,"slug":982,"image":983,"originalUrl":984,"categories":985},"\u002Fblog\u002Ffurther-optimizing-amd-powered-inference-with-paiton","AMD-inferentie verder optimaliseren met Paiton","Paiton richt zich volledig op inferentieoptimalisatie voor AMD. Ons recentste werk levert voor DeepSeek R1 Distill Llama 8B een 10 tot 15% hogere throughput, een betere time-to-first-token en stabielere prestaties bij kleinere batchgroottes.","2025-03-13T06:18:30","further-optimizing-amd-powered-inference-with-paiton","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost3.webp","https:\u002F\u002Feliovp.com\u002Ffurther-optimizing-amd-powered-inference-with-paiton\u002F",[562,563,183,626,986,987,468,822,876,183,600],"Deepseek","H100",{"path":989,"title":990,"description":991,"date":992,"slug":993,"image":994,"originalUrl":995,"categories":996},"\u002Fblog\u002Fa-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b","Een eerste blik op Paiton in actie: Deepseek R1 Distill Llama 3.1 8B","Een eerste blik op hoe Paiton Deepseek R1 Distill Llama 3.1 8B optimaliseert voor de AMD MI300X. We vergelijken een met Paiton geoptimaliseerd model met de standaardversie en meten throughput, latency en end-to-end prestaties bij uiteenlopende batchgroottes.","2025-01-31T09:11:02","a-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost2.webp","https:\u002F\u002Feliovp.com\u002Fa-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b\u002F",[562,563,183,626,986,987,468,822,876,183,600],{"path":998,"title":999,"description":1000,"date":1001,"slug":1002,"image":1003,"originalUrl":1004,"categories":1005},"\u002Fblog\u002Fai-model-optimization-with-paiton","AI-modeloptimalisatie met Paiton","In de snel evoluerende wereld van artificiële intelligentie zijn efficiënte modellen en sterke prestaties cruciaal. Met Paiton biedt ElioVP doorgedreven optimalisatie voor AI-modellen. Door de modelarchitectuur te compileren en onze eigen kernels te gebruiken, maakt Paiton snellere inferentie en een lager resourcegebruik op AMD GPU's mogelijk.","2025-01-30T19:53:25","ai-model-optimization-with-paiton","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost1.webp","https:\u002F\u002Feliovp.com\u002Fai-model-optimization-with-paiton\u002F",[562,563,183,626,987,468,822,876,183,600],1788530430030]