[{"data":1,"prerenderedAt":1221},["ShallowReactive",2],{"blog-post-nl-\u002Fblog\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm":3,"blog-posts-sidebar-nl":799},{"id":4,"title":5,"body":6,"categories":776,"date":787,"description":788,"extension":789,"image":790,"meta":791,"navigation":792,"originalUrl":793,"path":794,"seo":795,"slug":796,"stem":797,"__hash__":798},"blogNl\u002Fblog\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm.md","MI300X versus H200 versus RX 7900 XTX versus Tenstorrent n300s met vLLM",{"type":7,"value":8,"toc":763},"minimark",[9,13,16,32,40,43,46,53,172,178,184,191,201,204,207,213,359,372,378,391,424,430,505,510,522,525,528,533,538,552,557,570,575,589,594,611,616,630,684,691,697,703,713,719,725,734,740,743,757,760],[10,11,12],"p",{},"Nu grote taalmodellen (LLM's) een fundamenteel onderdeel van moderne toepassingen worden, is de juiste server voor deployment belangrijker dan ooit. Dat geldt voor ondernemingen die inferentie opschalen, start-ups die kosten optimaliseren en onderzoekers die de grenzen van throughput verleggen. In dit artikel vergelijken we twee bekende serveropstellingen met twee minder voor de hand liggende configuraties die normaal niet als datacenterserver worden gebruikt. Elk systeem gebruikt andere GPU- of acceleratorhardware met vLLM.",[10,14,15],{},"We vergelijken:",[17,18,19,23,26,29],"ol",{},[20,21,22],"li",{},"AMD MI300X",[20,24,25],{},"NVIDIA H200",[20,27,28],{},"Tenstorrent n300s",[20,30,31],{},"AMD RX 7900 XTX",[10,33,34,35,39],{},"Hoewel het vergelijken van de RX 7900 XTX met GPU's uit datacenterklasse misschien oneerlijk lijkt, is het belangrijk om de veelzijdigheid ervan te erkennen. Als multifunctionele GPU voor zowel high-end gaming als AI-ontwikkeling biedt hij een praktisch voordeel: u kunt hetzelfde systeem gebruiken voor ontwikkeling en vrije tijd. Dat maakt hem aantrekkelijk voor individuele ontwikkelaars, kleine teams of datacenters die ",[36,37,38],"strong",{},"op basis van de vraag dynamisch willen schakelen tussen gaming en AI-workloads",".",[10,41,42],{},"Dat gezegd hebbende, als we eerlijk zijn, nemen we de RX 7900 XTX vooral op omdat we deze al beschikbaar hebben en we benieuwd waren hoe deze zich verhoudt tot speciale datacenterhardware.",[10,44,45],{},"Het andere buitenbeentje is het Tenstorrent-systeem. Het toont veel potentieel en trok ongeveer drie jaar geleden al onze aandacht. We wilden het graag vergelijken met zijn veel grotere concurrenten en zo wat variatie brengen in een markt die momenteel door twee grote AI-spelers wordt gedomineerd (sorry, Intel).",[47,48,50],"h3",{"id":49},"gpu-specificaties-vanaf-q2-2025",[36,51,52],{},"GPU-specificaties (vanaf Q2 2025)",[54,55,56,93],"table",{},[57,58,59],"thead",{},[60,61,62,68,73,78,83,88],"tr",{},[63,64,65],"th",{},[36,66,67],{},"Versneller",[63,69,70],{},[36,71,72],{},"Architectuur",[63,74,75],{},[36,76,77],{},"VRAM",[63,79,80],{},[36,81,82],{},"Geheugentype",[63,84,85],{},[36,86,87],{},"TDP",[63,89,90],{},[36,91,92],{},"Geschatte prijs (USD)",[94,95,96,116,135,155],"tbody",{},[60,97,98,101,104,107,110,113],{},[99,100,22],"td",{},[99,102,103],{},"CDNA3",[99,105,106],{},"192 GB",[99,108,109],{},"HBM3",[99,111,112],{},"750W",[99,114,115],{},"~ $ 15.000",[60,117,118,120,123,126,129,132],{},[99,119,25],{},[99,121,122],{},"Hopper",[99,124,125],{},"141 GB",[99,127,128],{},"HBM3e",[99,130,131],{},"700W",[99,133,134],{},"~ $ 30.000",[60,136,137,140,143,146,149,152],{},[99,138,139],{},"AMD RX7900XTX",[99,141,142],{},"RDNA3",[99,144,145],{},"24 GB",[99,147,148],{},"GDDR6",[99,150,151],{},"355W",[99,153,154],{},"~ $ 1.000",[60,156,157,159,162,164,166,169],{},[99,158,28],{},[99,160,161],{},"Aangepaste RISC-V",[99,163,145],{},[99,165,148],{},[99,167,168],{},"300W",[99,170,171],{},"~$1.399",[10,173,174],{},[175,176,177],"em",{},"Opmerking: deze waarden zijn representatieve specificaties voor elke GPU of accelerator. De werkelijke prestaties kunnen variëren naargelang de systeemintegratie en de kenmerken van de workload, zoals CPU, moederbord en koeling. De GPU of accelerator is hier de belangrijkste onderscheidende factor.",[47,179,181],{"id":180},"vermogensmeetmethode",[36,182,183],{},"Vermogensmeetmethode",[10,185,186,187,190],{},"Deze vergelijking was een uitdaging omdat de nauwkeurige kosten per GPU per miljoen tokens voor MI300X en H200 moeilijk te schatten zijn, omdat de prijzen van individuele GPU's niet openbaar beschikbaar zijn. Daarom hebben we de kosten per miljoen tokens berekend op basis van de volledige systeemprijs en het geschatte energieverbruik. Deze aanpak is logischer, omdat bij echte implementaties de kosten op systeemniveau (stroom, hardware, infrastructuur) bijdragen aan de operationele kosten die verder gaan dan alleen de GPU. Om rekening te houden met het volledige systeem, hebben we de gemeten tokendoorvoer en het energieverbruik van één GPU vermenigvuldigd met het aantal GPU's in de server en dat vervolgens opgeteld bij het totale energieverbruik van het systeem, waardoor de systeemkosten en het vermogen effectief over alle GPU's werden verdeeld onder de veronderstelling van ",[36,188,189],{},"volledig gebruik",". Houd er rekening mee dat deze waarden alleen het inactieve of geschatte energieverbruik vertegenwoordigen en geen rekening houden met extra componenten of een groter verbruik bij volledig systeemgebruik.",[10,192,193,194,39],{},"Het energieverbruik van het H200-systeem in rust werd niet rechtstreeks gemeten. We gebruikten een schatting uit een artikel dat aangeeft dat het systeem in rust doorgaans ongeveer 2.200 W verbruikt. Meer details vindt u in het ",[195,196,200],"a",{"href":197,"rel":198},"https:\u002F\u002Fwww.servethehome.com\u002Fsupermicro-sys-821ge-tnhr-8x-nvidia-h200-gpu-air-cooled-bluefield-intel-xeon-astera-broadcom\u002F5\u002F#:~:text=Supermicro%20SYS%2D821GE%2DTNHR%20Power%20Delivery&text=Generally%20with%20this%20system%2C%20we,around%2010kW%20at%20its%20peak",[199],"nofollow","artikel van ServeTheHome",[10,202,203],{},"Het energieverbruik bij inactiviteit van het RX 7900-systeem kon niet rechtstreeks worden gemeten en werd in plaats daarvan geschat op ongeveer 400 W.",[10,205,206],{},"De stroomverbruikwaarden voor andere systemen zijn gemeten met behulp van de ipmitool-tool.",[47,208,210],{"id":209},"serverconfiguraties-en-prijzen",[36,211,212],{},"Serverconfiguraties en prijzen",[54,214,215,259],{},[57,216,217],{},[60,218,219,224,229,234,239,244,249,254],{},[63,220,221],{},[36,222,223],{},"Server",[63,225,226],{},[36,227,228],{},"CPU",[63,230,231],{},[36,232,233],{},"RAM",[63,235,236],{},[36,237,238],{},"Opslag",[63,240,241],{},[36,242,243],{},"Koeling",[63,245,246],{},[36,247,248],{},"# GPU's",[63,250,251],{},[36,252,253],{},"Inactief systeemvermogen (geschat)",[63,255,256],{},[36,257,258],{},"Systeemprijs (USD)",[94,260,261,287,309,334],{},[60,262,263,266,269,272,275,278,281,284],{},[99,264,265],{},"A+ Server 8125GS-TNMR2",[99,267,268],{},"2x EPYC 9654",[99,270,271],{},"1536 GB",[99,273,274],{},"4TB NVMe",[99,276,277],{},"Lucht",[99,279,280],{},"8",[99,282,283],{},"~2400W",[99,285,286],{},"~$260.564",[60,288,289,292,295,297,299,301,303,306],{},[99,290,291],{},"SuperServer 821GE-TNHR",[99,293,294],{},"2x Intel Xeon Platina 8468H",[99,296,271],{},[99,298,274],{},[99,300,277],{},[99,302,280],{},[99,304,305],{},"~2200W",[99,307,308],{},"~$307.336",[60,310,311,314,317,320,323,325,328,331],{},[99,312,313],{},"DIY AMD-werkstation",[99,315,316],{},"Ryzen9 7950X",[99,318,319],{},"64 GB",[99,321,322],{},"2TB NVMe",[99,324,277],{},[99,326,327],{},"2",[99,329,330],{},"~400W",[99,332,333],{},"~$3.500",[60,335,336,339,342,345,347,350,353,356],{},[99,337,338],{},"Tenstorrent Loudbox",[99,340,341],{},"2x Intel® Xeon® Silver 4309Y",[99,343,344],{},"512 GB",[99,346,274],{},[99,348,349],{},"Passief",[99,351,352],{},"4",[99,354,355],{},"~700W",[99,357,358],{},"$ 12.000",[10,360,361,364,365],{},[175,362,363],{},"Opmerking: configuraties zijn representatief. Real-world builds kunnen variëren, afhankelijk van componenten, leveranciers en integratiekosten. De prijzen hier vindt u via"," ",[195,366,369],{"href":367,"rel":368},"http:\u002F\u002Fwww.thinkmate.com",[199],[175,370,371],{},"www.thinkmate.com",[47,373,375],{"id":374},"benchmark-instellingen",[36,376,377],{},"Benchmark-instellingen",[10,379,380,364,383,364,388],{},[175,381,382],{},"Opmerking: alle benchmarks zijn uitgevoerd met",[175,384,385],{},[36,386,387],{},"een enkele GPU of acceleratorkaart per systeem",[175,389,390],{},"om een eerlijke vergelijking tussen verschillende hardwareklassen te garanderen.",[392,393,394,400,406,412,418],"ul",{},[20,395,396,399],{},[36,397,398],{},"Framework:"," vLLM (paged attention + continuous batching)",[20,401,402,405],{},[36,403,404],{},"Model:"," meta-llama\u002FMeta-Llama-3-8B-Instruct",[20,407,408,411],{},[36,409,410],{},"Workload:"," Gelijktijdige prompts, batchgrootte 32, vaste outputlengte van 256 tokens",[20,413,414,417],{},[36,415,416],{},"Dataset",": ShareGPT",[20,419,420,423],{},[36,421,422],{},"Statistieken:"," Tokens\u002Fsec (doorvoer) en kosten-prestaties",[47,425,427],{"id":426},"vllm-benchmarkresultaten-alleen-batchgrootte-32",[36,428,429],{},"vLLM Benchmarkresultaten (alleen batchgrootte 32)",[54,431,432,454],{},[57,433,434],{},[60,435,436,440,444,449],{},[63,437,438],{},[36,439,223],{},[63,441,442],{},[36,443,248],{},[63,445,446],{},[36,447,448],{},"Tokens\u002Fsec per GPU",[63,450,451],{},[36,452,453],{},"Systeemtokens\u002Fsec",[94,455,456,468,480,493],{},[60,457,458,460,462,465],{},[99,459,22],{},[99,461,280],{},[99,463,464],{},"7003.10",[99,466,467],{},"56.024,8",[60,469,470,472,474,477],{},[99,471,25],{},[99,473,280],{},[99,475,476],{},"8192.08",[99,478,479],{},"65.536,64",[60,481,482,485,487,490],{},[99,483,484],{},"AMD RX 7900XTX(*)",[99,486,327],{},[99,488,489],{},"1113,59",[99,491,492],{},"2227.18",[60,494,495,497,499,502],{},[99,496,338],{},[99,498,352],{},[99,500,501],{},"1314.0",[99,503,504],{},"5256.0",[10,506,507],{},[175,508,509],{},"Opmerking: we hebben fouten met onvoldoende geheugen (OOM) aangetroffen toen de modelcontextlengte 131072 was met de AMD RX 7900 XTX. Deze is verlaagd naar 22048, wat een aanzienlijke verandering is.",[47,511,513,364,519],{"id":512},"kosten-per-miljoen-tokensopmerking-voor-de-eenvoud-van-de-vergelijking-gebruiken-we-een-levensduur-van-3-jaar-26280-uur-de-stroomkosten-worden-berekend-met-een-tarief-van-010-per-kwh",[36,514,515,516],{},"Kosten per miljoen tokens",[175,517,518],{},"Opmerking:",[175,520,521],{},"Voor de eenvoud van de vergelijking gebruiken we een levensduur van 3 jaar (26280 uur). De stroomkosten worden berekend met een tarief van $ 0,10 per kWh.",[10,523,524],{},"Hieronder ziet u de berekening van de kosten per 1 miljoen tokens:",[10,526,527],{},"Uitgaande van een afschrijving van 3 jaar en volledig systeem- en GPU-gebruik",[10,529,530],{},[36,531,532],{},"AMD MI300X-server:",[10,534,535],{},[175,536,537],{},"Uitgaande van een inactief energieverbruik van 2400 W en 8 GPU's die volledig worden benut bij 750 W, zou het totaal 8,4 kW zijn",[17,539,540,543,546,549],{},[20,541,542],{},"Systeemtokens\u002Fsec: 7003,10 tokens\u002Fsec\u002FGPU * 8 GPU's = 56.024,8 tokens\u002Fsec",[20,544,545],{},"Tokens per uur: 56.024,8 tokens\u002Fsec * 3600 sec\u002Fuur = 201.689.280 tokens\u002Fuur",[20,547,548],{},"Kosten per uur: $260.564 \u002F 26280 uur + 8,4 kW * $0,10\u002FkWh = $10,76",[20,550,551],{},"Kosten per 1 miljoen tokens: $10,76 \u002F (201.689.280 \u002F 1.000.000) = $0,053 per 1 miljoen tokens",[10,553,554],{},[36,555,556],{},"AMD MI300X Server + Paiton:",[17,558,559,562,565,567],{},[20,560,561],{},"Systeemtokens\u002Fsec: 7637,12 tokens\u002Fsec\u002FGPU * 8 GPU's = 61.096,96 tokens\u002Fsec",[20,563,564],{},"Tokens per uur: 61.096,96 tokens\u002Fsec * 3600 sec\u002Fuur = 219.949.056 tokens\u002Fuur",[20,566,548],{},[20,568,569],{},"Kosten per 1 miljoen tokens: $10,76 \u002F (219.949.056 \u002F 1.000.000) = $0,049 per 1 miljoen tokens",[10,571,572],{},[36,573,574],{},"Nvidia H200-server:",[17,576,577,580,583,586],{},[20,578,579],{},"Systeemtokens\u002Fsec: 8192,08 tokens\u002Fsec\u002FGPU * 8 GPU's = 65.536,64 tokens\u002Fsec",[20,581,582],{},"Tokens per uur: 65.536,64 tokens\u002Fsec * 3600 sec\u002Fuur = 235.931.904 tokens\u002Fuur",[20,584,585],{},"Kosten per uur: $307.336 \u002F 26280 uur + 7,8 kW * $0,10\u002FkWh = $12,48",[20,587,588],{},"Kosten per 1 miljoen tokens: $12,48 \u002F (235.931.904 \u002F 1.000.000) = $0,053 per 1 miljoen tokens",[10,590,591],{},[36,592,593],{},"AMD RX 7900 XTX-werkstation:",[17,595,596,599,602,605],{},[20,597,598],{},"Systeemtokens\u002Fsec: 1113,59 tokens\u002Fsec\u002FGPU * 2 GPU's = 2227,18 tokens\u002Fsec",[20,600,601],{},"Tokens per uur: 2227,18 tokens\u002Fsec * 3600 sec\u002Fuur = 8.018.153 tokens\u002Fuur",[20,603,604],{},"Kosten per uur: $3.500 \u002F 26280 uur + 1,054 kW * $0,10\u002FkWh = $0,24",[20,606,607,608],{},"Kosten per 1 miljoen tokens: $0,24 \u002F (8.018.153 \u002F 1.000.000) = $0,030 per 1 miljoen tokens ",[36,609,610],{},"met een contextlengte van 22048",[10,612,613],{},[36,614,615],{},"Tenstorrent Loudbox:",[17,617,618,621,624,627],{},[20,619,620],{},"Systeemtokens\u002Fsec: 1314 tokens\u002Fsec\u002Fkaart * 4 kaarten = 5256 tokens\u002Fsec",[20,622,623],{},"Tokens per uur: 5256 tokens\u002Fsec * 3600 sec\u002Fuur = 18.921.600 tokens\u002Fuur",[20,625,626],{},"Kosten per uur: $12.000 \u002F 26280 uur + 1,9 kW * $0,10\u002FkWh = $0,65",[20,628,629],{},"Kosten per 1 miljoen tokens: $ 0,65 \u002F (18.921.600 \u002F 1.000.000) = $ 0,034 per 1 miljoen tokens",[54,631,632,645],{},[57,633,634],{},[60,635,636,640],{},[63,637,638],{},[36,639,223],{},[63,641,642],{},[36,643,644],{},"Kosten per 1 miljoen tokens",[94,646,647,654,662,668,677],{},[60,648,649,651],{},[99,650,22],{},[99,652,653],{},"$ 0,053",[60,655,656,659],{},[99,657,658],{},"AMD MI300X + Paiton",[99,660,661],{},"$ 0,049",[60,663,664,666],{},[99,665,25],{},[99,667,653],{},[60,669,670,672],{},[99,671,139],{},[99,673,674],{},[175,675,676],{},"$ 0,030 (lagere contextlengte)",[60,678,679,681],{},[99,680,338],{},[99,682,683],{},"$ 0,034",[10,685,686],{},[687,688],"img",{"alt":689,"src":690},"","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fcharttenstorrent.webp",[47,692,694],{"id":693},"observaties",[36,695,696],{},"Observaties",[10,698,699,702],{},[36,700,701],{},"AMD MI300X:"," Competitieve throughput en een enorme hoeveelheid VRAM. Ideaal voor middelgrote tot grote batchgroottes en grotere modellen zoals Llama 3-70B en hoger. We gebruikten Llama3-8B uitsluitend omdat de andere kaarten geen grotere modellen op één GPU konden laden. Zonder GPU-partitionering is de MI300X voor zulke kleine use cases niet de meest logische keuze.",[10,704,705,708,709,712],{},[36,706,707],{},"AMD MI300X + Paiton:"," Inclusief de observaties die we hierboven hebben besproken, behaalde Paiton ",[36,710,711],{},"8,2% lagere kosten per miljoen tokens"," vergeleken met de standaard MI300X-configuratie, wat een verbeterde kostenefficiëntie door software-optimalisaties aantoont. Het Paiton Framework wordt voortdurend verbeterd en naarmate de ontwikkeling vordert, zullen deze kosten in de loop van de tijd blijven dalen.",[10,714,715,718],{},[36,716,717],{},"NVIDIA H200:"," Toonaangevende snelheid, vergelijkbaar met de AMD MI300X, en een volwassen CUDA-softwarestack. Gebruiksgemak is zeker het geval bij Nvidia.",[10,720,721,724],{},[36,722,723],{},"RX 7900 XTX:"," Een kosteneffectieve keuze voor individuele ontwikkelaars. Niet ideaal voor grotere workloads vanwege VRAM-beperkingen en de vervelende beperking van de contextlengte, maar geweldig voor lichte inferentie en ontwikkeling. Handig voor AI\u002FML-workloads en andere algemene GPU-gerelateerde workloads.",[10,726,727,730,731,39],{},[36,728,729],{},"Tenstorrent n300s:"," Innovatieve RISC-V-architectuur op maat gemaakt voor ML-workloads. Opkomende steun in inferentiekaders zoals vLLM, maar het ecosysteem groeit nog steeds. De kosten per 1 miljoen tokens zijn concurrerend voor kleinere modellen, ",[36,732,733],{},"als het model wordt ondersteund",[47,735,737],{"id":736},"laatste-gedachten",[36,738,739],{},"Laatste gedachten",[10,741,742],{},"Het kiezen van de juiste server hangt af van uw gebruiksscenario:",[392,744,745,751],{},[20,746,747,750],{},[36,748,749],{},"Start-ups en onderzoekers:"," een RX 7900 XTX-werkstation of Tenstorrent Loudbox voor betaalbare experimenten en inferentie. Controleer wel of Tenstorrent het gewenste model ondersteunt.",[20,752,753,756],{},[36,754,755],{},"Bedrijven:"," MI300X en H200 bieden een goede balans tussen prestaties en efficiëntie, maar de MI300X GPU biedt aanzienlijk groter VRAM tegen lagere kosten.",[10,758,759],{},"Gezien de verrassend concurrerende kostenefficiëntie van de RX 7900 XTX in deze analyse, zijn we verheugd om aan te kondigen dat RDNA-ondersteuning voor Paiton momenteel in ontwikkeling is om het potentieel van deze GPU's verder te ontsluiten.",[10,761,762],{},"In een snel evoluerend AI-hardwarelandschap zorgt het combineren van de juiste accelerator met geoptimaliseerde inferentieframeworks zoals vLLM ervoor dat u het beste uit uw infrastructuur haalt.",{"title":689,"searchDepth":764,"depth":764,"links":765},2,[766,768,769,770,771,772,774,775],{"id":49,"depth":767,"text":52},3,{"id":180,"depth":767,"text":183},{"id":209,"depth":767,"text":212},{"id":374,"depth":767,"text":377},{"id":426,"depth":767,"text":429},{"id":512,"depth":767,"text":773},"Kosten per miljoen tokensOpmerking: Voor de eenvoud van de vergelijking gebruiken we een levensduur van 3 jaar (26280 uur). De stroomkosten worden berekend met een tarief van $ 0,10 per kWh.",{"id":693,"depth":767,"text":696},{"id":736,"depth":767,"text":739},[777,778,779,780,781,782,783,784,785,786],"Alle","Kunstmatige intelligentie","Paiton","Oplossingen","Niet gecategoriseerd","AMD","MI300X","NVidia","RX7900XTX","tenstorrent","2025-05-09T14:03:58","Nu grote taalmodellen een fundamenteel onderdeel worden van moderne toepassingen, is de juiste server voor deployment belangrijker dan ooit. We vergelijken AMD MI300X, NVIDIA H200, AMD RX 7900 XTX en Tenstorrent n300s met vLLM op throughput en kosten.","md","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fcomparisontenstor.webp",{},true,"https:\u002F\u002Feliovp.com\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm\u002F","\u002Fblog\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm",{"title":5,"description":788},"mi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm","blog\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm","tFk3LqU_XCElS_W_1WcKv9vHKOggZiE5CehSzI6pdnY",[800,817,831,861,872,894,912,930,949,967,983,995,1010,1025,1036,1045,1053,1068,1080,1082,1093,1103,1116,1126,1139,1150,1160,1171,1180,1192,1203,1212],{"path":801,"title":802,"description":803,"date":804,"slug":805,"image":806,"originalUrl":807,"categories":808},"\u002Fblog\u002Fpaiton-qwen38-radeon-ai-pro-r9700","Paiton: 21% meer Qwen3.8-doorvoer op Radeon AI PRO R9700","Paiton draait AMD's Qwen3.8 27B op één Radeon AI PRO R9700 met 39,77 outputtokens per seconde. Dat levert 21% meer throughput en 17,4% lagere gemodelleerde kosten op.","2026-09-04T09:00:00","paiton-qwen38-radeon-ai-pro-r9700","\u002Fasset\u002Fimages\u002Fblog\u002Fpaiton-r9700\u002F00-featured-paiton-r9700.webp","https:\u002F\u002Feliovp.com\u002Fblog\u002Fpaiton-qwen38-radeon-ai-pro-r9700",[779,778,809,810,811,812,813,814,815,816],"AMD Radeon","AI-inferentie","GPU-prestaties","Inferentielatentie","Inferentie-optimalisatie","Grote taalmodellen","vLLM","Kostenefficiëntie",{"path":818,"title":819,"description":820,"date":821,"slug":822,"image":823,"originalUrl":824,"categories":825},"\u002Fblog\u002Fai-data-center-power-requirements-gpu-per-megawatt","Stroomvereisten voor AI-datacenters: de GPU-per-MW-illusie","Waarom vermelden offertes voor AI-datacenters verschillende GPU-capaciteiten? Ontdek hoe PUE, piekbelasting, opslag, netwerken en koeling bepalen hoeveel compute werkelijk inzetbaar is.","2026-07-27T23:52:00","ai-data-center-power-requirements-gpu-per-megawatt","\u002Fasset\u002Fimages\u002Fblog\u002Fai-data-center-power-requirements-gpu-per-megawatt\u002Fgpu-per-megawatt-illusion.webp",null,[777,826,827,828,829,830],"AI-infrastructuur","Datacenters","ModFlex","HPC","AMD Helios",{"path":832,"title":833,"description":834,"date":835,"slug":836,"image":837,"originalUrl":838,"categories":839},"\u002Fblog\u002Fpaiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x","Paiton keert terug naar zijn diffusiewortels: optimalisatie van Wan2.2-T2V-A14B op AMD MI355X","Toen we begonnen met het bouwen van Paiton, was een van onze eerste aandachtsgebieden het optimaliseren van diffusiemodellen. Stable Diffusion XL was een van de eerste grote modellen waarin we lieten zien dat gefuseerde operators, efficiënte uitvoering en hardwarebewuste kernels een echt verschil konden maken. Nu keren we terug naar die oorsprong. Met de groeiende belangstelling voor het genereren van tekst-naar-video, ...","2026-06-10T14:04:04","paiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonwan2.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x\u002F",[777,778,779,840,782,841,842,843,844,845,846,847,848,849,850,851,852,784,853,854,779,855,856,857,858,859,860],"14B","B200","Benchmarks","Blackwell","Compute","Diffusie","Eliovp","Generatieve AI","GPU","Hardware","Inferentie","Instinct","MI355x","On-premises","Optimalisatie","Soevereine AI","T2V","Tekst-naar-video","Tuning","Video-generatie","Wan2.2",{"path":862,"title":863,"description":864,"date":865,"slug":866,"image":867,"originalUrl":868,"categories":869},"\u002Fblog\u002Ffrom-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure","Van zolder tot voorpagina: ElioVP erkend als pionier op het gebied van chipoptimalisatie en datacenterinfrastructuur","Het waren bijzondere weken voor het team van Eliovp. Ons bedrijf haalde de voorpagina van De Tijd, de toonaangevende zakenkrant van België. Ons verhaal begon bij een oprichter die op zolder aan hardware sleutelde en groeide uit tot een onderneming met 215 miljoen euro omzet.","2026-02-10T20:48:12","from-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fphysicalnewspaper.webp","https:\u002F\u002Feliovp.com\u002Ffrom-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure\u002F",[777,778,870,781,782,871,870,784],"Modulaire DC","De Tijd",{"path":873,"title":874,"description":875,"date":876,"slug":877,"image":878,"originalUrl":879,"categories":880},"\u002Fblog\u002Fprivacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit","Privacy is geen IT-probleem meer, het is een strategische prioriteit","Privacyrisico's, psychologische valkuilen en de operationele realiteit van generatieve AI in de Benelux. Waarom bedrijven gevoelige gegevens, governance en lokale AI strategisch moeten benaderen.","2026-01-29T13:51:11","privacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fheaderimage.webp","https:\u002F\u002Feliovp.com\u002Fprivacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit\u002F",[777,778,881,781,882,883,884,885,886,887,888,889,846,890,847,891,892,893],"Trending","AI Act","Antropomorfisme","AVG","Benelux","ChatGPT","Cyberbeveiliging","Databeheer","Gegevensbeveiliging","GDPR","Microsoft Copilot","Privacy","Shadow AI",{"path":895,"title":896,"description":897,"date":898,"slug":899,"image":900,"originalUrl":901,"categories":902},"\u002Fblog\u002Fitsme-bij-ons-is-het-its-not-me-en-dit-is-waarom","Itsme? Bij ons is het “it's not me”, en dit is waarom.","Waarom Eliovp itsme niet gebruikt voor medewerkers en interne processen: een analyse van datasoevereiniteit, cloudjurisdictie, metadata, eigendomsstructuur en technische risico's.","2025-11-27T09:32:14","itsme-bij-ons-is-het-its-not-me-en-dit-is-waarom","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffrontimage.webp","https:\u002F\u002Feliovp.com\u002Fitsme-bij-ons-is-het-its-not-me-en-dit-is-waarom\u002F",[777,903,904,905,887,906,907,908,890,909,910,911,892],"AWS","Belgian Mobile ID","CLOUD Act","Datasoevereiniteit","Digitale identiteit","eIDAS","itsme","Liberty Global","MyGov.be",{"path":913,"title":914,"description":915,"date":916,"slug":917,"image":918,"originalUrl":919,"categories":920},"\u002Fblog\u002Ffield-report-the-reality-of-building-agentic-ai-in-2025","Praktijkrapport: de realiteit van Agentic AI bouwen in 2025","De verwachtingen rond Agentic AI staan vaak ver af van de technische realiteit. Dit praktijkrapport beschrijft wat er nodig is om betrouwbare, lokale AI-agents voor bedrijfsworkflows te bouwen, van modulaire architectuur en observability tot modeltraining, VRAM en soevereine infrastructuur.","2025-11-25T14:03:39","field-report-the-reality-of-building-agentic-ai-in-2025","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffieldreport.webp","https:\u002F\u002Feliovp.com\u002Ffield-report-the-reality-of-building-agentic-ai-in-2025\u002F",[777,778,780,881,921,922,923,924,925,926,927,928,855,929],"Agentic AI","AI-techniek","AI-strategie","Autonome agenten","Bedrijfs-AI","Lokale LLM","Modelverfijning","AI op locatie","VRAM-optimalisatie",{"path":931,"title":932,"description":933,"date":934,"slug":935,"image":936,"originalUrl":937,"categories":938},"\u002Fblog\u002Fthe-synthetic-unicorn-bubble","De synthetische unicornzeepbel","Hoe AI-neocloudinfrastructuur circulaire kasstromen omzet in schijngroei. Tussen 2023 en 2025 stroomden miljarden aan durfkapitaal naar het neocloudecosysteem. Onze analyse onderzoekt hoe circulaire financiering, vaporware-infrastructuur en roofzuchtige contracten onderliggende activawaarden kunstmatig kunnen opbouwen.","2025-11-24T19:22:28","the-synthetic-unicorn-bubble","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fsyntheticunicorn.webp","https:\u002F\u002Feliovp.com\u002Fthe-synthetic-unicorn-bubble\u002F",[777,778,881,939,940,941,942,943,944,945,946,947,948],"AI Infrastructure","AI Neocloud","Circulaire financiering","GPU Cloud","Beleggingsrisico's","Opstartwaardering","Synthetische bubbel","Technische analyse","Vaporware","Durfkapitaal",{"path":950,"title":951,"description":952,"date":953,"slug":954,"image":955,"originalUrl":956,"categories":957},"\u002Fblog\u002Fbuilding-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power","De motor voor de AI-race bouwen: in vier maanden klaar voor NVIDIA GB300 NVL72","Bij AI-infrastructuur is snelheid een concurrentieel voordeel. Traditionele datacenterprojecten duren vaak 18 tot 24 maanden. Onze modulaire aanpak levert in vier maanden een operationele faciliteit die specifiek is ontworpen voor de NVIDIA GB300 NVL72.","2025-11-20T14:10:19","building-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fsuperpodmodflexfrontimage.webp","https:\u002F\u002Feliovp.com\u002Fbuilding-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power\u002F",[777,870,781,958,826,959,960,961,962,963,964,965,966],"150 kW rek","DLC","Hoge dichtheid","Vloeistofkoeling","Modulair datacenter","NVIDIA Blackwell Ultra","NVIDIA GB300","NVL72","Snelle implementatie",{"path":968,"title":969,"description":970,"date":971,"slug":972,"image":973,"originalUrl":974,"categories":975},"\u002Fblog\u002Fwhy-cuda-translation-wont-unlock-amds-real-potential","Waarom de “CUDA”-vertaling het echte potentieel van AMD niet zal ontsluiten","Om de paar jaar verschijnt een oplossing met dezelfde belofte: behoud uw CUDA-code, wissel van toolchain en draai plots op verschillende GPU-platforms. Dat kan nuttig zijn voor compatibiliteit, maar ontsluit niet automatisch AMD's echte prestatiepotentieel. Daarvoor zijn AMD-first kernels, libraries en tuning nodig.","2025-11-12T14:48:37","why-cuda-translation-wont-unlock-amds-real-potential","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fchatgpt-image-nov-11-2025-09_16_10-pm-1.webp","https:\u002F\u002Feliovp.com\u002Fwhy-cuda-translation-wont-unlock-amds-real-potential\u002F",[777,778,779,781,22,778,976,977,978,979,980,981,779,982],"CUDA-vertaling","FP8","GPU-optimalisatie","Hoogwaardige computers","HIP","Kerneltuning","ROCm",{"path":984,"title":985,"description":986,"date":987,"slug":988,"image":989,"originalUrl":990,"categories":991},"\u002Fblog\u002Fpaiton-the-simplest-way-to-supercharge-ai-inference","Paiton: de eenvoudigste manier om AI-inferentie een boost te geven","Laten we eerlijk zijn: marketing is niet onze sterkste kant. We namen nooit extern kapitaal aan, verbrandden geen budget aan advertentiecampagnes en bouwden geen verkoopleger. We bouwen gewoon technologie die werkt. Paiton versnelt uw bestaande inferentiestack zonder migratie, nieuwe API's of modelconversie.","2025-11-11T10:31:22","paiton-the-simplest-way-to-supercharge-ai-inference","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaiton-powaaah.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-the-simplest-way-to-supercharge-ai-inference\u002F",[777,778,779,810,992,22,816,993,813,981,779,994,815],"AMD Instinct","Hoge throughput","SGLang",{"path":996,"title":997,"description":998,"date":999,"slug":1000,"image":1001,"originalUrl":1002,"categories":1003},"\u002Fblog\u002Fstop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens","Stop met te veel betalen: Paiton MI300X MoE verslaat H200\u002FB200 in kosten per 1 miljoen tokens","We benchmarkten Paiton's nieuwe MoE-ondersteuning met Qwen\u002FQwen3-30B-A3B-Instruct-2507 en vergeleken de inferentieprestaties van verschillende opstellingen. Elke configuratie draaide vijf keer per batchgrootte. We rapporteren het gemiddelde van die runs op basis van realistische conversationele workloads.","2025-09-26T13:36:18","stop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fhulkvshulkpaitonwins.webp","https:\u002F\u002Feliovp.com\u002Fstop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens\u002F",[777,778,779,1004,22,1005,813,1006,1007,1008,25,779,1009],"AI-benchmarks","Kosten per token","Mixture of Experts","MoE","NVIDIA B200","Qwen3",{"path":1011,"title":1012,"description":1013,"date":1014,"slug":1015,"image":1016,"originalUrl":1017,"categories":1018},"\u002Fblog\u002Fagentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en","Agentic AI, maar dan lokaal: van inbox naar inzicht en actie","We bouwen productieklare, local-first AI-agents die aansluiten op uw bestaande e-mailomgeving. Ze maken tickets aan, classificeren berichten, lezen documenten, herkennen facturen en offertes, analyseren beelden en sturen gestructureerde rapporten naar uw systemen, zonder verplichte afhankelijkheid van externe AI-API's.","2025-09-16T13:09:00","agentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffrontfotoblog.webp","https:\u002F\u002Feliovp.com\u002Fagentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en\u002F",[777,778,780,781,921,1019,1020,1021,1022,926,928,855,1023,1024],"Schadedetectie","Documentverwerking","E-mailautomatisering","Factuurextractie","Ticketautomatisering","Workflowautomatisering",{"path":1026,"title":1027,"description":1028,"date":1029,"slug":1030,"image":1031,"originalUrl":1032,"categories":1033},"\u002Fblog\u002Fmi300x-fp8-data-parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach","MI300X FP8 data-parallelle benchmarks (8 tot 64 GPU's): H200 achter zich, B200 binnen bereik","We schalen Llama-3.1-8B-Instruct-FP8-KV met Paiton op een gepartitioneerde AMD MI300X-server van 8 fysieke GPU's naar 64 virtuele GPU's. De resultaten tonen sterke multi-tenant throughput, veel lagere latency en een bijna gelijkspel met NVIDIA's B200.","2025-07-31T13:32:57","mi300x-fp8-data-parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fimage-2-1.webp","https:\u002F\u002Feliovp.com\u002Fmi300x-fp8-data%e2%80%91parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach\u002F",[777,778,779,781,1034,782,841,1035,783,852,784,779,815],"AI","H200",{"path":1037,"title":1038,"description":1039,"date":1040,"slug":1041,"image":1042,"originalUrl":1043,"categories":1044},"\u002Fblog\u002Fapplicable-ai-for-businesses","Toepasbare AI voor bedrijven","Bij Eliovp blijven we innoveren om praktische oplossingen te bouwen. Een van onze grootste sterktes is het vermogen om buiten de gebaande paden te denken. Daarom ontwikkelen we toepasbare AI-oplossingen die dagelijks bruikbaar zijn en precies aansluiten op de behoeften van onze klanten.","2025-07-09T21:35:30","applicable-ai-for-businesses","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fscherm_afbeelding-2025-07-09-om-23.30.17.webp","https:\u002F\u002Feliovp.com\u002Fapplicable-ai-for-businesses\u002F",[777,778,780,921,1019,1020,1021,1022,926,928,855,1023,1024],{"path":1046,"title":1047,"description":1048,"date":1049,"slug":1050,"image":689,"originalUrl":1051,"categories":1052},"\u002Fblog\u002Fintroducing-paitons-free-evaluation-models","Maak kennis met de gratis evaluatiemodellen van Paiton","AI verandert elke sector in hoog tempo, maar grote modellen efficiënt uitvoeren blijft een aanzienlijke technische en financiële uitdaging. ElioVP specialiseert zich in optimalisatie voor AMD-accelerators en helpt organisaties het volledige potentieel van hun hardware te benutten. Met onze gratis evaluatiemodellen kunt u de optimalisaties van Paiton vooraf op uw eigen workloads testen.","2025-07-07T11:26:13","introducing-paitons-free-evaluation-models","https:\u002F\u002Feliovp.com\u002Fintroducing-paitons-free-evaluation-models\u002F",[777,778,779],{"path":1054,"title":1055,"description":1056,"date":1057,"slug":1058,"image":1059,"originalUrl":1060,"categories":1061},"\u002Fblog\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b","Paiton: veel sneller opstarten en betere prestaties voor Llama-3.1-405B","Met Paiton streven we niet alleen naar maximale inferentiesnelheden. We verbeteren de volledige levenscyclus van de deployment van grote taalmodellen. Onze nieuwste test combineert AMD MI300X-GPU's met het omvangrijke Llama-3.1-405B-Instruct-FP8-KV-model en levert baanbrekende resultaten op voor zowel opstartsnelheid als runtimeprestaties.","2025-06-12T20:15:23","paiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fservingscreenshot.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b\u002F",[777,778,779,781,810,22,1062,977,1063,1064,1065,779,1066,1067],"Koude start","Grafiekcompilatie","Llama 3.1 405B","LLM-optimalisatie","Opstartlatentie","Tensor-parallellisme",{"path":1069,"title":1070,"description":1071,"date":1072,"slug":1073,"image":1074,"originalUrl":1075,"categories":1076},"\u002Fblog\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x","Paiton FP8 verslaat NVIDIA's H200 op AMD's MI300X","AI evolueert razendsnel en efficiënte inferentie is essentieel om krachtige modellen in praktijksituaties in te zetten. Paiton levert nu sterkere FP8-inferentieprestaties op AMD MI300X-GPU's dan NVIDIA's H200, dankzij zorgvuldig geoptimaliseerde kernels.","2025-06-08T19:12:40","paiton-fp8-beats-nvidias-h200-on-amds-mi300x","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fblognewfp8.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x\u002F",[777,778,779,781,22,1077,925,847,811,812,814,1064,1078,1079],"Koude startoptimalisatie","Model serving","vLLM-optimalisatie",{"path":794,"title":5,"description":788,"date":787,"slug":796,"image":790,"originalUrl":793,"categories":1081},[777,778,779,780,781,782,783,784,785,786],{"path":1083,"title":1084,"description":1085,"date":1086,"slug":1087,"image":1088,"originalUrl":1089,"categories":1090},"\u002Fblog\u002Fclusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights","ClusterP&L: financiële inzichten voor investeerders in GPU-clusters","Eliovp ontwerpt, bouwt en optimaliseert al jaren GPU-clusters in heel Europa. Omdat klanten ons telkens opnieuw vroegen om een P&L-model voor hun investering, bundelden we onze praktijkkennis in ClusterP&L: een toegankelijke, voortdurend bijgewerkte tool voor financiële prognoses van GPU-infrastructuur.","2025-05-03T10:52:22","clusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fcomparisonscenarios.webp","https:\u002F\u002Feliovp.com\u002Fclusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights\u002F",[777,778,870,780,841,1035,1091,784,1092],"MI325x","pnl-rekenmachine",{"path":1094,"title":1095,"description":1096,"date":1097,"slug":1098,"image":1099,"originalUrl":1100,"categories":1101},"\u002Fblog\u002Fcranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200","Snellere tokens voor minder geld: AMD MI300X tegenover NVIDIA H200","We vergelijken Qwen3-32B op een AMD MI300X, geoptimaliseerd met Paiton, met de NVIDIA H200. De resultaten tonen hoe Paiton vergelijkbare of betere prestaties kan leveren tegen lagere hardwarekosten en met aantrekkelijke kosten per miljoen tokens.","2025-05-02T21:10:30","cranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002F3ac59a73-2466-4422-b7e5-ef2e4a8ca58e.webp","https:\u002F\u002Feliovp.com\u002Fcranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200\u002F",[777,778,779,1034,782,1035,1102,784,779,815],"MI300",{"path":1104,"title":1105,"description":1106,"date":1107,"slug":1108,"image":1109,"originalUrl":1110,"categories":1111},"\u002Fblog\u002Fpower-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw","Waar vermogen en precisie samenkomen: modulair high-density datacenter voor NVIDIA NVL-deployments (1 tot 2 MW)","Eliovp ontwikkelt modulaire high-density infrastructuur voor AI-workloads van Blackwell-klasse. Het platform ondersteunt NVIDIA NVL-configuraties van NVL4 tot NVL72, van gedistribueerde edge-inferentie tot modeltraining op hyperscale, met 1 tot 2 MW IT-vermogen per module.","2025-05-02T14:09:59","power-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Feliovp_critical-1mw-pod_rev-2_transparent.webp","https:\u002F\u002Feliovp.com\u002Fpower-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw\u002F",[777,870,1112,939,960,829,961,962,1113,1114,965,1115],"1-2MW datacenter","NVIDIA Blackwell","NVIDIA NVL","Precisiekoeling",{"path":1117,"title":1118,"description":1119,"date":1120,"slug":1121,"image":1122,"originalUrl":1123,"categories":1124},"\u002Fblog\u002Fexamining-ai-agents-in-the-medical-field-ai-that-speaks-dicom","AI-agents in de medische wereld: AI die DICOM spreekt","Eliovp ontwikkelde een medische AI-agent die rechtstreeks met DICOM-servers in ziekenhuizen communiceert. De assistent kan patiënten en onderzoeken opzoeken, relevante beelden ophalen en medische beeldanalyse ondersteunen binnen de lokale ziekenhuisinfrastructuur.","2025-04-11T14:45:48","examining-ai-agents-in-the-medical-field-ai-that-speaks-dicom","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fhealthcareblog-1.webp","https:\u002F\u002Feliovp.com\u002Fexamining-ai-agents-in-the-medical-field-ai-that-speaks-dicom\u002F",[777,778,780,781,1034,782,1125],"Zorg",{"path":1127,"title":1128,"description":1129,"date":1130,"slug":1131,"image":1132,"originalUrl":1133,"categories":1134},"\u002Fblog\u002Feliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs","Eliovp BV: uw partner voor een veerkrachtige supply chain bij nieuwe Amerikaanse invoerheffingen","Het internationale handelslandschap verandert snel. Nieuwe Amerikaanse invoerheffingen zorgen voor onzekerheid, vooral bij bedrijven die afhankelijk zijn van high-performance computing en AI-infrastructuur. Eliovp helpt klanten hun supply chain veerkrachtig, betrouwbaar en kostenefficiënt te houden.","2025-04-04T10:01:27","eliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ftariffsshipping.webp","https:\u002F\u002Feliovp.com\u002Feliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs\u002F",[777,881,1034,782,1135,1136,1137,1138],"importeren","Taiwan","Tarieven","Trump",{"path":1140,"title":1141,"description":1142,"date":1143,"slug":1144,"image":1145,"originalUrl":1146,"categories":1147},"\u002Fblog\u002Fwhy-ai-agents-are-the-future","Waarom AI-agenten de toekomst zijn","AI-agenten integreren met uw bestaande ERP-, CRM- en marketingplatforms. Ze vullen uw huidige systemen aan, nemen intelligentere beslissingen en schalen mee met uw organisatie. Zo verlaagt u kosten, beperkt u fouten en maakt u medewerkers vrij voor werk met meer toegevoegde waarde.","2025-03-23T22:06:59","why-ai-agents-are-the-future","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ferp2.jpeg","https:\u002F\u002Feliovp.com\u002Fwhy-ai-agents-are-the-future\u002F",[777,778,780,1034,1148,1149],"AI-agenten","ERP",{"path":1151,"title":1152,"description":1153,"date":1154,"slug":1155,"image":1156,"originalUrl":1157,"categories":1158},"\u002Fblog\u002Fthe-rise-of-open-source-ai-model-optimization","De opkomst van open-source AI-modeloptimalisatie","In het snel evoluerende AI-landschap zijn opensourceoplossingen belangrijke aanjagers van innovatie en betere prestaties. Deze door de gemeenschap gedragen platforms maken geavanceerde technologie breder toegankelijk, stimuleren samenwerking en versnellen de optimalisatie van AI-modellen.","2025-03-22T20:59:23","the-rise-of-open-source-ai-model-optimization","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Friseofopensource.jpeg","https:\u002F\u002Feliovp.com\u002Fthe-rise-of-open-source-ai-model-optimization\u002F",[777,778,881,1159,782,848,784],"AI-nieuws",{"path":1161,"title":1162,"description":1163,"date":1164,"slug":1165,"image":1166,"originalUrl":1167,"categories":1168},"\u002Fblog\u002Fintroducing-our-benchmarking-tool-powered-by-dstack","Maak kennis met onze benchmarktool, gebouwd op dstack","Betrouwbare benchmarks zijn essentieel om AI-modellen en software te optimaliseren. Onze nieuwe tool integreert met dstack en maakt geautomatiseerde, reproduceerbare en schaalbare benchmarkworkflows mogelijk, zowel op lokale GPU's als in de cloud.","2025-03-20T14:21:59","introducing-our-benchmarking-tool-powered-by-dstack","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fbenchmarktool.jpeg","https:\u002F\u002Feliovp.com\u002Fintroducing-our-benchmarking-tool-powered-by-dstack\u002F",[777,778,779,1034,782,1169,1170,783,779],"benchmark","LLM",{"path":1172,"title":1173,"description":1174,"date":1175,"slug":1176,"image":1177,"originalUrl":1178,"categories":1179},"\u002Fblog\u002Foptimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200","QwQ-32B optimaliseren (door Qwen): AMD MI300X versus NVIDIA H200","De meeste LLM-benchmarks richten zich op afgeleiden van Llama of DeepSeek. Met QwQ-32B verbreden we die vergelijking en testen we hoe Paiton de AMD MI300X optimaliseert tegenover NVIDIA's H200, van throughput en concurrency tot TTFT en end-to-end-latency.","2025-03-19T21:41:44","optimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaiton4.jpeg","https:\u002F\u002Feliovp.com\u002Foptimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200\u002F",[777,778,779],{"path":1181,"title":1182,"description":1183,"date":1184,"slug":1185,"image":1186,"originalUrl":1187,"categories":1188},"\u002Fblog\u002Feliovp-featured-on-amd-tech-talk-podcast","Eliovp te gast in de AMD Tech Talk-podcast","Eliovp was onlangs te gast in de AMD Tech Talk-podcast. Onze CEO Elio Van Puyvelde sprak met Jim Greene over het ontstaan van Eliovp, de passie en expertise achter het bedrijf en de geïntegreerde oplossingen die we vandaag aanbieden.","2025-03-19T07:53:39","eliovp-featured-on-amd-tech-talk-podcast","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ftechtalkjimgreene.jpeg","https:\u002F\u002Feliovp.com\u002Feliovp-featured-on-amd-tech-talk-podcast\u002F",[777,782,1189,1190,1191],"Jim Greene","Podcast","Tech Talk",{"path":1193,"title":1194,"description":1195,"date":1196,"slug":1197,"image":1198,"originalUrl":1199,"categories":1200},"\u002Fblog\u002Ffurther-optimizing-amd-powered-inference-with-paiton","AMD-inferentie verder optimaliseren met Paiton","Paiton richt zich volledig op inferentieoptimalisatie voor AMD. Ons recentste werk levert voor DeepSeek R1 Distill Llama 8B een 10 tot 15% hogere throughput, een betere time-to-first-token en stabielere prestaties bij kleinere batchgroottes.","2025-03-13T06:18:30","further-optimizing-amd-powered-inference-with-paiton","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost3.webp","https:\u002F\u002Feliovp.com\u002Ffurther-optimizing-amd-powered-inference-with-paiton\u002F",[777,778,779,782,1201,1202,1035,783,1091,779,815],"Deepseek","H100",{"path":1204,"title":1205,"description":1206,"date":1207,"slug":1208,"image":1209,"originalUrl":1210,"categories":1211},"\u002Fblog\u002Fa-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b","Een eerste blik op Paiton in actie: Deepseek R1 Distill Llama 3.1 8B","Een eerste blik op hoe Paiton Deepseek R1 Distill Llama 3.1 8B optimaliseert voor de AMD MI300X. We vergelijken een met Paiton geoptimaliseerd model met de standaardversie en meten throughput, latency en end-to-end prestaties bij uiteenlopende batchgroottes.","2025-01-31T09:11:02","a-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost2.webp","https:\u002F\u002Feliovp.com\u002Fa-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b\u002F",[777,778,779,782,1201,1202,1035,783,1091,779,815],{"path":1213,"title":1214,"description":1215,"date":1216,"slug":1217,"image":1218,"originalUrl":1219,"categories":1220},"\u002Fblog\u002Fai-model-optimization-with-paiton","AI-modeloptimalisatie met Paiton","In de snel evoluerende wereld van artificiële intelligentie zijn efficiënte modellen en sterke prestaties cruciaal. Met Paiton biedt ElioVP doorgedreven optimalisatie voor AI-modellen. Door de modelarchitectuur te compileren en onze eigen kernels te gebruiken, maakt Paiton snellere inferentie en een lager resourcegebruik op AMD GPU's mogelijk.","2025-01-30T19:53:25","ai-model-optimization-with-paiton","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost1.webp","https:\u002F\u002Feliovp.com\u002Fai-model-optimization-with-paiton\u002F",[777,778,779,782,1202,1035,783,1091,779,815],1788530429893]