[{"data":1,"prerenderedAt":682},["ShallowReactive",2],{"blog-post-nl-\u002Fblog\u002Fthe-rise-of-open-source-ai-model-optimization":3,"blog-posts-sidebar-nl":256},{"id":4,"title":5,"body":6,"categories":236,"date":244,"description":245,"extension":246,"image":247,"meta":248,"navigation":249,"originalUrl":250,"path":251,"seo":252,"slug":253,"stem":254,"__hash__":255},"blogNl\u002Fblog\u002Fthe-rise-of-open-source-ai-model-optimization.md","De opkomst van open-source AI-modeloptimalisatie",{"type":7,"value":8,"toc":224},"minimark",[9,13,21,24,27,30,36,47,53,56,62,65,68,74,77,83,86,95,104,107,114,117,124,127,134,137,144,147,154,157,164,167,174,177,184,187,194,197,203,206,209,215,218,221],[10,11,12],"p",{},"In het snel evoluerende landschap van kunstmatige intelligentie (AI) zijn opensourceoplossingen belangrijke aanjagers van innovatie en betere prestaties. Deze door de gemeenschap gedragen platforms maken geavanceerde technologie breder toegankelijk, stimuleren samenwerking en versnellen de optimalisatie van AI-modellen.​",[14,15,17],"h3",{"id":16},"de-opensourcerevolutie-in-ai",[18,19,20],"strong",{},"De opensourcerevolutie in AI",[10,22,23],{},"Opensource-AI-modellen hebben de ontwikkeling en deployment van machinelearningtoepassingen veranderd. Met transparante, aanpasbare en vrij toegankelijke codebases kunnen ontwikkelaars en organisaties AI-oplossingen op hun specifieke behoeften afstemmen. Die flexibiliteit vermindert de afhankelijkheid van propriëtaire systemen en stimuleert tegelijk een cultuur van gedeelde kennis en voortdurende verbetering.​",[10,25,26],{},"Een opmerkelijk voorbeeld is DeepSeek-R1, een opensourcemodel van het Chinese AI-bedrijf DeepSeek. Hoewel het met aanzienlijk minder middelen werd ontwikkeld dan vergelijkbare modellen, behaalt DeepSeek-R1 op verschillende benchmarks resultaten die vergelijkbaar zijn met die van marktleiders zoals OpenAI. Dit illustreert de kracht van ‘zuinige innovatie’, waarbij beperkte middelen creatieve oplossingen en efficiënte modeloptimalisatie stimuleren. ​",[10,28,29],{},"Meer recentelijk hebben de Claude 3-familie van Anthropic en de Llama 3-modellen van Meta aangetoond dat open en gedeeltelijk open modellen prestaties kunnen leveren die vergelijkbaar zijn met of zelfs beter zijn dan closed-source-oplossingen, waardoor het idee wordt uitgedaagd dat AI-ontwikkeling enorme eigen middelen vereist.​",[14,31,33],{"id":32},"paiton-baanbrekende-ai-optimalisatiesoftware",[18,34,35],{},"Paiton: baanbrekende AI-optimalisatiesoftware",[10,37,38,39,46],{},"In deze dynamische omgeving onderscheidt ",[40,41,45],"a",{"href":42,"rel":43},"https:\u002F\u002Feliovp.com\u002Fa-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b\u002F",[44],"nofollow","onze Paiton-tool"," zich als toonaangevende software voor optimalisatie van AI-modellen. Ontworpen om de prestaties van AI-modellen te verbeteren, heeft Paiton consequent verbeteringen geleverd variërend van 15% tot 30% op AMD Instinct Accelerators zoals de MI3**-serie, waarbij de prestaties van gelijkwaardige Nvidia-hardware vaak worden overtroffen. Door gebruik te maken van geavanceerde optimalisatietechnieken stelt Paiton organisaties in staat de efficiëntie en effectiviteit van hun AI-implementaties te maximaliseren.​",[14,48,50],{"id":49},"baanbrekende-hardwareverbeteringen-vanaf-gtc-2025",[18,51,52],{},"Baanbrekende hardwareverbeteringen vanaf GTC 2025",[10,54,55],{},"De recente NVIDIA GTC 2025-conferentie heeft verschillende baanbrekende ontwikkelingen op het gebied van AI-hardwareoptimalisatie onthuld die het industriële landschap opnieuw vormgeven:​",[14,57,59],{"id":58},"nvidias-revolutionaire-rubin-ai-chip",[18,60,61],{},"NVIDIA's revolutionaire Rubin AI-chip",[10,63,64],{},"NVIDIA heeft zojuist zijn volgende generatie AI-versneller, de Rubin-chip, onthuld op GTC 2025. Voortbouwend op het succes van de Blackwell-architectuur vertegenwoordigt Rubin een enorme sprong voorwaarts in de verwerkingsmogelijkheden van AI. Volgens NVIDIA CEO Jensen Huang levert de Rubin-chip tot 3x betere prestaties per watt vergeleken met de vorige generatie B200 Blackwell GPU, met gespecialiseerde circuits voor het versnellen van transformatorarchitecturen en multimodale AI-workloads. ​",[10,66,67],{},"Het Rubin-platform introduceert een nieuwe geheugenarchitectuur die knelpunten in de gegevensbeweging met 60% vermindert, waarmee een van de belangrijkste efficiëntiebeperkingen in de huidige AI-systemen wordt aangepakt. Deze vooruitgang is met name relevant voor op optimalisatie gerichte oplossingen zoals Paiton, omdat het nieuwe wegen opent voor hardwarebewuste modelafstemming die deze architecturale innovaties kan benutten.",[14,69,71],{"id":70},"arm-gebaseerde-ai-versnelling",[18,72,73],{},"ARM-gebaseerde AI-versnelling",[10,75,76],{},"Een andere belangrijke aankondiging van GTC 2025 was NVIDIA's uitgebreide samenwerking met ARM om gespecialiseerde AI-kernen voor edge-apparaten te ontwikkelen. Deze samenwerking heeft tot doel AI-mogelijkheden van serverklasse naar omgevingen met beperkt vermogen te brengen, waardoor efficiënte inferentie voor complexe modellen op smartphones, voertuigen en IoT-apparaten mogelijk worden. De nieuwe referentieontwerpen demonstreren een viervoudige verbetering van de energie-efficiëntie vergeleken met eerdere generaties, waardoor geavanceerde AI-toepassingen levensvatbaar worden in scenario's waarin stroom- en thermische beperkingen voorheen onbetaalbaar waren.",[14,78,80],{"id":79},"opkomende-trends-in-ai-modeloptimalisatie",[18,81,82],{},"Opkomende trends in AI-modeloptimalisatie",[10,84,85],{},"Het gebied van AI-modeloptimalisatie is getuige van verschillende belangrijke trends die het toekomstige traject vormgeven:​",[87,88,89],"ul",{},[90,91,92],"li",{},[18,93,94],{},"Tencents T1 Redeneringsmodel",[10,96,97,98,103],{},"In een belangrijke ontwikkeling voor open-source AI heeft de Chinese technologiegigant Tencent onlangs zijn ",[40,99,102],{"href":100,"rel":101},"https:\u002F\u002Ftencent.github.io\u002Fllm.hunyuan.T1\u002FREADME_EN.html",[44],"T1-redeneermodel"," uitgebracht, speciaal ontworpen om uit te blinken in complexe redeneringstaken. Volgens het onderzoeksteam van Tencent introduceert het T1-model een nieuwe architectuur die het redeneerproces scheidt van kennisrepresentatie, waardoor een efficiënter gebruik van parameters mogelijk is.​",[10,105,106],{},"Eerste benchmarks tonen dat T1 bij Chineestalige taken aanzienlijk beter presteert dan Meta's Llama-modellen, terwijl het voor inferentie 35% minder rekenkracht nodig heeft. Het model presteert ook uitstekend op meertalige redeneerbenchmarks, wat erop wijst dat de architecturale vernieuwingen in verschillende talen en domeinen goed werken.​",[10,108,109],{},[110,111],"img",{"alt":112,"src":113},"","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ftencent.png",[10,115,116],{},"Tencent heeft toegang tot de modelgewichten en optimalisatietechnieken geopend via hun GitHub-repository, waardoor waardevolle bronnen worden geboden waarop de open-sourcegemeenschap kan voortbouwen. Deze release vertegenwoordigt een belangrijke bijdrage aan het democratiseren van geavanceerde AI-mogelijkheden en laat zien hoe op optimalisatie gerichte benaderingen kunnen leiden tot modellen die zowel capabeler als efficiënter zijn.",[87,118,119],{},[90,120,121],{},[18,122,123],{},"Geavanceerde kwantiseringstechnieken",[10,125,126],{},"Recente doorbraken in kwantisering zorgen voor een revolutie in modeloptimalisatie. De Mistral-modellen van Google Gemma en Mistral AI hebben aangetoond dat agressieve kwantisering (naar 2, 3 of 4 bits) indrukwekkende prestaties kan behouden terwijl de geheugenvereisten dramatisch worden verminderd. De GPTQ- en AWQ-kwantiseringstechnieken zijn industriestandaarden geworden, waarbij onderzoek van MIT en Stanford een reductie van de geheugenvoetafdruk tot 55% aantoont, terwijl de inferentiesnelheid met 2-4x wordt verbeterd.",[87,128,129],{},[90,130,131],{},[18,132,133],{},"Schaarse mix van experts (MoE)-architectuur",[10,135,136],{},"De MoE-architectuur, zoals gebruikt in modellen als Mixtral 8x7B en Google's Gemini, is een krachtige manier om modelcapaciteiten op te schalen zonder de rekenvereisten evenredig te verhogen. Door voor elke input alleen de relevante ‘expert’-subnetwerken te activeren, kunnen MoE-modellen prestaties leveren die vergelijkbaar zijn met modellen die meerdere malen groter zijn. Recente benchmarks tonen 30 tot 40% betere prestaties per parameter dan bij dense architecturen.​",[87,138,139],{},[90,140,141],{},[18,142,143],{},"Agentic AI-systemen",[10,145,146],{},"Het ontwikkelen van AI-agenten die in staat zijn tot autonome besluitvorming en leren wordt steeds gangbaarder. Deze systemen kunnen zich aanpassen aan dynamische omgevingen en complexe taken uitvoeren met minimale menselijke tussenkomst. Microsoft’s AutoGen en het open-source LangChain-framework zijn standaardhulpmiddelen geworden voor het bouwen van deze agentsystemen, met recente verbeteringen in de redeneermogelijkheden via ReAct- en Tree-of-Thought-prompttechnieken.",[87,148,149],{},[90,150,151],{},[18,152,153],{},"Aangepaste silicium- en hardware-optimalisatie",[10,155,156],{},"Het ontwerp van gespecialiseerde hardware, zoals op maat gemaakte siliciumchips, verbetert de prestaties en efficiëntie van AI-modellen. Deze trend omvat de ontwikkeling van processors die zijn afgestemd op specifieke AI-workloads, waardoor het energieverbruik wordt verminderd en de verwerkingssnelheid wordt verbeterd. Naast de dominantie van Nvidia verleggen bedrijven als AMD met hun MI300X-accelerators en startups als Cerebras en Groq de grenzen van AI-specifieke hardware, waarbij laatstgenoemde ongekende tokengeneratiesnelheden laat zien van meer dan 1.000 tokens per seconde op grote taalmodellen.",[87,158,159],{},[90,160,161],{},[18,162,163],{},"Multimodale AI-integratie",[10,165,166],{},"Het integreren van meerdere datamodaliteiten, zoals tekst, afbeeldingen en audio, in één enkel model maakt uitgebreidere en contextbewuste AI-toepassingen mogelijk. Deze trend zorgt voor vooruitgang op gebieden als natuurlijke taalverwerking en computervisie. Recente multimodale modellen zoals Claude 3 Opus, GPT-4 Omni en Gemini Ultra hebben opmerkelijke capaciteiten getoond bij het begrijpen en genereren van inhoud op verschillende modaliteiten, waarbij de nieuwste benchmarks bijna menselijke prestaties laten zien bij complexe redeneringstaken waarbij visuele en tekstuele informatie worden gecombineerd.",[87,168,169],{},[90,170,171],{},[18,172,173],{},"Retrieval-Augmented Generation (RAG)",[10,175,176],{},"RAG is een cruciale techniek om de nauwkeurigheid van modellen te verbeteren en hallucinaties te beperken door tijdens de generatie feitelijke informatie uit externe kennisbanken op te halen. Opensourceframeworks zoals LlamaIndex en LangChain maken geavanceerde RAG-pipelines toegankelijk voor ontwikkelaars van elk ervaringsniveau. Recente innovaties omvatten hybride retrievalmethoden die dense en sparse embeddings combineren. Daarmee daalt de retrievallatency tot 40% en verbetert de relevantie.",[87,178,179],{},[90,180,181],{},[18,182,183],{},"Edge AI-optimalisatie",[10,185,186],{},"AI-algoritmen rechtstreeks op edge-apparaten uitvoeren, zoals smartphones en IoT-sensoren, maakt realtime gegevensverwerking en besluitvorming mogelijk zonder afhankelijkheid van centrale cloudservers. Dat verlaagt de latency en verbetert de privacy. TinyML-frameworks en modellen zoals Phi-3-mini, ontworpen voor efficiënte uitvoering op consumentenhardware, sturen deze trend. Recente benchmarks tonen dat geoptimaliseerde edgemodellen 85 tot 90% van de prestaties van hun grotere tegenhangers behalen met slechts een fractie van de rekenresources.",[87,188,189],{},[90,190,191],{},[18,192,193],{},"Continu leren en aanpassing",[10,195,196],{},"De verschuiving van statische naar voortdurend bijgewerkte modellen versnelt. Systemen die van nieuwe gegevens leren en zich aan veranderende omgevingen aanpassen zonder volledig opnieuw te worden getraind, worden essentieel voor praktische AI-deployments. Meta's recente onderzoek naar parameterefficiënte fine-tuningtechnieken zoals LoRA (Low-Rank Adaptation) en QLoRA heeft continue modelaanpassing aanzienlijk verbeterd. Daarvoor is soms slechts 5% nodig van de resources voor volledige retraining.",[14,198,200],{"id":199},"de-impact-van-open-source-ai-optimalisatie",[18,201,202],{},"De impact van open-source AI-optimalisatie",[10,204,205],{},"De brede beschikbaarheid van opensource-optimalisatietools en -modellen democratiseert de toegang tot geavanceerde AI-mogelijkheden. Organisaties van elke omvang kunnen deze middelen gebruiken om geavanceerde AI-toepassingen te ontwikkelen zonder grote investeringen in eigen technologie. Die toegankelijkheid stimuleert innovatie, versnelt ontwikkelingscycli en bevordert een samenwerkend ecosysteem waarin kennis en vooruitgang vrij worden gedeeld.",[10,207,208],{},"Recente brancherapporten van Gartner en Forrester geven aan dat organisaties die gebruik maken van open-source AI-optimalisatietools tot 40% lagere implementatiekosten en een 50% snellere time-to-market voor AI-applicaties ervaren. De levendige open-sourcegemeenschap rondom tools als de Transformers-bibliotheek van Hugging Face en de Triton-taal van OpenAI voor GPU-programmering heeft de innovatie versneld, waarbij technieken voor modeloptimalisatie zich in een ongekend tempo ontwikkelen.",[14,210,212],{"id":211},"conclusie",[18,213,214],{},"Conclusie",[10,216,217],{},"De opkomst van open-source AI-modeloptimalisatie betekent een transformatieve verschuiving in het AI-landschap. Door oplossingen als Paiton te omarmen, kunnen organisaties aanzienlijke prestatiewinst behalen, de kosten verlagen en bijdragen aan een levendige gemeenschap van innovatie. Nu rekenefficiëntie steeds belangrijker wordt voor het op grote schaal inzetten van geavanceerde AI-mogelijkheden, zullen tools die het hardwaregebruik maximaliseren een centrale rol spelen in de volgende golf van AI-transformatie.",[10,219,220],{},"Hardware-innovaties aangekondigd op GTC 2025, zoals de Rubin AI-chip van NVIDIA, naast softwareverbeteringen zoals het T1-redeneermodel van Tencent, laten zien dat een sector zich steeds meer richt op efficiëntie en optimalisatie als belangrijkste onderscheidende factoren. Dit sluit perfect aan bij de missie van Paiton om de AI-prestaties op verschillende hardwareplatforms te maximaliseren.",[10,222,223],{},"De toekomst van AI behoort niet alleen toe aan wie de grootste modellen bouwt, maar ook aan wie ze het efficiëntst kan uitvoeren. Naarmate opensource-optimalisatietechnieken zich verder ontwikkelen, worden AI-mogelijkheden breder toegankelijk. Dat maakt innovatie mogelijk in sectoren en toepassingen die voorheen door beperkte rekenresources werden afgeremd.",{"title":112,"searchDepth":225,"depth":225,"links":226},2,[227,229,230,231,232,233,234,235],{"id":16,"depth":228,"text":20},3,{"id":32,"depth":228,"text":35},{"id":49,"depth":228,"text":52},{"id":58,"depth":228,"text":61},{"id":70,"depth":228,"text":73},{"id":79,"depth":228,"text":82},{"id":199,"depth":228,"text":202},{"id":211,"depth":228,"text":214},[237,238,239,240,241,242,243],"Alle","Kunstmatige intelligentie","Trending","AI-nieuws","AMD","GPU","NVidia","2025-03-22T20:59:23","In het snel evoluerende AI-landschap zijn opensourceoplossingen belangrijke aanjagers van innovatie en betere prestaties. Deze door de gemeenschap gedragen platforms maken geavanceerde technologie breder toegankelijk, stimuleren samenwerking en versnellen de optimalisatie van AI-modellen.","md","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Friseofopensource.jpeg",{},true,"https:\u002F\u002Feliovp.com\u002Fthe-rise-of-open-source-ai-model-optimization\u002F","\u002Fblog\u002Fthe-rise-of-open-source-ai-model-optimization",{"title":5,"description":245},"the-rise-of-open-source-ai-model-optimization","blog\u002Fthe-rise-of-open-source-ai-model-optimization","NtGaFPzFZPYehRRdxqqqyBFsFlmFfrTMpOKq54bdxNs",[257,275,289,318,330,351,369,388,407,425,442,454,470,485,497,506,514,529,541,552,563,573,586,596,609,620,622,633,642,654,665,673],{"path":258,"title":259,"description":260,"date":261,"slug":262,"image":263,"originalUrl":264,"categories":265},"\u002Fblog\u002Fpaiton-qwen38-radeon-ai-pro-r9700","Paiton: 21% meer Qwen3.8-doorvoer op Radeon AI PRO R9700","Paiton draait AMD's Qwen3.8 27B op één Radeon AI PRO R9700 met 39,77 outputtokens per seconde. Dat levert 21% meer throughput en 17,4% lagere gemodelleerde kosten op.","2026-09-04T09:00:00","paiton-qwen38-radeon-ai-pro-r9700","\u002Fasset\u002Fimages\u002Fblog\u002Fpaiton-r9700\u002F00-featured-paiton-r9700.webp","https:\u002F\u002Feliovp.com\u002Fblog\u002Fpaiton-qwen38-radeon-ai-pro-r9700",[266,238,267,268,269,270,271,272,273,274],"Paiton","AMD Radeon","AI-inferentie","GPU-prestaties","Inferentielatentie","Inferentie-optimalisatie","Grote taalmodellen","vLLM","Kostenefficiëntie",{"path":276,"title":277,"description":278,"date":279,"slug":280,"image":281,"originalUrl":282,"categories":283},"\u002Fblog\u002Fai-data-center-power-requirements-gpu-per-megawatt","Stroomvereisten voor AI-datacenters: de GPU-per-MW-illusie","Waarom vermelden offertes voor AI-datacenters verschillende GPU-capaciteiten? Ontdek hoe PUE, piekbelasting, opslag, netwerken en koeling bepalen hoeveel compute werkelijk inzetbaar is.","2026-07-27T23:52:00","ai-data-center-power-requirements-gpu-per-megawatt","\u002Fasset\u002Fimages\u002Fblog\u002Fai-data-center-power-requirements-gpu-per-megawatt\u002Fgpu-per-megawatt-illusion.webp",null,[237,284,285,286,287,288],"AI-infrastructuur","Datacenters","ModFlex","HPC","AMD Helios",{"path":290,"title":291,"description":292,"date":293,"slug":294,"image":295,"originalUrl":296,"categories":297},"\u002Fblog\u002Fpaiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x","Paiton keert terug naar zijn diffusiewortels: optimalisatie van Wan2.2-T2V-A14B op AMD MI355X","Toen we begonnen met het bouwen van Paiton, was een van onze eerste aandachtsgebieden het optimaliseren van diffusiemodellen. Stable Diffusion XL was een van de eerste grote modellen waarin we lieten zien dat gefuseerde operators, efficiënte uitvoering en hardwarebewuste kernels een echt verschil konden maken. Nu keren we terug naar die oorsprong. Met de groeiende belangstelling voor het genereren van tekst-naar-video, ...","2026-06-10T14:04:04","paiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonwan2.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-returns-to-its-diffusion-roots-optimizing-wan2-2-t2v-a14b-on-amd-mi355x\u002F",[237,238,266,298,241,299,300,301,302,303,304,305,242,306,307,308,309,243,310,311,266,312,313,314,315,316,317],"14B","B200","Benchmarks","Blackwell","Compute","Diffusie","Eliovp","Generatieve AI","Hardware","Inferentie","Instinct","MI355x","On-premises","Optimalisatie","Soevereine AI","T2V","Tekst-naar-video","Tuning","Video-generatie","Wan2.2",{"path":319,"title":320,"description":321,"date":322,"slug":323,"image":324,"originalUrl":325,"categories":326},"\u002Fblog\u002Ffrom-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure","Van zolder tot voorpagina: ElioVP erkend als pionier op het gebied van chipoptimalisatie en datacenterinfrastructuur","Het waren bijzondere weken voor het team van Eliovp. Ons bedrijf haalde de voorpagina van De Tijd, de toonaangevende zakenkrant van België. Ons verhaal begon bij een oprichter die op zolder aan hardware sleutelde en groeide uit tot een onderneming met 215 miljoen euro omzet.","2026-02-10T20:48:12","from-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fphysicalnewspaper.webp","https:\u002F\u002Feliovp.com\u002Ffrom-the-attic-to-the-front-page-eliovp-recognized-as-a-pioneer-in-chip-optimization-data-center-infrastructure\u002F",[237,238,327,328,241,329,327,243],"Modulaire DC","Niet gecategoriseerd","De Tijd",{"path":331,"title":332,"description":333,"date":334,"slug":335,"image":336,"originalUrl":337,"categories":338},"\u002Fblog\u002Fprivacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit","Privacy is geen IT-probleem meer, het is een strategische prioriteit","Privacyrisico's, psychologische valkuilen en de operationele realiteit van generatieve AI in de Benelux. Waarom bedrijven gevoelige gegevens, governance en lokale AI strategisch moeten benaderen.","2026-01-29T13:51:11","privacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fheaderimage.webp","https:\u002F\u002Feliovp.com\u002Fprivacy-is-geen-it-probleem-meer-het-is-een-strategische-prioriteit\u002F",[237,238,239,328,339,340,341,342,343,344,345,346,304,347,305,348,349,350],"AI Act","Antropomorfisme","AVG","Benelux","ChatGPT","Cyberbeveiliging","Databeheer","Gegevensbeveiliging","GDPR","Microsoft Copilot","Privacy","Shadow AI",{"path":352,"title":353,"description":354,"date":355,"slug":356,"image":357,"originalUrl":358,"categories":359},"\u002Fblog\u002Fitsme-bij-ons-is-het-its-not-me-en-dit-is-waarom","Itsme? Bij ons is het “it's not me”, en dit is waarom.","Waarom Eliovp itsme niet gebruikt voor medewerkers en interne processen: een analyse van datasoevereiniteit, cloudjurisdictie, metadata, eigendomsstructuur en technische risico's.","2025-11-27T09:32:14","itsme-bij-ons-is-het-its-not-me-en-dit-is-waarom","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffrontimage.webp","https:\u002F\u002Feliovp.com\u002Fitsme-bij-ons-is-het-its-not-me-en-dit-is-waarom\u002F",[237,360,361,362,344,363,364,365,347,366,367,368,349],"AWS","Belgian Mobile ID","CLOUD Act","Datasoevereiniteit","Digitale identiteit","eIDAS","itsme","Liberty Global","MyGov.be",{"path":370,"title":371,"description":372,"date":373,"slug":374,"image":375,"originalUrl":376,"categories":377},"\u002Fblog\u002Ffield-report-the-reality-of-building-agentic-ai-in-2025","Praktijkrapport: de realiteit van Agentic AI bouwen in 2025","De verwachtingen rond Agentic AI staan vaak ver af van de technische realiteit. Dit praktijkrapport beschrijft wat er nodig is om betrouwbare, lokale AI-agents voor bedrijfsworkflows te bouwen, van modulaire architectuur en observability tot modeltraining, VRAM en soevereine infrastructuur.","2025-11-25T14:03:39","field-report-the-reality-of-building-agentic-ai-in-2025","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffieldreport.webp","https:\u002F\u002Feliovp.com\u002Ffield-report-the-reality-of-building-agentic-ai-in-2025\u002F",[237,238,378,239,379,380,381,382,383,384,385,386,312,387],"Oplossingen","Agentic AI","AI-techniek","AI-strategie","Autonome agenten","Bedrijfs-AI","Lokale LLM","Modelverfijning","AI op locatie","VRAM-optimalisatie",{"path":389,"title":390,"description":391,"date":392,"slug":393,"image":394,"originalUrl":395,"categories":396},"\u002Fblog\u002Fthe-synthetic-unicorn-bubble","De synthetische unicornzeepbel","Hoe AI-neocloudinfrastructuur circulaire kasstromen omzet in schijngroei. Tussen 2023 en 2025 stroomden miljarden aan durfkapitaal naar het neocloudecosysteem. Onze analyse onderzoekt hoe circulaire financiering, vaporware-infrastructuur en roofzuchtige contracten onderliggende activawaarden kunstmatig kunnen opbouwen.","2025-11-24T19:22:28","the-synthetic-unicorn-bubble","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fsyntheticunicorn.webp","https:\u002F\u002Feliovp.com\u002Fthe-synthetic-unicorn-bubble\u002F",[237,238,239,397,398,399,400,401,402,403,404,405,406],"AI Infrastructure","AI Neocloud","Circulaire financiering","GPU Cloud","Beleggingsrisico's","Opstartwaardering","Synthetische bubbel","Technische analyse","Vaporware","Durfkapitaal",{"path":408,"title":409,"description":410,"date":411,"slug":412,"image":413,"originalUrl":414,"categories":415},"\u002Fblog\u002Fbuilding-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power","De motor voor de AI-race bouwen: in vier maanden klaar voor NVIDIA GB300 NVL72","Bij AI-infrastructuur is snelheid een concurrentieel voordeel. Traditionele datacenterprojecten duren vaak 18 tot 24 maanden. Onze modulaire aanpak levert in vier maanden een operationele faciliteit die specifiek is ontworpen voor de NVIDIA GB300 NVL72.","2025-11-20T14:10:19","building-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fsuperpodmodflexfrontimage.webp","https:\u002F\u002Feliovp.com\u002Fbuilding-the-engine-for-the-ai-race-the-4-month-path-to-nvidia-gb300-nvl72-power\u002F",[237,327,328,416,284,417,418,419,420,421,422,423,424],"150 kW rek","DLC","Hoge dichtheid","Vloeistofkoeling","Modulair datacenter","NVIDIA Blackwell Ultra","NVIDIA GB300","NVL72","Snelle implementatie",{"path":426,"title":427,"description":428,"date":429,"slug":430,"image":431,"originalUrl":432,"categories":433},"\u002Fblog\u002Fwhy-cuda-translation-wont-unlock-amds-real-potential","Waarom de “CUDA”-vertaling het echte potentieel van AMD niet zal ontsluiten","Om de paar jaar verschijnt een oplossing met dezelfde belofte: behoud uw CUDA-code, wissel van toolchain en draai plots op verschillende GPU-platforms. Dat kan nuttig zijn voor compatibiliteit, maar ontsluit niet automatisch AMD's echte prestatiepotentieel. Daarvoor zijn AMD-first kernels, libraries en tuning nodig.","2025-11-12T14:48:37","why-cuda-translation-wont-unlock-amds-real-potential","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fchatgpt-image-nov-11-2025-09_16_10-pm-1.webp","https:\u002F\u002Feliovp.com\u002Fwhy-cuda-translation-wont-unlock-amds-real-potential\u002F",[237,238,266,328,434,238,435,436,437,438,439,440,266,441],"AMD MI300X","CUDA-vertaling","FP8","GPU-optimalisatie","Hoogwaardige computers","HIP","Kerneltuning","ROCm",{"path":443,"title":444,"description":445,"date":446,"slug":447,"image":448,"originalUrl":449,"categories":450},"\u002Fblog\u002Fpaiton-the-simplest-way-to-supercharge-ai-inference","Paiton: de eenvoudigste manier om AI-inferentie een boost te geven","Laten we eerlijk zijn: marketing is niet onze sterkste kant. We namen nooit extern kapitaal aan, verbrandden geen budget aan advertentiecampagnes en bouwden geen verkoopleger. We bouwen gewoon technologie die werkt. Paiton versnelt uw bestaande inferentiestack zonder migratie, nieuwe API's of modelconversie.","2025-11-11T10:31:22","paiton-the-simplest-way-to-supercharge-ai-inference","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaiton-powaaah.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-the-simplest-way-to-supercharge-ai-inference\u002F",[237,238,266,268,451,434,274,452,271,440,266,453,273],"AMD Instinct","Hoge throughput","SGLang",{"path":455,"title":456,"description":457,"date":458,"slug":459,"image":460,"originalUrl":461,"categories":462},"\u002Fblog\u002Fstop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens","Stop met te veel betalen: Paiton MI300X MoE verslaat H200\u002FB200 in kosten per 1 miljoen tokens","We benchmarkten Paiton's nieuwe MoE-ondersteuning met Qwen\u002FQwen3-30B-A3B-Instruct-2507 en vergeleken de inferentieprestaties van verschillende opstellingen. Elke configuratie draaide vijf keer per batchgrootte. We rapporteren het gemiddelde van die runs op basis van realistische conversationele workloads.","2025-09-26T13:36:18","stop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fhulkvshulkpaitonwins.webp","https:\u002F\u002Feliovp.com\u002Fstop-overpaying-paiton-mi300x-moe-beats-h200-b200-on-1m-tokens\u002F",[237,238,266,463,434,464,271,465,466,467,468,266,469],"AI-benchmarks","Kosten per token","Mixture of Experts","MoE","NVIDIA B200","NVIDIA H200","Qwen3",{"path":471,"title":472,"description":473,"date":474,"slug":475,"image":476,"originalUrl":477,"categories":478},"\u002Fblog\u002Fagentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en","Agentic AI, maar dan lokaal: van inbox naar inzicht en actie","We bouwen productieklare, local-first AI-agents die aansluiten op uw bestaande e-mailomgeving. Ze maken tickets aan, classificeren berichten, lezen documenten, herkennen facturen en offertes, analyseren beelden en sturen gestructureerde rapporten naar uw systemen, zonder verplichte afhankelijkheid van externe AI-API's.","2025-09-16T13:09:00","agentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ffrontfotoblog.webp","https:\u002F\u002Feliovp.com\u002Fagentic-ai-but-make-it-local-from-inbox-to-insight-to-action-en\u002F",[237,238,378,328,379,479,480,481,482,384,386,312,483,484],"Schadedetectie","Documentverwerking","E-mailautomatisering","Factuurextractie","Ticketautomatisering","Workflowautomatisering",{"path":486,"title":487,"description":488,"date":489,"slug":490,"image":491,"originalUrl":492,"categories":493},"\u002Fblog\u002Fmi300x-fp8-data-parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach","MI300X FP8 data-parallelle benchmarks (8 tot 64 GPU's): H200 achter zich, B200 binnen bereik","We schalen Llama-3.1-8B-Instruct-FP8-KV met Paiton op een gepartitioneerde AMD MI300X-server van 8 fysieke GPU's naar 64 virtuele GPU's. De resultaten tonen sterke multi-tenant throughput, veel lagere latency en een bijna gelijkspel met NVIDIA's B200.","2025-07-31T13:32:57","mi300x-fp8-data-parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fimage-2-1.webp","https:\u002F\u002Feliovp.com\u002Fmi300x-fp8-data%e2%80%91parallel-benchmarks-8-64-gpus-h200-left-behind-b200-within-reach\u002F",[237,238,266,328,494,241,299,495,496,309,243,266,273],"AI","H200","MI300X",{"path":498,"title":499,"description":500,"date":501,"slug":502,"image":503,"originalUrl":504,"categories":505},"\u002Fblog\u002Fapplicable-ai-for-businesses","Toepasbare AI voor bedrijven","Bij Eliovp blijven we innoveren om praktische oplossingen te bouwen. Een van onze grootste sterktes is het vermogen om buiten de gebaande paden te denken. Daarom ontwikkelen we toepasbare AI-oplossingen die dagelijks bruikbaar zijn en precies aansluiten op de behoeften van onze klanten.","2025-07-09T21:35:30","applicable-ai-for-businesses","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fscherm_afbeelding-2025-07-09-om-23.30.17.webp","https:\u002F\u002Feliovp.com\u002Fapplicable-ai-for-businesses\u002F",[237,238,378,379,479,480,481,482,384,386,312,483,484],{"path":507,"title":508,"description":509,"date":510,"slug":511,"image":112,"originalUrl":512,"categories":513},"\u002Fblog\u002Fintroducing-paitons-free-evaluation-models","Maak kennis met de gratis evaluatiemodellen van Paiton","AI verandert elke sector in hoog tempo, maar grote modellen efficiënt uitvoeren blijft een aanzienlijke technische en financiële uitdaging. ElioVP specialiseert zich in optimalisatie voor AMD-accelerators en helpt organisaties het volledige potentieel van hun hardware te benutten. Met onze gratis evaluatiemodellen kunt u de optimalisaties van Paiton vooraf op uw eigen workloads testen.","2025-07-07T11:26:13","introducing-paitons-free-evaluation-models","https:\u002F\u002Feliovp.com\u002Fintroducing-paitons-free-evaluation-models\u002F",[237,238,266],{"path":515,"title":516,"description":517,"date":518,"slug":519,"image":520,"originalUrl":521,"categories":522},"\u002Fblog\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b","Paiton: veel sneller opstarten en betere prestaties voor Llama-3.1-405B","Met Paiton streven we niet alleen naar maximale inferentiesnelheden. We verbeteren de volledige levenscyclus van de deployment van grote taalmodellen. Onze nieuwste test combineert AMD MI300X-GPU's met het omvangrijke Llama-3.1-405B-Instruct-FP8-KV-model en levert baanbrekende resultaten op voor zowel opstartsnelheid als runtimeprestaties.","2025-06-12T20:15:23","paiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fservingscreenshot.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-dramatically-faster-startup-and-performance-for-llama-3-1-405b\u002F",[237,238,266,328,268,434,523,436,524,525,526,266,527,528],"Koude start","Grafiekcompilatie","Llama 3.1 405B","LLM-optimalisatie","Opstartlatentie","Tensor-parallellisme",{"path":530,"title":531,"description":532,"date":533,"slug":534,"image":535,"originalUrl":536,"categories":537},"\u002Fblog\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x","Paiton FP8 verslaat NVIDIA's H200 op AMD's MI300X","AI evolueert razendsnel en efficiënte inferentie is essentieel om krachtige modellen in praktijksituaties in te zetten. Paiton levert nu sterkere FP8-inferentieprestaties op AMD MI300X-GPU's dan NVIDIA's H200, dankzij zorgvuldig geoptimaliseerde kernels.","2025-06-08T19:12:40","paiton-fp8-beats-nvidias-h200-on-amds-mi300x","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fblognewfp8.webp","https:\u002F\u002Feliovp.com\u002Fpaiton-fp8-beats-nvidias-h200-on-amds-mi300x\u002F",[237,238,266,328,434,538,383,305,269,270,272,525,539,540],"Koude startoptimalisatie","Model serving","vLLM-optimalisatie",{"path":542,"title":543,"description":544,"date":545,"slug":546,"image":547,"originalUrl":548,"categories":549},"\u002Fblog\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm","MI300X versus H200 versus RX 7900 XTX versus Tenstorrent n300s met vLLM","Nu grote taalmodellen een fundamenteel onderdeel worden van moderne toepassingen, is de juiste server voor deployment belangrijker dan ooit. We vergelijken AMD MI300X, NVIDIA H200, AMD RX 7900 XTX en Tenstorrent n300s met vLLM op throughput en kosten.","2025-05-09T14:03:58","mi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fcomparisontenstor.webp","https:\u002F\u002Feliovp.com\u002Fmi300x-vs-h200-vs-rx-7900-xtx-vs-tenstorrent-n300s-with-vllm\u002F",[237,238,266,378,328,241,496,243,550,551],"RX7900XTX","tenstorrent",{"path":553,"title":554,"description":555,"date":556,"slug":557,"image":558,"originalUrl":559,"categories":560},"\u002Fblog\u002Fclusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights","ClusterP&L: financiële inzichten voor investeerders in GPU-clusters","Eliovp ontwerpt, bouwt en optimaliseert al jaren GPU-clusters in heel Europa. Omdat klanten ons telkens opnieuw vroegen om een P&L-model voor hun investering, bundelden we onze praktijkkennis in ClusterP&L: een toegankelijke, voortdurend bijgewerkte tool voor financiële prognoses van GPU-infrastructuur.","2025-05-03T10:52:22","clusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fcomparisonscenarios.webp","https:\u002F\u002Feliovp.com\u002Fclusterpl-empowering-gpu-cluster-investors-with-real-world-financial-insights\u002F",[237,238,327,378,299,495,561,243,562],"MI325x","pnl-rekenmachine",{"path":564,"title":565,"description":566,"date":567,"slug":568,"image":569,"originalUrl":570,"categories":571},"\u002Fblog\u002Fcranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200","Snellere tokens voor minder geld: AMD MI300X tegenover NVIDIA H200","We vergelijken Qwen3-32B op een AMD MI300X, geoptimaliseerd met Paiton, met de NVIDIA H200. De resultaten tonen hoe Paiton vergelijkbare of betere prestaties kan leveren tegen lagere hardwarekosten en met aantrekkelijke kosten per miljoen tokens.","2025-05-02T21:10:30","cranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002F3ac59a73-2466-4422-b7e5-ef2e4a8ca58e.webp","https:\u002F\u002Feliovp.com\u002Fcranking-out-faster-tokens-for-fewer-dollars-amd-mi300x-vs-nvidia-h200\u002F",[237,238,266,494,241,495,572,243,266,273],"MI300",{"path":574,"title":575,"description":576,"date":577,"slug":578,"image":579,"originalUrl":580,"categories":581},"\u002Fblog\u002Fpower-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw","Waar vermogen en precisie samenkomen: modulair high-density datacenter voor NVIDIA NVL-deployments (1 tot 2 MW)","Eliovp ontwikkelt modulaire high-density infrastructuur voor AI-workloads van Blackwell-klasse. Het platform ondersteunt NVIDIA NVL-configuraties van NVL4 tot NVL72, van gedistribueerde edge-inferentie tot modeltraining op hyperscale, met 1 tot 2 MW IT-vermogen per module.","2025-05-02T14:09:59","power-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Feliovp_critical-1mw-pod_rev-2_transparent.webp","https:\u002F\u002Feliovp.com\u002Fpower-meets-precision-high-density-modular-data-center-for-nvidia-nvl-deployments-1-2-mw\u002F",[237,327,582,397,418,287,419,420,583,584,423,585],"1-2MW datacenter","NVIDIA Blackwell","NVIDIA NVL","Precisiekoeling",{"path":587,"title":588,"description":589,"date":590,"slug":591,"image":592,"originalUrl":593,"categories":594},"\u002Fblog\u002Fexamining-ai-agents-in-the-medical-field-ai-that-speaks-dicom","AI-agents in de medische wereld: AI die DICOM spreekt","Eliovp ontwikkelde een medische AI-agent die rechtstreeks met DICOM-servers in ziekenhuizen communiceert. De assistent kan patiënten en onderzoeken opzoeken, relevante beelden ophalen en medische beeldanalyse ondersteunen binnen de lokale ziekenhuisinfrastructuur.","2025-04-11T14:45:48","examining-ai-agents-in-the-medical-field-ai-that-speaks-dicom","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fhealthcareblog-1.webp","https:\u002F\u002Feliovp.com\u002Fexamining-ai-agents-in-the-medical-field-ai-that-speaks-dicom\u002F",[237,238,378,328,494,241,595],"Zorg",{"path":597,"title":598,"description":599,"date":600,"slug":601,"image":602,"originalUrl":603,"categories":604},"\u002Fblog\u002Feliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs","Eliovp BV: uw partner voor een veerkrachtige supply chain bij nieuwe Amerikaanse invoerheffingen","Het internationale handelslandschap verandert snel. Nieuwe Amerikaanse invoerheffingen zorgen voor onzekerheid, vooral bij bedrijven die afhankelijk zijn van high-performance computing en AI-infrastructuur. Eliovp helpt klanten hun supply chain veerkrachtig, betrouwbaar en kostenefficiënt te houden.","2025-04-04T10:01:27","eliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ftariffsshipping.webp","https:\u002F\u002Feliovp.com\u002Feliovp-bv-your-trusted-partner-for-supply-chain-resilience-amidst-new-u-s-tariffs\u002F",[237,239,494,241,605,606,607,608],"importeren","Taiwan","Tarieven","Trump",{"path":610,"title":611,"description":612,"date":613,"slug":614,"image":615,"originalUrl":616,"categories":617},"\u002Fblog\u002Fwhy-ai-agents-are-the-future","Waarom AI-agenten de toekomst zijn","AI-agenten integreren met uw bestaande ERP-, CRM- en marketingplatforms. Ze vullen uw huidige systemen aan, nemen intelligentere beslissingen en schalen mee met uw organisatie. Zo verlaagt u kosten, beperkt u fouten en maakt u medewerkers vrij voor werk met meer toegevoegde waarde.","2025-03-23T22:06:59","why-ai-agents-are-the-future","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ferp2.jpeg","https:\u002F\u002Feliovp.com\u002Fwhy-ai-agents-are-the-future\u002F",[237,238,378,494,618,619],"AI-agenten","ERP",{"path":251,"title":5,"description":245,"date":244,"slug":253,"image":247,"originalUrl":250,"categories":621},[237,238,239,240,241,242,243],{"path":623,"title":624,"description":625,"date":626,"slug":627,"image":628,"originalUrl":629,"categories":630},"\u002Fblog\u002Fintroducing-our-benchmarking-tool-powered-by-dstack","Maak kennis met onze benchmarktool, gebouwd op dstack","Betrouwbare benchmarks zijn essentieel om AI-modellen en software te optimaliseren. Onze nieuwe tool integreert met dstack en maakt geautomatiseerde, reproduceerbare en schaalbare benchmarkworkflows mogelijk, zowel op lokale GPU's als in de cloud.","2025-03-20T14:21:59","introducing-our-benchmarking-tool-powered-by-dstack","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fbenchmarktool.jpeg","https:\u002F\u002Feliovp.com\u002Fintroducing-our-benchmarking-tool-powered-by-dstack\u002F",[237,238,266,494,241,631,632,496,266],"benchmark","LLM",{"path":634,"title":635,"description":636,"date":637,"slug":638,"image":639,"originalUrl":640,"categories":641},"\u002Fblog\u002Foptimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200","QwQ-32B optimaliseren (door Qwen): AMD MI300X versus NVIDIA H200","De meeste LLM-benchmarks richten zich op afgeleiden van Llama of DeepSeek. Met QwQ-32B verbreden we die vergelijking en testen we hoe Paiton de AMD MI300X optimaliseert tegenover NVIDIA's H200, van throughput en concurrency tot TTFT en end-to-end-latency.","2025-03-19T21:41:44","optimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaiton4.jpeg","https:\u002F\u002Feliovp.com\u002Foptimizing-qwq-32b-by-qwen-amd-mi300x-vs-nvidia-h200\u002F",[237,238,266],{"path":643,"title":644,"description":645,"date":646,"slug":647,"image":648,"originalUrl":649,"categories":650},"\u002Fblog\u002Feliovp-featured-on-amd-tech-talk-podcast","Eliovp te gast in de AMD Tech Talk-podcast","Eliovp was onlangs te gast in de AMD Tech Talk-podcast. Onze CEO Elio Van Puyvelde sprak met Jim Greene over het ontstaan van Eliovp, de passie en expertise achter het bedrijf en de geïntegreerde oplossingen die we vandaag aanbieden.","2025-03-19T07:53:39","eliovp-featured-on-amd-tech-talk-podcast","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Ftechtalkjimgreene.jpeg","https:\u002F\u002Feliovp.com\u002Feliovp-featured-on-amd-tech-talk-podcast\u002F",[237,241,651,652,653],"Jim Greene","Podcast","Tech Talk",{"path":655,"title":656,"description":657,"date":658,"slug":659,"image":660,"originalUrl":661,"categories":662},"\u002Fblog\u002Ffurther-optimizing-amd-powered-inference-with-paiton","AMD-inferentie verder optimaliseren met Paiton","Paiton richt zich volledig op inferentieoptimalisatie voor AMD. Ons recentste werk levert voor DeepSeek R1 Distill Llama 8B een 10 tot 15% hogere throughput, een betere time-to-first-token en stabielere prestaties bij kleinere batchgroottes.","2025-03-13T06:18:30","further-optimizing-amd-powered-inference-with-paiton","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost3.webp","https:\u002F\u002Feliovp.com\u002Ffurther-optimizing-amd-powered-inference-with-paiton\u002F",[237,238,266,241,663,664,495,496,561,266,273],"Deepseek","H100",{"path":666,"title":667,"description":668,"date":669,"slug":670,"image":671,"originalUrl":42,"categories":672},"\u002Fblog\u002Fa-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b","Een eerste blik op Paiton in actie: Deepseek R1 Distill Llama 3.1 8B","Een eerste blik op hoe Paiton Deepseek R1 Distill Llama 3.1 8B optimaliseert voor de AMD MI300X. We vergelijken een met Paiton geoptimaliseerd model met de standaardversie en meten throughput, latency en end-to-end prestaties bij uiteenlopende batchgroottes.","2025-01-31T09:11:02","a-first-look-at-paiton-in-action-deepseek-r1-distill-llama-3-1-8b","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost2.webp",[237,238,266,241,663,664,495,496,561,266,273],{"path":674,"title":675,"description":676,"date":677,"slug":678,"image":679,"originalUrl":680,"categories":681},"\u002Fblog\u002Fai-model-optimization-with-paiton","AI-modeloptimalisatie met Paiton","In de snel evoluerende wereld van artificiële intelligentie zijn efficiënte modellen en sterke prestaties cruciaal. Met Paiton biedt ElioVP doorgedreven optimalisatie voor AI-modellen. Door de modelarchitectuur te compileren en onze eigen kernels te gebruiken, maakt Paiton snellere inferentie en een lager resourcegebruik op AMD GPU's mogelijk.","2025-01-30T19:53:25","ai-model-optimization-with-paiton","\u002Fasset\u002Fimages\u002Fblog\u002Fimported\u002Fpaitonpost1.webp","https:\u002F\u002Feliovp.com\u002Fai-model-optimization-with-paiton\u002F",[237,238,266,241,664,495,496,561,266,273],1788530430248]