[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"reazon-offering-angebot-leistungen":3,"reazon-offering-angebot-zielgruppen":20,"reazon-angebot-subnav":21,"reazon-mainnav":22,"reazon-page-\u002Fde\u002Fbare-metal":32,"reazon-footernav":198,"reazon-articles-\u002Fde\u002Fwissen":214},[4,8,12,16],{"title":5,"href":6,"description":7},"DGX Spark mieten","\u002Fde\u002Fdgx-spark","Der NVIDIA-AI-Supercomputer für den Schreibtisch — on-demand aus der Schweiz, bare metal oder gemanagt.",{"title":9,"href":10,"description":11},"Bare Metal GPU","\u002Fde\u002Fbare-metal","DGX Spark & H100 als dedizierte Maschine — volle Kontrolle, Root-Zugriff, Schweizer Rechenzentrum.",{"title":13,"href":14,"description":15},"Managed Inference","\u002Fde\u002Fmanaged-inference","LLM-Endpoints via vLLM — von uns betrieben, ohne Ops-Aufwand, mit Schweizer Datenhoheit.",{"title":17,"href":18,"description":19},"Hermes Agents","\u002Fde\u002Fagents","Agentische Workloads gemanagt — Hermes-Agents auf souveräner Hardware, von uns betrieben.",[],[],[23,26,29],{"title":24,"href":25},"Preise","\u002Fde\u002Fpreise",{"title":27,"href":28},"Wissen","\u002Fde\u002Fwissen",{"title":30,"href":31},"Über Twentyone","\u002Fde\u002Fueber-uns",{"data":33},{"id":34,"path":10,"slug":35,"published_at":36,"page_type":37,"no_index":40,"fields":41,"blocks":45},675,"bare-metal","2026-06-19T09:21:41.623Z",{"identifier":38,"name":39},"service","Service-Hub",false,{"title":42,"summary":11,"meta_title":43,"meta_description":44},"Bare Metal GPU mit Root-Zugriff","Bare Metal GPU mieten mit Root-Zugriff — DGX Spark & H100 | Twentyone","Dedizierte GPU-Hardware mit vollem Root-Zugriff aus einem Schweizer Rechenzentrum. DGX Spark und H100 ohne Abstraktionsschicht — Kosten, wann sinnvoll, Vergleich.",[46,73,87,99,111,123,135,155,182],{"id":47,"position":48,"content_type":49,"fields":52},8087,1,{"identifier":50,"name":51},"cluster_grid","Themen-Grid",{"headline":53,"subnav_label":54,"subnav_anchor":55,"items":56},"Bare Metal, kurz erklärt","Überblick","ueberblick",[57,61,65,69],{"title":58,"description":59,"description_html":60},"Voller Root-Zugriff","Du bekommst die Maschine, nicht eine Abstraktion davon. Eigene Treiber, eigener Kernel, eigene Modelle.","\u003Cp>Du bekommst die Maschine, nicht eine Abstraktion davon. Eigene Treiber, eigener Kernel, eigene Modelle.\u003C\u002Fp>\n",{"description":62,"description_html":63,"title":64},"DGX Spark oder H100, exklusiv für dich. Keine geteilte GPU, keine laute Nachbarschaft auf der Karte.","\u003Cp>DGX Spark oder H100, exklusiv für dich. Keine geteilte GPU, keine laute Nachbarschaft auf der Karte.\u003C\u002Fp>\n","Dedizierte Hardware",{"title":66,"description":67,"description_html":68},"Kein Hypervisor dazwischen","Die Leistung landet bei dir, nicht in einer Virtualisierungsschicht. Bare metal heisst bare metal.","\u003Cp>Die Leistung landet bei dir, nicht in einer Virtualisierungsschicht. Bare metal heisst bare metal.\u003C\u002Fp>\n",{"title":70,"description":71,"description_html":72},"Schweizer Rechenzentrum","Physisch in der Schweiz. Du weisst, wo deine Daten liegen, und unter welcher Rechtsordnung.","\u003Cp>Physisch in der Schweiz. Du weisst, wo deine Daten liegen, und unter welcher Rechtsordnung.\u003C\u002Fp>\n",{"id":74,"position":75,"content_type":76,"fields":79},8088,2,{"identifier":77,"name":78},"big5_section","TAYA-Sektion",{"pillar":80,"eyebrow":81,"headline":82,"subnav_label":83,"subnav_anchor":84,"body":85,"body_html":86},"cost","Was kostet das?","Was Bare Metal kostet","Kosten","kosten","Du buchst die Maschine monatsweise und gibst sie wieder frei, wenn dein Projekt durch ist. Keine Anschaffung, keine Abschreibung, keine Hardware, die im Schrank altert.\n\nDie Monatspauschale hängt von der Maschine ab: DGX Spark ist günstiger als eine H100. Die aktuellen Ansätze stehen auf der [Preisseite](\u002Fde\u002Fpreise).\n\nJe länger du planst, desto günstiger wird der Monat. Sag uns die Laufzeit, dann rechnen wir es dir vor.","\u003Cp>Du buchst die Maschine monatsweise und gibst sie wieder frei, wenn dein Projekt durch ist. Keine Anschaffung, keine Abschreibung, keine Hardware, die im Schrank altert.\u003C\u002Fp>\n\n\u003Cp>Die Monatspauschale hängt von der Maschine ab: DGX Spark ist günstiger als eine H100. Die aktuellen Ansätze stehen auf der \u003Ca href=\"\u002Fde\u002Fpreise\">Preisseite\u003C\u002Fa>.\u003C\u002Fp>\n\n\u003Cp>Je länger du planst, desto günstiger wird der Monat. Sag uns die Laufzeit, dann rechnen wir es dir vor.\u003C\u002Fp>\n",{"id":88,"position":89,"content_type":90,"fields":91},8089,3,{"identifier":77,"name":78},{"pillar":92,"eyebrow":93,"headline":94,"subnav_label":95,"subnav_anchor":96,"body":97,"body_html":98},"problems","Passt das zu mir?","Wann Bare Metal die richtige Wahl ist","Wann sinnvoll","wann-sinnvoll","Bare metal ist richtig, wenn du Kontrolle brauchst: eigene CUDA-Version, eigene Treiber, ein Modell, das du nicht durch eine fremde API schicken willst, oder Daten, die das Haus nicht verlassen dürfen.\n\nEs ist die falsche Wahl, wenn du eigentlich nur einen laufenden Endpoint willst. Dann nimmst du dir mit Root nur Arbeit ans Bein, die du nicht brauchst. Dafür gibt es [Managed Inference](\u002Fde\u002Fmanaged-inference).\n\nFaustregel: Bare metal, wenn der Stack das Produkt ist. Gemanagt, wenn das Modell nur ein Baustein ist.","\u003Cp>Bare metal ist richtig, wenn du Kontrolle brauchst: eigene CUDA-Version, eigene Treiber, ein Modell, das du nicht durch eine fremde API schicken willst, oder Daten, die das Haus nicht verlassen dürfen.\u003C\u002Fp>\n\n\u003Cp>Es ist die falsche Wahl, wenn du eigentlich nur einen laufenden Endpoint willst. Dann nimmst du dir mit Root nur Arbeit ans Bein, die du nicht brauchst. Dafür gibt es \u003Ca href=\"\u002Fde\u002Fmanaged-inference\">Managed Inference\u003C\u002Fa>.\u003C\u002Fp>\n\n\u003Cp>Faustregel: Bare metal, wenn der Stack das Produkt ist. Gemanagt, wenn das Modell nur ein Baustein ist.\u003C\u002Fp>\n",{"id":100,"position":101,"content_type":102,"fields":103},8090,4,{"identifier":77,"name":78},{"pillar":104,"eyebrow":105,"headline":106,"subnav_label":107,"subnav_anchor":108,"body":109,"body_html":110},"comparisons","Wie unterscheidet sich das?","Bare Metal, VM oder Hyperscaler","Vergleich","vergleich","**Bare metal** gibt dir die ganze Maschine. Volle Leistung, voller Zugriff, nichts dazwischen.\n\n**Virtuelle GPU-Instanz** teilt die Karte und legt einen Hypervisor dazwischen. Bequem, aber du gibst Leistung und Kontrolle ab.\n\n**Hyperscaler** bietet beides, aber die Daten liegen ausserhalb der Schweiz und die Rechnung schwankt mit dem Traffic. Bei uns ist die Maschine dediziert, steht in der Schweiz, und der Preis steht vorher fest.","\u003Cp>\u003Cstrong>Bare metal\u003C\u002Fstrong> gibt dir die ganze Maschine. Volle Leistung, voller Zugriff, nichts dazwischen.\u003C\u002Fp>\n\n\u003Cp>\u003Cstrong>Virtuelle GPU-Instanz\u003C\u002Fstrong> teilt die Karte und legt einen Hypervisor dazwischen. Bequem, aber du gibst Leistung und Kontrolle ab.\u003C\u002Fp>\n\n\u003Cp>\u003Cstrong>Hyperscaler\u003C\u002Fstrong> bietet beides, aber die Daten liegen ausserhalb der Schweiz und die Rechnung schwankt mit dem Traffic. Bei uns ist die Maschine dediziert, steht in der Schweiz, und der Preis steht vorher fest.\u003C\u002Fp>\n",{"id":112,"position":113,"content_type":114,"fields":115},8091,5,{"identifier":77,"name":78},{"pillar":116,"eyebrow":117,"headline":118,"subnav_label":119,"subnav_anchor":120,"body":121,"body_html":122},"reviews","Habt ihr Beispiele?","Derselbe Stack, den wir selbst fahren","Beispiele","beispiele","Unsere eigenen Produkte und Agents laufen auf genau dieser Hardware. Wir kennen die Stolpersteine beim Treiber-Setup, beim Speicher-Management grosser Modelle und beim Dauerbetrieb, weil wir sie selbst getroffen haben.\n\nGenau dieses Wissen steckt im Setup, das du bei uns mietest, nicht in einem Datenblatt.","\u003Cp>Unsere eigenen Produkte und Agents laufen auf genau dieser Hardware. Wir kennen die Stolpersteine beim Treiber-Setup, beim Speicher-Management grosser Modelle und beim Dauerbetrieb, weil wir sie selbst getroffen haben.\u003C\u002Fp>\n\n\u003Cp>Genau dieses Wissen steckt im Setup, das du bei uns mietest, nicht in einem Datenblatt.\u003C\u002Fp>\n",{"id":124,"position":125,"content_type":126,"fields":127},8092,6,{"identifier":77,"name":78},{"pillar":128,"eyebrow":129,"headline":130,"subnav_label":131,"subnav_anchor":132,"body":133,"body_html":134},"bestof","Was empfehlt ihr?","So richtest du Bare Metal sinnvoll ein","Empfehlung","empfehlung","Starte mit der kleinsten Maschine, die dein Modell trägt. DGX Spark für Inferenz und Entwicklung, H100 erst, wenn Durchsatz oder Training es verlangen.\n\nLeg von Anfang an Backups und ein sauberes Image deiner Umgebung an. Bare metal heisst auch: Du bist für den Zustand der Maschine verantwortlich. Wenn du das nicht willst, übernehmen wir den Betrieb und du bleibst trotzdem souverän.","\u003Cp>Starte mit der kleinsten Maschine, die dein Modell trägt. DGX Spark für Inferenz und Entwicklung, H100 erst, wenn Durchsatz oder Training es verlangen.\u003C\u002Fp>\n\n\u003Cp>Leg von Anfang an Backups und ein sauberes Image deiner Umgebung an. Bare metal heisst auch: Du bist für den Zustand der Maschine verantwortlich. Wenn du das nicht willst, übernehmen wir den Betrieb und du bleibst trotzdem souverän.\u003C\u002Fp>\n",{"id":136,"position":137,"content_type":138,"fields":141},8093,7,{"identifier":139,"name":140},"pricing_teaser","Preis-Teaser",{"eyebrow":24,"headline":142,"body":143,"body_html":144,"cta":145},"Monatspauschale, pro Maschine","Die Monatspauschale hängt davon ab, ob du eine DGX Spark oder eine H100 nimmst. Beides offen auf der Preisseite, kein „Preis auf Anfrage“.","\u003Cp>Die Monatspauschale hängt davon ab, ob du eine DGX Spark oder eine H100 nimmst. Beides offen auf der Preisseite, kein „Preis auf Anfrage“.\u003C\u002Fp>\n",{"type":146,"label":147,"target":148,"page":149,"url":25},"internal","Preise ansehen",null,{"id":150,"slug":151,"path":25,"page_type":152,"published":153,"type":154},678,"preise","page",true,"Cms::Page",{"id":156,"position":157,"content_type":158,"fields":161},8094,8,{"identifier":159,"name":160},"faq_list","FAQ-Liste",{"headline":162,"subnav_label":163,"subnav_anchor":164,"items":165},"Häufige Fragen zu Bare Metal","FAQs","faqs",[166,170,174,178],{"question":167,"answer":168,"answer_html":169},"Habe ich wirklich Root?","Ja. Die Maschine gehört für die Mietdauer dir. Du installierst Treiber, Kernel-Module und Software, wie du willst.","\u003Cp>Ja. Die Maschine gehört für die Mietdauer dir. Du installierst Treiber, Kernel-Module und Software, wie du willst.\u003C\u002Fp>\n",{"question":171,"answer":172,"answer_html":173},"Welche GPUs gibt es?","DGX Spark (GB10, 128 GB) und H100. Welche passt, hängt davon ab, ob du Inferenz oder Training fährst.","\u003Cp>DGX Spark (GB10, 128 GB) und H100. Welche passt, hängt davon ab, ob du Inferenz oder Training fährst.\u003C\u002Fp>\n",{"question":175,"answer":176,"answer_html":177},"Könnt ihr den Betrieb übernehmen?","Ja. Wenn du die Kontrolle, aber nicht die Betriebsarbeit willst, betreiben wir die Maschine für dich. Siehe [Managed Inference](\u002Fde\u002Fmanaged-inference).","\u003Cp>Ja. Wenn du die Kontrolle, aber nicht die Betriebsarbeit willst, betreiben wir die Maschine für dich. Siehe \u003Ca href=\"\u002Fde\u002Fmanaged-inference\">Managed Inference\u003C\u002Fa>.\u003C\u002Fp>\n",{"question":179,"answer":180,"answer_html":181},"Was passiert mit meinen Daten nach der Miete?","Die Maschine wird vor der nächsten Vergabe sauber zurückgesetzt. Deine Daten löschst du selbst oder wir tun es nachweislich.","\u003Cp>Die Maschine wird vor der nächsten Vergabe sauber zurückgesetzt. Deine Daten löschst du selbst oder wir tun es nachweislich.\u003C\u002Fp>\n",{"id":183,"position":184,"content_type":185,"fields":188},8095,9,{"identifier":186,"name":187},"cta","CTA Block",{"headline":189,"subline":190,"cta":191,"mode":197},"Maschine mit Root, aus der Schweiz","Sag uns, was du fahren willst, und für wie lange. Wir nennen dir Maschine und Preis.",{"type":146,"label":192,"target":148,"page":193,"url":196},"Kontakt aufnehmen",{"id":194,"slug":195,"path":196,"page_type":152,"published":153,"type":154},682,"kontakt","\u002Fde\u002Fkontakt","dark",[199,206],{"title":200,"links":201},"Leistungen",[202,203,204,205],{"title":5,"href":6},{"title":9,"href":10},{"title":13,"href":14},{"title":17,"href":18},{"title":207,"links":208},"Unternehmen",[209,210,211,212],{"title":30,"href":31},{"title":27,"href":28},{"title":24,"href":25},{"title":213,"href":196},"Kontakt",[215,224,233,242,249,256,263,270,276,282,288,295,301,307,313,319,325,332],{"path":216,"slug":217,"title":218,"summary":219,"image":148,"publication_date":220,"big5_category":104,"hubs":221},"\u002Fde\u002Fwissen\u002Fazure-openai-bedrock-alternative-schweiz","azure-openai-bedrock-alternative-schweiz","Souveräne Inferenz gegen Azure OpenAI und AWS Bedrock: was sich im Alltag ändert","Azure OpenAI und AWS Bedrock gegen einen souverän betriebenen Endpoint: warum der Schweizer Serverstandort der Hyperscaler das Kernproblem nicht löst und was der Unterschied im Betrieb bedeutet.","2026-07-13T00:00:00Z",[222],{"slug":223,"title":13},"managed-inference",{"path":225,"slug":226,"title":227,"summary":228,"image":148,"publication_date":220,"big5_category":128,"hubs":229},"\u002Fde\u002Fwissen\u002Fbeste-gpu-llm-inferenz","beste-gpu-llm-inferenz","Die beste GPU für LLM-Inferenz: DGX Spark, H100, L40S und RTX im Vergleich","Welche GPU für eigene Inferenz? DGX Spark, H100, L40S und RTX 4090 nach dem, was zählt: wie viel Modell hineinpasst, wie viel Durchsatz herauskommt und was der Monat kostet.",[230,231],{"slug":35,"title":42},{"slug":232,"title":5},"dgx-spark",{"path":234,"slug":235,"title":236,"summary":237,"image":148,"publication_date":220,"big5_category":116,"hubs":238},"\u002Fde\u002Fwissen\u002Fhermes-agent-erfahrungsbericht","hermes-agent-erfahrungsbericht","Hermes-Agent im Realbetrieb: was ein souveräner Agent wirklich leistet","Ein Erfahrungsbericht statt Hochglanzprospekt: wie sich ein souverän betriebener Hermes-Agent im täglichen Einsatz verhält, wo er glänzt und wo die Begleitung anfängt.",[239],{"slug":240,"title":241},"agents","Hermes Agents as a Service",{"path":243,"slug":244,"title":245,"summary":246,"image":148,"publication_date":220,"big5_category":92,"hubs":247},"\u002Fde\u002Fwissen\u002Fki-regulierte-daten-schweiz","ki-regulierte-daten-schweiz","KI mit regulierten Daten: LLMs nutzen, ohne dass die Daten die Schweiz verlassen","Für Branchen, in denen Daten das Land nicht verlassen dürfen: was revDSG, Berufsgeheimnis und der CLOUD Act für KI-Projekte bedeuten, und wie souveräne Inferenz den Rahmen einhält.",[248],{"slug":223,"title":13},{"path":250,"slug":251,"title":252,"summary":253,"image":148,"publication_date":220,"big5_category":80,"hubs":254},"\u002Fde\u002Fwissen\u002Fopenai-api-kosten-vs-eigener-endpoint","openai-api-kosten-vs-eigener-endpoint","Ab welchem Volumen sich ein eigener Endpoint gegen die API rechnet","Die Pay-per-Token-API ist günstig, bis sie es nicht mehr ist. Wo genau der Break-even zu einem reservierten Endpoint mit fester Monatspauschale liegt, an einem konkreten Beispiel durchgerechnet.",[255],{"slug":223,"title":13},{"path":257,"slug":258,"title":259,"summary":260,"image":148,"publication_date":261,"big5_category":104,"hubs":262},"\u002Fde\u002Fwissen\u002Ffine-tuning-rag-prompt","fine-tuning-rag-prompt","Fine-Tuning, RAG oder besserer Prompt? Die klare Entscheidungsregel","Fine-Tuning ist meistens nicht die Antwort auf „das Modell kennt unsere Daten nicht“. Wann Prompting, RAG oder Fine-Tuning wirklich das richtige Werkzeug sind und wie du die Eskalationsleiter korrekt durchläufst.","2026-07-07T00:00:00Z",[],{"path":264,"slug":265,"title":266,"summary":267,"image":148,"publication_date":261,"big5_category":268,"hubs":269},"\u002Fde\u002Fwissen\u002Fopenai-api-migration","openai-api-migration","Von der OpenAI-API zu souveräner Inferenz: die Migration in der Praxis","Der Umstieg von OpenAI oder Anthropic auf ein selbst betriebenes offenes Modell in der Schweiz sieht dank OpenAI-kompatibler Endpoints nach einer Ein-Zeilen-Änderung aus, ist aber doch mehr. Wo Prompts, Tool-Calling und Feature-Lücken zur Stolperfalle werden.","how-to",[],{"path":271,"slug":272,"title":273,"summary":274,"image":148,"publication_date":261,"big5_category":92,"hubs":275},"\u002Fde\u002Fwissen\u002Fquantisierung-int4-int8-awq-gptq-gguf","quantisierung-int4-int8-awq-gptq-gguf","Quantisierung ohne Qualitätsverlust: int4, int8, AWQ, GPTQ, GGUF entzaubert","int8 ist fast immer verlustfrei, int4 meistens auch, aber nicht bei Reasoning, Code und langen Agenten-Ketten. Wir zeigen dir ungeschönt, was Quantisierung wirklich kostet und wo GPTQ, AWQ, GGUF und bitsandbytes hingehören.",[],{"path":277,"slug":278,"title":279,"summary":280,"image":148,"publication_date":261,"big5_category":92,"hubs":281},"\u002Fde\u002Fwissen\u002Frag-schlechte-antworten","rag-schlechte-antworten","RAG richtig gebaut: warum eure Wissensbasis schlechte Antworten gibt","Die meisten RAG-Systeme scheitern nicht am Sprachmodell, sondern am Retrieval davor. Wir zeigen die häufigsten Fehlerquellen bei Chunking, Embeddings und Retrieval-Strategie sowie, wie du Retrieval- und Generationsfehler sauber auseinanderhältst.",[],{"path":283,"slug":284,"title":285,"summary":286,"image":148,"publication_date":261,"big5_category":268,"hubs":287},"\u002Fde\u002Fwissen\u002Fvram-modell-gpu-berechnen","vram-modell-gpu-berechnen","Welches Modell passt auf welche GPU? VRAM richtig berechnen","Bevor du GPUs kaufst oder mietest: die Faustformel für Gewichte, KV-Cache und Overhead, damit du weisst, welches Modell wirklich auf deine Hardware passt.",[],{"path":289,"slug":290,"title":291,"summary":292,"image":148,"publication_date":293,"big5_category":92,"hubs":294},"\u002Fde\u002Fwissen\u002Fagent-oder-endpoint","agent-oder-endpoint","Braucht ihr wirklich einen Agent oder reicht ein Endpoint?","Agenten sind im Trend, aber oft die teurere und fragilere Lösung für ein Problem, das ein einfacher Endpoint löst. Wann sich der Aufwand lohnt und wann nicht.","2026-06-30T00:00:00Z",[],{"path":296,"slug":297,"title":298,"summary":299,"image":148,"publication_date":293,"big5_category":92,"hubs":300},"\u002Fde\u002Fwissen\u002Fdatenhoheit-was-bedeutet-das","datenhoheit-was-bedeutet-das","Was Datenhoheit konkret heisst und wo deine Prompts wirklich landen","Datenhoheit ist mehr als ein Hosting-Standort. Was rechtlich, technisch und vertraglich dahintersteckt, und welche Fragen du jedem AI-Anbieter stellen solltest.",[],{"path":302,"slug":303,"title":304,"summary":305,"image":148,"publication_date":293,"big5_category":116,"hubs":306},"\u002Fde\u002Fwissen\u002Fdgx-spark-erfahrungsbericht","dgx-spark-erfahrungsbericht","DGX Spark im Betrieb: was die Maschine nach drei Monaten wirklich kann","Kein Datenblatt, sondern ein Erfahrungsbericht. Wo die DGX Spark im täglichen Betrieb glänzt, wo ihre Grenzen liegen und für wen sich die Maschine lohnt.",[],{"path":308,"slug":309,"title":310,"summary":311,"image":148,"publication_date":293,"big5_category":268,"hubs":312},"\u002Fde\u002Fwissen\u002Fllm-endpoint-aufsetzen","llm-endpoint-aufsetzen","Eigenen LLM Endpoint aufsetzen: von der GPU zum ersten Token","Ein realistischer Weg vom blanken Server zum produktiven Inferenz-Endpoint. Die Schritte, die Reihenfolge und die Stolpersteine, die zwischen „läuft lokal“ und „läuft produktiv“ liegen.",[],{"path":314,"slug":315,"title":316,"summary":317,"image":148,"publication_date":293,"big5_category":128,"hubs":318},"\u002Fde\u002Fwissen\u002Foffene-modelle-auswahl","offene-modelle-auswahl","Welches offene Modell für welche Aufgabe? Llama, Qwen, Mistral & Co.","Nicht das grösste Modell gewinnt, sondern das passende. Wie du offene Modelle nach Aufgabe, Speicherbedarf und Lizenz auswählst, statt Benchmarks hinterherzulaufen.",[],{"path":320,"slug":321,"title":322,"summary":323,"image":148,"publication_date":293,"big5_category":104,"hubs":324},"\u002Fde\u002Fwissen\u002Fvllm-ollama-tgi-vergleich","vllm-ollama-tgi-vergleich","vLLM, Ollama oder TGI: welche Inference Engine für welchen Fall","Die Engine entscheidet über Durchsatz, Latenz und Betriebsaufwand. Ein nüchterner Vergleich der drei verbreitetsten Optionen, inklusive der Fälle, in denen die einfache Lösung gewinnt.",[],{"path":326,"slug":327,"title":328,"summary":329,"image":148,"publication_date":330,"big5_category":104,"hubs":331},"\u002Fde\u002Fwissen\u002Fdgx-spark-vs-cloud-gpu","dgx-spark-vs-cloud-gpu","DGX Spark gegen Cloud-GPU: wann sich eigene Hardware lohnt","Unified Memory gegen rohen Durchsatz, Schweizer Hardware gegen Hyperscaler. Ein nüchterner Vergleich, inklusive der Fälle, in denen die Cloud gewinnt.","2026-06-18T00:00:00Z",[],{"path":333,"slug":334,"title":335,"summary":336,"image":148,"publication_date":330,"big5_category":80,"hubs":337},"\u002Fde\u002Fwissen\u002Fllm-selbst-betreiben-kosten","llm-selbst-betreiben-kosten","Was kostet es, ein LLM selbst zu betreiben?","Die nüchterne Rechnung hinter eigenen LLM-Endpoints: Hardware, Betrieb und der Punkt, ab dem sich Selbermachen wirklich lohnt.",[]]