[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"reazon-page-\u002Fde":3,"reazon-mainnav":155,"reazon-angebot-subnav":163,"reazon-offering-angebot-zielgruppen":164,"reazon-articles-\u002Fde\u002Fwissen":165,"reazon-footernav":292,"reazon-offering-angebot-leistungen":308},{"data":4},{"id":5,"path":6,"slug":7,"published_at":8,"page_type":9,"no_index":12,"fields":13,"blocks":17},673,"\u002Fde","de","2026-06-19T09:21:40.710Z",{"identifier":10,"name":11},"page","Page",false,{"title":14,"meta_description":15,"meta_title":16},"Twentyone — GPU-Hardware & Dev-Services","DGX Spark & GPU-Hardware mieten — bare metal mit Root-Zugriff, gemanagte LLM-Endpoints oder Hermes Agents as a Service. Schweizer Datenhoheit, für Entwickler gebaut.","Twentyone — GPU-Hardware & AI-Dev-Services aus der Schweiz",[18,47,89,100,114,139],{"id":19,"position":20,"content_type":21,"fields":24},8072,1,{"identifier":22,"name":23},"hero","Hero",{"headline":25,"subline":26,"links":27},"AI-Infrastruktur, die dir gehört.","Deine Daten in einer fremden Cloud, dein Modell hinter einer fremden API, deine Kosten schwer planbar. twentyone gibt dir GPU-Hardware aus der Schweiz: bare metal mit Root-Zugriff, gemanagte LLM-Endpoints oder fertige Agents. Du entscheidest, wie viel Betrieb du selbst übernimmst.",[28,40],{"link":29},{"type":30,"label":31,"target":32,"page":33,"url":36},"internal","DGX Spark mieten",null,{"id":34,"slug":35,"path":36,"page_type":37,"published":38,"type":39},674,"dgx-spark","\u002Fde\u002Fdgx-spark","service",true,"Cms::Page",{"link":41},{"type":30,"label":42,"target":32,"page":43,"url":46},"Preise ansehen",{"id":44,"slug":45,"path":46,"page_type":10,"published":38,"type":39},678,"preise","\u002Fde\u002Fpreise",{"id":48,"position":49,"content_type":50,"fields":53},8073,2,{"identifier":51,"name":52},"cluster_grid","Themen-Grid",{"headline":54,"items":55},"Drei Ebenen, eine Hardware-Basis",[56,61,71,80],{"title":31,"description":57,"description_html":58,"link":59},"Der NVIDIA-AI-Supercomputer mit GB10 und 128 GB Unified Memory, on-demand. Statt die Maschine zu kaufen, mietest du sie, solange du sie brauchst.","\u003Cp>Der NVIDIA-AI-Supercomputer mit GB10 und 128 GB Unified Memory, on-demand. Statt die Maschine zu kaufen, mietest du sie, solange du sie brauchst.\u003C\u002Fp>\n",{"type":30,"label":31,"target":32,"page":60,"url":36},{"id":34,"slug":35,"path":36,"page_type":37,"published":38,"type":39},{"title":62,"description":63,"description_html":64,"link":65},"Bare Metal mit Root","DGX Spark oder H100 als dedizierte Maschine. Voller Root-Zugriff, keine Abstraktionsschicht dazwischen, Schweizer Rechenzentrum.","\u003Cp>DGX Spark oder H100 als dedizierte Maschine. Voller Root-Zugriff, keine Abstraktionsschicht dazwischen, Schweizer Rechenzentrum.\u003C\u002Fp>\n",{"type":30,"label":66,"target":32,"page":67,"url":70},"Bare Metal GPU",{"id":68,"slug":69,"path":70,"page_type":37,"published":38,"type":39},675,"bare-metal","\u002Fde\u002Fbare-metal",{"title":72,"description":73,"description_html":74,"link":75},"Managed Inference","LLM-Endpoints via vLLM, von uns betrieben. OpenAI-kompatible API, ohne dass du dich um Betrieb und Skalierung kümmerst.","\u003Cp>LLM-Endpoints via vLLM, von uns betrieben. OpenAI-kompatible API, ohne dass du dich um Betrieb und Skalierung kümmerst.\u003C\u002Fp>\n",{"type":30,"label":72,"target":32,"page":76,"url":79},{"id":77,"slug":78,"path":79,"page_type":37,"published":38,"type":39},676,"managed-inference","\u002Fde\u002Fmanaged-inference",{"title":81,"description":82,"description_html":83,"link":84},"Hermes Agents","Agentische Workloads als gemanagter Dienst. Hermes-Agents auf souveräner Hardware, mit persistentem Gedächtnis und Tool-Use.","\u003Cp>Agentische Workloads als gemanagter Dienst. Hermes-Agents auf souveräner Hardware, mit persistentem Gedächtnis und Tool-Use.\u003C\u002Fp>\n",{"type":30,"label":81,"target":32,"page":85,"url":88},{"id":86,"slug":87,"path":88,"page_type":37,"published":38,"type":39},677,"agents","\u002Fde\u002Fagents",{"id":90,"position":91,"content_type":92,"fields":95},8074,3,{"identifier":93,"name":94},"text","Text Block",{"headline":96,"alignment":97,"body":98,"body_html":99},"Warum eigene Hardware statt Hyperscaler","left","Die meisten AI-Projekte starten auf einer grossen Cloud und merken später, dass drei Dinge fehlen: Datenhoheit, planbare Kosten und Kontrolle über den Stack.\n\n**Deine Daten bleiben in der Schweiz.** Die Hardware steht in einem Schweizer Rechenzentrum. Prompts, Embeddings und Trainingsdaten verlassen die Schweizer Rechtsordnung nicht. Das ist DSG- und DSGVO-konform, ohne dass du es dir zusammenargumentieren musst.\n\n**Kosten, die du vorher kennst.** Du buchst eine Maschine oder einen Endpoint zur Monatspauschale, nicht ein undurchsichtiges Bundle aus Compute, Traffic und Speicher. Kein Bill-Shock am Monatsende.\n\n**Du baust auf einem Stack, den wir selbst betreiben.** Wir vermieten keine Hardware, die wir nur durchreichen. Wir betreiben denselben Stack für unsere eigenen Produkte. Wenn etwas klemmt, kennen wir es.","\u003Cp>Die meisten AI-Projekte starten auf einer grossen Cloud und merken später, dass drei Dinge fehlen: Datenhoheit, planbare Kosten und Kontrolle über den Stack.\u003C\u002Fp>\n\n\u003Cp>\u003Cstrong>Deine Daten bleiben in der Schweiz.\u003C\u002Fstrong> Die Hardware steht in einem Schweizer Rechenzentrum. Prompts, Embeddings und Trainingsdaten verlassen die Schweizer Rechtsordnung nicht. Das ist DSG- und DSGVO-konform, ohne dass du es dir zusammenargumentieren musst.\u003C\u002Fp>\n\n\u003Cp>\u003Cstrong>Kosten, die du vorher kennst.\u003C\u002Fstrong> Du buchst eine Maschine oder einen Endpoint zur Monatspauschale, nicht ein undurchsichtiges Bundle aus Compute, Traffic und Speicher. Kein Bill-Shock am Monatsende.\u003C\u002Fp>\n\n\u003Cp>\u003Cstrong>Du baust auf einem Stack, den wir selbst betreiben.\u003C\u002Fstrong> Wir vermieten keine Hardware, die wir nur durchreichen. Wir betreiben denselben Stack für unsere eigenen Produkte. Wenn etwas klemmt, kennen wir es.\u003C\u002Fp>\n",{"id":101,"position":102,"content_type":103,"fields":106},8075,4,{"identifier":104,"name":105},"pricing_teaser","Preis-Teaser",{"eyebrow":107,"headline":108,"body":109,"body_html":110,"cta":111},"Preise","Transparent, monatlich abgerechnet","Bare Metal, Managed Inference und Agents rechnen wir monatsweise ab, als planbare Pauschale statt Stundenzähler oder Token-Lotterie. Du siehst die Ansätze, bevor du fragst. Kein „Preis auf Anfrage“.","\u003Cp>Bare Metal, Managed Inference und Agents rechnen wir monatsweise ab, als planbare Pauschale statt Stundenzähler oder Token-Lotterie. Du siehst die Ansätze, bevor du fragst. Kein „Preis auf Anfrage“.\u003C\u002Fp>\n",{"type":30,"label":112,"target":32,"page":113,"url":46},"Alle Preise ansehen",{"id":44,"slug":45,"path":46,"page_type":10,"published":38,"type":39},{"id":115,"position":116,"content_type":117,"fields":120},8076,5,{"identifier":118,"name":119},"faq_list","FAQ-Liste",{"headline":121,"items":122},"Häufige Fragen",[123,127,131,135],{"question":124,"answer":125,"answer_html":126},"Wo stehen die GPUs?","In einem Rechenzentrum in der Schweiz. Deine Daten verlassen die Schweizer Rechtsordnung nicht.","\u003Cp>In einem Rechenzentrum in der Schweiz. Deine Daten verlassen die Schweizer Rechtsordnung nicht.\u003C\u002Fp>\n",{"question":128,"answer":129,"answer_html":130},"Brauche ich eigenes ML-Know-how?","Für Bare Metal ja. Du bekommst Root und baust selbst. Für [Managed Inference](\u002Fde\u002Fmanaged-inference) und [Agents](\u002Fde\u002Fagents) nicht, das betreiben wir für dich.","\u003Cp>Für Bare Metal ja. Du bekommst Root und baust selbst. Für \u003Ca href=\"\u002Fde\u002Fmanaged-inference\">Managed Inference\u003C\u002Fa> und \u003Ca href=\"\u002Fde\u002Fagents\">Agents\u003C\u002Fa> nicht, das betreiben wir für dich.\u003C\u002Fp>\n",{"question":132,"answer":133,"answer_html":134},"Kann ich klein anfangen?","Ja. Du buchst eine Maschine oder einen Endpoint zur Monatspauschale, ohne Hardware zu kaufen und ohne lange Mindestlaufzeit.","\u003Cp>Ja. Du buchst eine Maschine oder einen Endpoint zur Monatspauschale, ohne Hardware zu kaufen und ohne lange Mindestlaufzeit.\u003C\u002Fp>\n",{"question":136,"answer":137,"answer_html":138},"Welche Modelle laufen?","Offene Modelle deiner Wahl über vLLM, OpenAI-kompatibel. Für Agents setzen wir auf Hermes von Nous Research.","\u003Cp>Offene Modelle deiner Wahl über vLLM, OpenAI-kompatibel. Für Agents setzen wir auf Hermes von Nous Research.\u003C\u002Fp>\n",{"id":140,"position":141,"content_type":142,"fields":145},8077,6,{"identifier":143,"name":144},"cta","CTA Block",{"headline":146,"subline":147,"cta":148,"mode":154},"Sag uns, was du vorhast","Egal ob DGX Spark, ein gemanagter Endpoint oder ein Agent. Wir antworten konkret, nicht mit einem Verkaufsgespräch.",{"type":30,"label":149,"target":32,"page":150,"url":153},"Kontakt aufnehmen",{"id":151,"slug":152,"path":153,"page_type":10,"published":38,"type":39},682,"kontakt","\u002Fde\u002Fkontakt","dark",[156,157,160],{"title":107,"href":46},{"title":158,"href":159},"Wissen","\u002Fde\u002Fwissen",{"title":161,"href":162},"Über Twentyone","\u002Fde\u002Fueber-uns",[],[],[166,175,185,194,202,210,217,224,230,236,242,249,255,261,267,273,279,286],{"path":167,"slug":168,"title":169,"summary":170,"image":32,"publication_date":171,"big5_category":172,"hubs":173},"\u002Fde\u002Fwissen\u002Fazure-openai-bedrock-alternative-schweiz","azure-openai-bedrock-alternative-schweiz","Souveräne Inferenz gegen Azure OpenAI und AWS Bedrock: was sich im Alltag ändert","Azure OpenAI und AWS Bedrock gegen einen souverän betriebenen Endpoint: warum der Schweizer Serverstandort der Hyperscaler das Kernproblem nicht löst und was der Unterschied im Betrieb bedeutet.","2026-07-13T00:00:00Z","comparisons",[174],{"slug":78,"title":72},{"path":176,"slug":177,"title":178,"summary":179,"image":32,"publication_date":171,"big5_category":180,"hubs":181},"\u002Fde\u002Fwissen\u002Fbeste-gpu-llm-inferenz","beste-gpu-llm-inferenz","Die beste GPU für LLM-Inferenz: DGX Spark, H100, L40S und RTX im Vergleich","Welche GPU für eigene Inferenz? DGX Spark, H100, L40S und RTX 4090 nach dem, was zählt: wie viel Modell hineinpasst, wie viel Durchsatz herauskommt und was der Monat kostet.","bestof",[182,184],{"slug":69,"title":183},"Bare Metal GPU mit Root-Zugriff",{"slug":35,"title":31},{"path":186,"slug":187,"title":188,"summary":189,"image":32,"publication_date":171,"big5_category":190,"hubs":191},"\u002Fde\u002Fwissen\u002Fhermes-agent-erfahrungsbericht","hermes-agent-erfahrungsbericht","Hermes-Agent im Realbetrieb: was ein souveräner Agent wirklich leistet","Ein Erfahrungsbericht statt Hochglanzprospekt: wie sich ein souverän betriebener Hermes-Agent im täglichen Einsatz verhält, wo er glänzt und wo die Begleitung anfängt.","reviews",[192],{"slug":87,"title":193},"Hermes Agents as a Service",{"path":195,"slug":196,"title":197,"summary":198,"image":32,"publication_date":171,"big5_category":199,"hubs":200},"\u002Fde\u002Fwissen\u002Fki-regulierte-daten-schweiz","ki-regulierte-daten-schweiz","KI mit regulierten Daten: LLMs nutzen, ohne dass die Daten die Schweiz verlassen","Für Branchen, in denen Daten das Land nicht verlassen dürfen: was revDSG, Berufsgeheimnis und der CLOUD Act für KI-Projekte bedeuten, und wie souveräne Inferenz den Rahmen einhält.","problems",[201],{"slug":78,"title":72},{"path":203,"slug":204,"title":205,"summary":206,"image":32,"publication_date":171,"big5_category":207,"hubs":208},"\u002Fde\u002Fwissen\u002Fopenai-api-kosten-vs-eigener-endpoint","openai-api-kosten-vs-eigener-endpoint","Ab welchem Volumen sich ein eigener Endpoint gegen die API rechnet","Die Pay-per-Token-API ist günstig, bis sie es nicht mehr ist. Wo genau der Break-even zu einem reservierten Endpoint mit fester Monatspauschale liegt, an einem konkreten Beispiel durchgerechnet.","cost",[209],{"slug":78,"title":72},{"path":211,"slug":212,"title":213,"summary":214,"image":32,"publication_date":215,"big5_category":172,"hubs":216},"\u002Fde\u002Fwissen\u002Ffine-tuning-rag-prompt","fine-tuning-rag-prompt","Fine-Tuning, RAG oder besserer Prompt? Die klare Entscheidungsregel","Fine-Tuning ist meistens nicht die Antwort auf „das Modell kennt unsere Daten nicht“. Wann Prompting, RAG oder Fine-Tuning wirklich das richtige Werkzeug sind und wie du die Eskalationsleiter korrekt durchläufst.","2026-07-07T00:00:00Z",[],{"path":218,"slug":219,"title":220,"summary":221,"image":32,"publication_date":215,"big5_category":222,"hubs":223},"\u002Fde\u002Fwissen\u002Fopenai-api-migration","openai-api-migration","Von der OpenAI-API zu souveräner Inferenz: die Migration in der Praxis","Der Umstieg von OpenAI oder Anthropic auf ein selbst betriebenes offenes Modell in der Schweiz sieht dank OpenAI-kompatibler Endpoints nach einer Ein-Zeilen-Änderung aus, ist aber doch mehr. Wo Prompts, Tool-Calling und Feature-Lücken zur Stolperfalle werden.","how-to",[],{"path":225,"slug":226,"title":227,"summary":228,"image":32,"publication_date":215,"big5_category":199,"hubs":229},"\u002Fde\u002Fwissen\u002Fquantisierung-int4-int8-awq-gptq-gguf","quantisierung-int4-int8-awq-gptq-gguf","Quantisierung ohne Qualitätsverlust: int4, int8, AWQ, GPTQ, GGUF entzaubert","int8 ist fast immer verlustfrei, int4 meistens auch, aber nicht bei Reasoning, Code und langen Agenten-Ketten. Wir zeigen dir ungeschönt, was Quantisierung wirklich kostet und wo GPTQ, AWQ, GGUF und bitsandbytes hingehören.",[],{"path":231,"slug":232,"title":233,"summary":234,"image":32,"publication_date":215,"big5_category":199,"hubs":235},"\u002Fde\u002Fwissen\u002Frag-schlechte-antworten","rag-schlechte-antworten","RAG richtig gebaut: warum eure Wissensbasis schlechte Antworten gibt","Die meisten RAG-Systeme scheitern nicht am Sprachmodell, sondern am Retrieval davor. Wir zeigen die häufigsten Fehlerquellen bei Chunking, Embeddings und Retrieval-Strategie sowie, wie du Retrieval- und Generationsfehler sauber auseinanderhältst.",[],{"path":237,"slug":238,"title":239,"summary":240,"image":32,"publication_date":215,"big5_category":222,"hubs":241},"\u002Fde\u002Fwissen\u002Fvram-modell-gpu-berechnen","vram-modell-gpu-berechnen","Welches Modell passt auf welche GPU? VRAM richtig berechnen","Bevor du GPUs kaufst oder mietest: die Faustformel für Gewichte, KV-Cache und Overhead, damit du weisst, welches Modell wirklich auf deine Hardware passt.",[],{"path":243,"slug":244,"title":245,"summary":246,"image":32,"publication_date":247,"big5_category":199,"hubs":248},"\u002Fde\u002Fwissen\u002Fagent-oder-endpoint","agent-oder-endpoint","Braucht ihr wirklich einen Agent oder reicht ein Endpoint?","Agenten sind im Trend, aber oft die teurere und fragilere Lösung für ein Problem, das ein einfacher Endpoint löst. Wann sich der Aufwand lohnt und wann nicht.","2026-06-30T00:00:00Z",[],{"path":250,"slug":251,"title":252,"summary":253,"image":32,"publication_date":247,"big5_category":199,"hubs":254},"\u002Fde\u002Fwissen\u002Fdatenhoheit-was-bedeutet-das","datenhoheit-was-bedeutet-das","Was Datenhoheit konkret heisst und wo deine Prompts wirklich landen","Datenhoheit ist mehr als ein Hosting-Standort. Was rechtlich, technisch und vertraglich dahintersteckt, und welche Fragen du jedem AI-Anbieter stellen solltest.",[],{"path":256,"slug":257,"title":258,"summary":259,"image":32,"publication_date":247,"big5_category":190,"hubs":260},"\u002Fde\u002Fwissen\u002Fdgx-spark-erfahrungsbericht","dgx-spark-erfahrungsbericht","DGX Spark im Betrieb: was die Maschine nach drei Monaten wirklich kann","Kein Datenblatt, sondern ein Erfahrungsbericht. Wo die DGX Spark im täglichen Betrieb glänzt, wo ihre Grenzen liegen und für wen sich die Maschine lohnt.",[],{"path":262,"slug":263,"title":264,"summary":265,"image":32,"publication_date":247,"big5_category":222,"hubs":266},"\u002Fde\u002Fwissen\u002Fllm-endpoint-aufsetzen","llm-endpoint-aufsetzen","Eigenen LLM Endpoint aufsetzen: von der GPU zum ersten Token","Ein realistischer Weg vom blanken Server zum produktiven Inferenz-Endpoint. Die Schritte, die Reihenfolge und die Stolpersteine, die zwischen „läuft lokal“ und „läuft produktiv“ liegen.",[],{"path":268,"slug":269,"title":270,"summary":271,"image":32,"publication_date":247,"big5_category":180,"hubs":272},"\u002Fde\u002Fwissen\u002Foffene-modelle-auswahl","offene-modelle-auswahl","Welches offene Modell für welche Aufgabe? Llama, Qwen, Mistral & Co.","Nicht das grösste Modell gewinnt, sondern das passende. Wie du offene Modelle nach Aufgabe, Speicherbedarf und Lizenz auswählst, statt Benchmarks hinterherzulaufen.",[],{"path":274,"slug":275,"title":276,"summary":277,"image":32,"publication_date":247,"big5_category":172,"hubs":278},"\u002Fde\u002Fwissen\u002Fvllm-ollama-tgi-vergleich","vllm-ollama-tgi-vergleich","vLLM, Ollama oder TGI: welche Inference Engine für welchen Fall","Die Engine entscheidet über Durchsatz, Latenz und Betriebsaufwand. Ein nüchterner Vergleich der drei verbreitetsten Optionen, inklusive der Fälle, in denen die einfache Lösung gewinnt.",[],{"path":280,"slug":281,"title":282,"summary":283,"image":32,"publication_date":284,"big5_category":172,"hubs":285},"\u002Fde\u002Fwissen\u002Fdgx-spark-vs-cloud-gpu","dgx-spark-vs-cloud-gpu","DGX Spark gegen Cloud-GPU: wann sich eigene Hardware lohnt","Unified Memory gegen rohen Durchsatz, Schweizer Hardware gegen Hyperscaler. Ein nüchterner Vergleich, inklusive der Fälle, in denen die Cloud gewinnt.","2026-06-18T00:00:00Z",[],{"path":287,"slug":288,"title":289,"summary":290,"image":32,"publication_date":284,"big5_category":207,"hubs":291},"\u002Fde\u002Fwissen\u002Fllm-selbst-betreiben-kosten","llm-selbst-betreiben-kosten","Was kostet es, ein LLM selbst zu betreiben?","Die nüchterne Rechnung hinter eigenen LLM-Endpoints: Hardware, Betrieb und der Punkt, ab dem sich Selbermachen wirklich lohnt.",[],[293,300],{"title":294,"links":295},"Leistungen",[296,297,298,299],{"title":31,"href":36},{"title":66,"href":70},{"title":72,"href":79},{"title":81,"href":88},{"title":301,"links":302},"Unternehmen",[303,304,305,306],{"title":161,"href":162},{"title":158,"href":159},{"title":107,"href":46},{"title":307,"href":153},"Kontakt",[309,311,313,315],{"title":31,"href":36,"description":310},"Der NVIDIA-AI-Supercomputer für den Schreibtisch — on-demand aus der Schweiz, bare metal oder gemanagt.",{"title":66,"href":70,"description":312},"DGX Spark & H100 als dedizierte Maschine — volle Kontrolle, Root-Zugriff, Schweizer Rechenzentrum.",{"title":72,"href":79,"description":314},"LLM-Endpoints via vLLM — von uns betrieben, ohne Ops-Aufwand, mit Schweizer Datenhoheit.",{"title":81,"href":88,"description":316},"Agentische Workloads gemanagt — Hermes-Agents auf souveräner Hardware, von uns betrieben."]