[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"reazon-page-\u002Fde\u002Fdgx-spark":3,"reazon-angebot-subnav":173,"reazon-offering-angebot-zielgruppen":174,"reazon-footernav":175,"reazon-mainnav":201,"reazon-offering-angebot-leistungen":205,"reazon-articles-\u002Fde\u002Fwissen":213},{"data":4},{"id":5,"path":6,"slug":7,"published_at":8,"page_type":9,"no_index":12,"fields":13,"blocks":18},674,"\u002Fde\u002Fdgx-spark","dgx-spark","2026-06-19T09:21:41.145Z",{"identifier":10,"name":11},"service","Service-Hub",false,{"title":14,"summary":15,"meta_description":16,"meta_title":17},"DGX Spark mieten","Der NVIDIA-AI-Supercomputer für den Schreibtisch — on-demand aus der Schweiz, bare metal oder gemanagt.","DGX Spark (GB10, 128 GB) on-demand mieten statt kaufen — Schweizer Datenhoheit, Root-Zugriff oder gemanagte Endpoints. Kosten, Vergleich und Einsatz im Überblick.","NVIDIA DGX Spark mieten — on-demand aus der Schweiz | Twentyone",[19,46,60,72,84,96,108,130,157],{"id":20,"position":21,"content_type":22,"fields":25},8078,1,{"identifier":23,"name":24},"cluster_grid","Themen-Grid",{"headline":26,"subnav_label":27,"subnav_anchor":28,"items":29},"DGX Spark im Überblick","Überblick","ueberblick",[30,34,38,42],{"title":31,"description":32,"description_html":33},"GB10 Grace Blackwell","NVIDIAs Superchip vereint CPU und Blackwell-GPU auf einem Package. Gebaut für AI-Workloads am Schreibtisch und im Rechenzentrum.","\u003Cp>NVIDIAs Superchip vereint CPU und Blackwell-GPU auf einem Package. Gebaut für AI-Workloads am Schreibtisch und im Rechenzentrum.\u003C\u002Fp>\n",{"title":35,"description":36,"description_html":37},"128 GB Unified Memory","CPU und GPU teilen sich denselben Speicher. Du lädst grosse Modelle, ohne sie über PCIe hin und her zu schaufeln.","\u003Cp>CPU und GPU teilen sich denselben Speicher. Du lädst grosse Modelle, ohne sie über PCIe hin und her zu schaufeln.\u003C\u002Fp>\n",{"title":39,"description":40,"description_html":41},"Bare Metal oder gemanagt","Nimm die Maschine mit vollem Root-Zugriff oder lass uns Endpoints und Agents darauf betreiben.","\u003Cp>Nimm die Maschine mit vollem Root-Zugriff oder lass uns Endpoints und Agents darauf betreiben.\u003C\u002Fp>\n",{"title":43,"description":44,"description_html":45},"Schweizer Rechenzentrum","Die Hardware steht in der Schweiz. Deine Daten bleiben in der Schweizer Rechtsordnung.","\u003Cp>Die Hardware steht in der Schweiz. Deine Daten bleiben in der Schweizer Rechtsordnung.\u003C\u002Fp>\n",{"id":47,"position":48,"content_type":49,"fields":52},8079,2,{"identifier":50,"name":51},"big5_section","TAYA-Sektion",{"subnav_anchor":53,"pillar":54,"eyebrow":55,"headline":56,"subnav_label":57,"body":58,"body_html":59},"kosten","cost","Was kostet das?","Was es kostet, DGX Spark zu mieten","Kosten","Eine DGX Spark zu kaufen bindet Kapital, und die Hardware veraltet, während sie die meiste Zeit ungenutzt steht. Du mietest sie stattdessen, solange dein Projekt läuft.\n\nWir rechnen monatsweise ab, egal ob du die Maschine bare metal mit Root nimmst oder wir Endpoints darauf betreiben. Eine planbare Pauschale pro Monat statt Stunden-Buchhaltung. Die aktuellen Ansätze stehen auf der [Preisseite](\u002Fde\u002Fpreise).\n\nWas den Preis treibt: ob du die ganze Maschine dediziert brauchst oder dir ein geteilter Inferenz-Endpoint reicht, und wie viel Betrieb du an uns abgibst.","\u003Cp>Eine DGX Spark zu kaufen bindet Kapital, und die Hardware veraltet, während sie die meiste Zeit ungenutzt steht. Du mietest sie stattdessen, solange dein Projekt läuft.\u003C\u002Fp>\n\n\u003Cp>Wir rechnen monatsweise ab, egal ob du die Maschine bare metal mit Root nimmst oder wir Endpoints darauf betreiben. Eine planbare Pauschale pro Monat statt Stunden-Buchhaltung. Die aktuellen Ansätze stehen auf der \u003Ca href=\"\u002Fde\u002Fpreise\">Preisseite\u003C\u002Fa>.\u003C\u002Fp>\n\n\u003Cp>Was den Preis treibt: ob du die ganze Maschine dediziert brauchst oder dir ein geteilter Inferenz-Endpoint reicht, und wie viel Betrieb du an uns abgibst.\u003C\u002Fp>\n",{"id":61,"position":62,"content_type":63,"fields":64},8080,3,{"identifier":50,"name":51},{"pillar":65,"eyebrow":66,"headline":67,"subnav_label":68,"subnav_anchor":69,"body":70,"body_html":71},"problems","Passt das zu mir?","Wann sich DGX Spark lohnt, und wann nicht","Wann sinnvoll","wann-sinnvoll","DGX Spark spielt ihre Stärke aus, wenn du grosse, offene Modelle lokal laufen lassen willst. Die 128 GB Unified Memory tragen Modelle, die auf einer normalen Consumer-GPU nicht in den Speicher passen.\n\nSie ist nicht die richtige Wahl, wenn du nur gelegentlich ein kleines Modell abfragst. Dann reicht ein gemanagter [Endpoint](\u002Fde\u002Fmanaged-inference), und du zahlst nicht für eine ganze Maschine.\n\nSie ist auch nicht das Werkzeug für grosses paralleles Training über viele GPUs. Dafür ist ein [H100-Setup](\u002Fde\u002Fbare-metal) gebaut. DGX Spark ist die Inferenz- und Entwicklungsmaschine, nicht der Trainings-Cluster.","\u003Cp>DGX Spark spielt ihre Stärke aus, wenn du grosse, offene Modelle lokal laufen lassen willst. Die 128 GB Unified Memory tragen Modelle, die auf einer normalen Consumer-GPU nicht in den Speicher passen.\u003C\u002Fp>\n\n\u003Cp>Sie ist nicht die richtige Wahl, wenn du nur gelegentlich ein kleines Modell abfragst. Dann reicht ein gemanagter \u003Ca href=\"\u002Fde\u002Fmanaged-inference\">Endpoint\u003C\u002Fa>, und du zahlst nicht für eine ganze Maschine.\u003C\u002Fp>\n\n\u003Cp>Sie ist auch nicht das Werkzeug für grosses paralleles Training über viele GPUs. Dafür ist ein \u003Ca href=\"\u002Fde\u002Fbare-metal\">H100-Setup\u003C\u002Fa> gebaut. DGX Spark ist die Inferenz- und Entwicklungsmaschine, nicht der Trainings-Cluster.\u003C\u002Fp>\n",{"id":73,"position":74,"content_type":75,"fields":76},8081,4,{"identifier":50,"name":51},{"pillar":77,"eyebrow":78,"headline":79,"subnav_label":80,"subnav_anchor":81,"body":82,"body_html":83},"comparisons","Wie unterscheidet sich das?","DGX Spark, H100 oder Cloud-GPU","Vergleich","vergleich","**DGX Spark** ist auf lokale Inferenz grosser Modelle ausgelegt. Unified Memory statt rohem Durchsatz, effizient und souverän.\n\n**H100** liefert die rohe Rechenleistung fürs Training und für hohen Durchsatz. Du nimmst sie, wenn du über viele Tokens pro Sekunde oder über Fine-Tuning redest. Auch sie gibt es bei uns [bare metal](\u002Fde\u002Fbare-metal).\n\n**Hyperscaler-Cloud** ist flexibel und sofort da, aber deine Daten liegen ausserhalb der Schweiz, und die Kosten sind schwer vorhersehbar. Genau diese drei Punkte löst twentyone anders.","\u003Cp>\u003Cstrong>DGX Spark\u003C\u002Fstrong> ist auf lokale Inferenz grosser Modelle ausgelegt. Unified Memory statt rohem Durchsatz, effizient und souverän.\u003C\u002Fp>\n\n\u003Cp>\u003Cstrong>H100\u003C\u002Fstrong> liefert die rohe Rechenleistung fürs Training und für hohen Durchsatz. Du nimmst sie, wenn du über viele Tokens pro Sekunde oder über Fine-Tuning redest. Auch sie gibt es bei uns \u003Ca href=\"\u002Fde\u002Fbare-metal\">bare metal\u003C\u002Fa>.\u003C\u002Fp>\n\n\u003Cp>\u003Cstrong>Hyperscaler-Cloud\u003C\u002Fstrong> ist flexibel und sofort da, aber deine Daten liegen ausserhalb der Schweiz, und die Kosten sind schwer vorhersehbar. Genau diese drei Punkte löst twentyone anders.\u003C\u002Fp>\n",{"id":85,"position":86,"content_type":87,"fields":88},8082,5,{"identifier":50,"name":51},{"pillar":89,"eyebrow":90,"headline":91,"subnav_label":92,"subnav_anchor":93,"body":94,"body_html":95},"reviews","Habt ihr Beispiele?","Wir betreiben DGX Spark selbst","Beispiele","beispiele","Wir reden nicht über Hardware, die wir nur aus dem Datenblatt kennen. Wir betreiben unsere eigenen Produkte und Agents auf demselben Stack, den wir vermieten.\n\nDas ist unser ehrlichster Beleg: Wir setzen die Maschine im Alltag ein, nicht nur in der Demo. Die Stolpersteine, die wir dabei selbst getroffen haben, fliessen direkt in das ein, was du bei uns bekommst.","\u003Cp>Wir reden nicht über Hardware, die wir nur aus dem Datenblatt kennen. Wir betreiben unsere eigenen Produkte und Agents auf demselben Stack, den wir vermieten.\u003C\u002Fp>\n\n\u003Cp>Das ist unser ehrlichster Beleg: Wir setzen die Maschine im Alltag ein, nicht nur in der Demo. Die Stolpersteine, die wir dabei selbst getroffen haben, fliessen direkt in das ein, was du bei uns bekommst.\u003C\u002Fp>\n",{"id":97,"position":98,"content_type":99,"fields":100},8083,6,{"identifier":50,"name":51},{"pillar":101,"eyebrow":102,"headline":103,"subnav_label":104,"subnav_anchor":105,"body":106,"body_html":107},"bestof","Was empfehlt ihr?","Unsere Empfehlung für den Einstieg","Empfehlung","empfehlung","Willst du ein offenes Modell souverän betreiben, ohne dich um Betrieb zu kümmern, starte mit einem gemanagten Endpoint und wechsle erst auf eine dedizierte Maschine, wenn die Last es verlangt.\n\nBrauchst du volle Kontrolle über Treiber, Modelle und Daten, nimm die DGX Spark bare metal mit Root.\n\nDer häufigste Fehler: zu früh eine ganze Maschine dediziert mieten, obwohl ein geteilter Endpoint die ersten Monate locker trägt. Wir sagen dir, was zu deinem Workload passt, auch wenn das die kleinere Rechnung ist.","\u003Cp>Willst du ein offenes Modell souverän betreiben, ohne dich um Betrieb zu kümmern, starte mit einem gemanagten Endpoint und wechsle erst auf eine dedizierte Maschine, wenn die Last es verlangt.\u003C\u002Fp>\n\n\u003Cp>Brauchst du volle Kontrolle über Treiber, Modelle und Daten, nimm die DGX Spark bare metal mit Root.\u003C\u002Fp>\n\n\u003Cp>Der häufigste Fehler: zu früh eine ganze Maschine dediziert mieten, obwohl ein geteilter Endpoint die ersten Monate locker trägt. Wir sagen dir, was zu deinem Workload passt, auch wenn das die kleinere Rechnung ist.\u003C\u002Fp>\n",{"id":109,"position":110,"content_type":111,"fields":114},8084,7,{"identifier":112,"name":113},"pricing_teaser","Preis-Teaser",{"eyebrow":115,"cta":116,"headline":127,"body":128,"body_html":129},"Preise",{"type":117,"label":118,"target":119,"page":120,"url":123},"internal","Preise ansehen",null,{"id":121,"slug":122,"path":123,"page_type":124,"published":125,"type":126},678,"preise","\u002Fde\u002Fpreise","page",true,"Cms::Page","Monatlich abgerechnet","Ob bare metal mit Root oder gemanagter Endpoint, wir rechnen beides monatsweise ab. Die konkreten Ansätze stehen offen auf der Preisseite.","\u003Cp>Ob bare metal mit Root oder gemanagter Endpoint, wir rechnen beides monatsweise ab. Die konkreten Ansätze stehen offen auf der Preisseite.\u003C\u002Fp>\n",{"id":131,"position":132,"content_type":133,"fields":136},8085,8,{"identifier":134,"name":135},"faq_list","FAQ-Liste",{"headline":137,"subnav_label":138,"subnav_anchor":139,"items":140},"Häufige Fragen zu DGX Spark","FAQs","faqs",[141,145,149,153],{"question":142,"answer":143,"answer_html":144},"Was ist die DGX Spark genau?","Ein kompakter AI-Rechner von NVIDIA mit GB10-Superchip und 128 GB Unified Memory, gebaut, um grosse Modelle lokal laufen zu lassen.","\u003Cp>Ein kompakter AI-Rechner von NVIDIA mit GB10-Superchip und 128 GB Unified Memory, gebaut, um grosse Modelle lokal laufen zu lassen.\u003C\u002Fp>\n",{"question":146,"answer":147,"answer_html":148},"Bekomme ich die Maschine für mich allein?","Bare metal ja, dann ist sie dediziert und du hast Root. Gemanagt teilst du dir Inferenz-Kapazität und zahlst eine Monatspauschale für die reservierte Leistung.","\u003Cp>Bare metal ja, dann ist sie dediziert und du hast Root. Gemanagt teilst du dir Inferenz-Kapazität und zahlst eine Monatspauschale für die reservierte Leistung.\u003C\u002Fp>\n",{"question":150,"answer":151,"answer_html":152},"Welche Modelle laufen darauf?","Offene Modelle deiner Wahl über vLLM, OpenAI-kompatibel. Für agentische Workloads betreiben wir [Hermes-Agents](\u002Fde\u002Fagents).","\u003Cp>Offene Modelle deiner Wahl über vLLM, OpenAI-kompatibel. Für agentische Workloads betreiben wir \u003Ca href=\"\u002Fde\u002Fagents\">Hermes-Agents\u003C\u002Fa>.\u003C\u002Fp>\n",{"question":154,"answer":155,"answer_html":156},"Kann ich darauf trainieren?","Für Fine-Tuning kleinerer Modelle ja. Für grosses, paralleles Training ist ein [H100-Setup](\u002Fde\u002Fbare-metal) die bessere Wahl.","\u003Cp>Für Fine-Tuning kleinerer Modelle ja. Für grosses, paralleles Training ist ein \u003Ca href=\"\u002Fde\u002Fbare-metal\">H100-Setup\u003C\u002Fa> die bessere Wahl.\u003C\u002Fp>\n",{"id":158,"position":159,"content_type":160,"fields":163},8086,9,{"identifier":161,"name":162},"cta","CTA Block",{"headline":164,"subline":165,"cta":166,"mode":172},"DGX Spark für dein Projekt","Sag uns, welches Modell du betreiben willst. Wir sagen dir, ob bare metal oder gemanagt besser passt.",{"type":117,"label":167,"target":119,"page":168,"url":171},"Kontakt aufnehmen",{"id":169,"slug":170,"path":171,"page_type":124,"published":125,"type":126},682,"kontakt","\u002Fde\u002Fkontakt","dark",[],[],[176,189],{"title":177,"links":178},"Leistungen",[179,180,183,186],{"title":14,"href":6},{"title":181,"href":182},"Bare Metal GPU","\u002Fde\u002Fbare-metal",{"title":184,"href":185},"Managed Inference","\u002Fde\u002Fmanaged-inference",{"title":187,"href":188},"Hermes Agents","\u002Fde\u002Fagents",{"title":190,"links":191},"Unternehmen",[192,195,198,199],{"title":193,"href":194},"Über Twentyone","\u002Fde\u002Fueber-uns",{"title":196,"href":197},"Wissen","\u002Fde\u002Fwissen",{"title":115,"href":123},{"title":200,"href":171},"Kontakt",[202,203,204],{"title":115,"href":123},{"title":196,"href":197},{"title":193,"href":194},[206,207,209,211],{"title":14,"href":6,"description":15},{"title":181,"href":182,"description":208},"DGX Spark & H100 als dedizierte Maschine — volle Kontrolle, Root-Zugriff, Schweizer Rechenzentrum.",{"title":184,"href":185,"description":210},"LLM-Endpoints via vLLM — von uns betrieben, ohne Ops-Aufwand, mit Schweizer Datenhoheit.",{"title":187,"href":188,"description":212},"Agentische Workloads gemanagt — Hermes-Agents auf souveräner Hardware, von uns betrieben.",[214,223,233,242,249,256,263,270,276,282,288,295,301,307,313,319,325,332],{"path":215,"slug":216,"title":217,"summary":218,"image":119,"publication_date":219,"big5_category":77,"hubs":220},"\u002Fde\u002Fwissen\u002Fazure-openai-bedrock-alternative-schweiz","azure-openai-bedrock-alternative-schweiz","Souveräne Inferenz gegen Azure OpenAI und AWS Bedrock: was sich im Alltag ändert","Azure OpenAI und AWS Bedrock gegen einen souverän betriebenen Endpoint: warum der Schweizer Serverstandort der Hyperscaler das Kernproblem nicht löst und was der Unterschied im Betrieb bedeutet.","2026-07-13T00:00:00Z",[221],{"slug":222,"title":184},"managed-inference",{"path":224,"slug":225,"title":226,"summary":227,"image":119,"publication_date":219,"big5_category":101,"hubs":228},"\u002Fde\u002Fwissen\u002Fbeste-gpu-llm-inferenz","beste-gpu-llm-inferenz","Die beste GPU für LLM-Inferenz: DGX Spark, H100, L40S und RTX im Vergleich","Welche GPU für eigene Inferenz? DGX Spark, H100, L40S und RTX 4090 nach dem, was zählt: wie viel Modell hineinpasst, wie viel Durchsatz herauskommt und was der Monat kostet.",[229,232],{"slug":230,"title":231},"bare-metal","Bare Metal GPU mit Root-Zugriff",{"slug":7,"title":14},{"path":234,"slug":235,"title":236,"summary":237,"image":119,"publication_date":219,"big5_category":89,"hubs":238},"\u002Fde\u002Fwissen\u002Fhermes-agent-erfahrungsbericht","hermes-agent-erfahrungsbericht","Hermes-Agent im Realbetrieb: was ein souveräner Agent wirklich leistet","Ein Erfahrungsbericht statt Hochglanzprospekt: wie sich ein souverän betriebener Hermes-Agent im täglichen Einsatz verhält, wo er glänzt und wo die Begleitung anfängt.",[239],{"slug":240,"title":241},"agents","Hermes Agents as a Service",{"path":243,"slug":244,"title":245,"summary":246,"image":119,"publication_date":219,"big5_category":65,"hubs":247},"\u002Fde\u002Fwissen\u002Fki-regulierte-daten-schweiz","ki-regulierte-daten-schweiz","KI mit regulierten Daten: LLMs nutzen, ohne dass die Daten die Schweiz verlassen","Für Branchen, in denen Daten das Land nicht verlassen dürfen: was revDSG, Berufsgeheimnis und der CLOUD Act für KI-Projekte bedeuten, und wie souveräne Inferenz den Rahmen einhält.",[248],{"slug":222,"title":184},{"path":250,"slug":251,"title":252,"summary":253,"image":119,"publication_date":219,"big5_category":54,"hubs":254},"\u002Fde\u002Fwissen\u002Fopenai-api-kosten-vs-eigener-endpoint","openai-api-kosten-vs-eigener-endpoint","Ab welchem Volumen sich ein eigener Endpoint gegen die API rechnet","Die Pay-per-Token-API ist günstig, bis sie es nicht mehr ist. Wo genau der Break-even zu einem reservierten Endpoint mit fester Monatspauschale liegt, an einem konkreten Beispiel durchgerechnet.",[255],{"slug":222,"title":184},{"path":257,"slug":258,"title":259,"summary":260,"image":119,"publication_date":261,"big5_category":77,"hubs":262},"\u002Fde\u002Fwissen\u002Ffine-tuning-rag-prompt","fine-tuning-rag-prompt","Fine-Tuning, RAG oder besserer Prompt? Die klare Entscheidungsregel","Fine-Tuning ist meistens nicht die Antwort auf „das Modell kennt unsere Daten nicht“. Wann Prompting, RAG oder Fine-Tuning wirklich das richtige Werkzeug sind und wie du die Eskalationsleiter korrekt durchläufst.","2026-07-07T00:00:00Z",[],{"path":264,"slug":265,"title":266,"summary":267,"image":119,"publication_date":261,"big5_category":268,"hubs":269},"\u002Fde\u002Fwissen\u002Fopenai-api-migration","openai-api-migration","Von der OpenAI-API zu souveräner Inferenz: die Migration in der Praxis","Der Umstieg von OpenAI oder Anthropic auf ein selbst betriebenes offenes Modell in der Schweiz sieht dank OpenAI-kompatibler Endpoints nach einer Ein-Zeilen-Änderung aus, ist aber doch mehr. Wo Prompts, Tool-Calling und Feature-Lücken zur Stolperfalle werden.","how-to",[],{"path":271,"slug":272,"title":273,"summary":274,"image":119,"publication_date":261,"big5_category":65,"hubs":275},"\u002Fde\u002Fwissen\u002Fquantisierung-int4-int8-awq-gptq-gguf","quantisierung-int4-int8-awq-gptq-gguf","Quantisierung ohne Qualitätsverlust: int4, int8, AWQ, GPTQ, GGUF entzaubert","int8 ist fast immer verlustfrei, int4 meistens auch, aber nicht bei Reasoning, Code und langen Agenten-Ketten. Wir zeigen dir ungeschönt, was Quantisierung wirklich kostet und wo GPTQ, AWQ, GGUF und bitsandbytes hingehören.",[],{"path":277,"slug":278,"title":279,"summary":280,"image":119,"publication_date":261,"big5_category":65,"hubs":281},"\u002Fde\u002Fwissen\u002Frag-schlechte-antworten","rag-schlechte-antworten","RAG richtig gebaut: warum eure Wissensbasis schlechte Antworten gibt","Die meisten RAG-Systeme scheitern nicht am Sprachmodell, sondern am Retrieval davor. Wir zeigen die häufigsten Fehlerquellen bei Chunking, Embeddings und Retrieval-Strategie sowie, wie du Retrieval- und Generationsfehler sauber auseinanderhältst.",[],{"path":283,"slug":284,"title":285,"summary":286,"image":119,"publication_date":261,"big5_category":268,"hubs":287},"\u002Fde\u002Fwissen\u002Fvram-modell-gpu-berechnen","vram-modell-gpu-berechnen","Welches Modell passt auf welche GPU? VRAM richtig berechnen","Bevor du GPUs kaufst oder mietest: die Faustformel für Gewichte, KV-Cache und Overhead, damit du weisst, welches Modell wirklich auf deine Hardware passt.",[],{"path":289,"slug":290,"title":291,"summary":292,"image":119,"publication_date":293,"big5_category":65,"hubs":294},"\u002Fde\u002Fwissen\u002Fagent-oder-endpoint","agent-oder-endpoint","Braucht ihr wirklich einen Agent oder reicht ein Endpoint?","Agenten sind im Trend, aber oft die teurere und fragilere Lösung für ein Problem, das ein einfacher Endpoint löst. Wann sich der Aufwand lohnt und wann nicht.","2026-06-30T00:00:00Z",[],{"path":296,"slug":297,"title":298,"summary":299,"image":119,"publication_date":293,"big5_category":65,"hubs":300},"\u002Fde\u002Fwissen\u002Fdatenhoheit-was-bedeutet-das","datenhoheit-was-bedeutet-das","Was Datenhoheit konkret heisst und wo deine Prompts wirklich landen","Datenhoheit ist mehr als ein Hosting-Standort. Was rechtlich, technisch und vertraglich dahintersteckt, und welche Fragen du jedem AI-Anbieter stellen solltest.",[],{"path":302,"slug":303,"title":304,"summary":305,"image":119,"publication_date":293,"big5_category":89,"hubs":306},"\u002Fde\u002Fwissen\u002Fdgx-spark-erfahrungsbericht","dgx-spark-erfahrungsbericht","DGX Spark im Betrieb: was die Maschine nach drei Monaten wirklich kann","Kein Datenblatt, sondern ein Erfahrungsbericht. Wo die DGX Spark im täglichen Betrieb glänzt, wo ihre Grenzen liegen und für wen sich die Maschine lohnt.",[],{"path":308,"slug":309,"title":310,"summary":311,"image":119,"publication_date":293,"big5_category":268,"hubs":312},"\u002Fde\u002Fwissen\u002Fllm-endpoint-aufsetzen","llm-endpoint-aufsetzen","Eigenen LLM Endpoint aufsetzen: von der GPU zum ersten Token","Ein realistischer Weg vom blanken Server zum produktiven Inferenz-Endpoint. Die Schritte, die Reihenfolge und die Stolpersteine, die zwischen „läuft lokal“ und „läuft produktiv“ liegen.",[],{"path":314,"slug":315,"title":316,"summary":317,"image":119,"publication_date":293,"big5_category":101,"hubs":318},"\u002Fde\u002Fwissen\u002Foffene-modelle-auswahl","offene-modelle-auswahl","Welches offene Modell für welche Aufgabe? Llama, Qwen, Mistral & Co.","Nicht das grösste Modell gewinnt, sondern das passende. Wie du offene Modelle nach Aufgabe, Speicherbedarf und Lizenz auswählst, statt Benchmarks hinterherzulaufen.",[],{"path":320,"slug":321,"title":322,"summary":323,"image":119,"publication_date":293,"big5_category":77,"hubs":324},"\u002Fde\u002Fwissen\u002Fvllm-ollama-tgi-vergleich","vllm-ollama-tgi-vergleich","vLLM, Ollama oder TGI: welche Inference Engine für welchen Fall","Die Engine entscheidet über Durchsatz, Latenz und Betriebsaufwand. Ein nüchterner Vergleich der drei verbreitetsten Optionen, inklusive der Fälle, in denen die einfache Lösung gewinnt.",[],{"path":326,"slug":327,"title":328,"summary":329,"image":119,"publication_date":330,"big5_category":77,"hubs":331},"\u002Fde\u002Fwissen\u002Fdgx-spark-vs-cloud-gpu","dgx-spark-vs-cloud-gpu","DGX Spark gegen Cloud-GPU: wann sich eigene Hardware lohnt","Unified Memory gegen rohen Durchsatz, Schweizer Hardware gegen Hyperscaler. Ein nüchterner Vergleich, inklusive der Fälle, in denen die Cloud gewinnt.","2026-06-18T00:00:00Z",[],{"path":333,"slug":334,"title":335,"summary":336,"image":119,"publication_date":330,"big5_category":54,"hubs":337},"\u002Fde\u002Fwissen\u002Fllm-selbst-betreiben-kosten","llm-selbst-betreiben-kosten","Was kostet es, ein LLM selbst zu betreiben?","Die nüchterne Rechnung hinter eigenen LLM-Endpoints: Hardware, Betrieb und der Punkt, ab dem sich Selbermachen wirklich lohnt.",[]]