[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"reazon-offering-angebot-leistungen":3,"reazon-offering-angebot-zielgruppen":20,"reazon-angebot-subnav":21,"reazon-mainnav":22,"reazon-page-\u002Fde\u002Fagents":32,"reazon-footernav":198,"reazon-articles-\u002Fde\u002Fwissen":214},[4,8,12,16],{"title":5,"href":6,"description":7},"DGX Spark mieten","\u002Fde\u002Fdgx-spark","Der NVIDIA-AI-Supercomputer für den Schreibtisch — on-demand aus der Schweiz, bare metal oder gemanagt.",{"title":9,"href":10,"description":11},"Bare Metal GPU","\u002Fde\u002Fbare-metal","DGX Spark & H100 als dedizierte Maschine — volle Kontrolle, Root-Zugriff, Schweizer Rechenzentrum.",{"title":13,"href":14,"description":15},"Managed Inference","\u002Fde\u002Fmanaged-inference","LLM-Endpoints via vLLM — von uns betrieben, ohne Ops-Aufwand, mit Schweizer Datenhoheit.",{"title":17,"href":18,"description":19},"Hermes Agents","\u002Fde\u002Fagents","Agentische Workloads gemanagt — Hermes-Agents auf souveräner Hardware, von uns betrieben.",[],[],[23,26,29],{"title":24,"href":25},"Preise","\u002Fde\u002Fpreise",{"title":27,"href":28},"Wissen","\u002Fde\u002Fwissen",{"title":30,"href":31},"Über Twentyone","\u002Fde\u002Fueber-uns",{"data":33},{"id":34,"path":18,"slug":35,"published_at":36,"page_type":37,"no_index":40,"fields":41,"blocks":45},677,"agents","2026-06-19T09:21:42.569Z",{"identifier":38,"name":39},"service","Service-Hub",false,{"title":42,"summary":19,"meta_description":43,"meta_title":44},"Hermes Agents as a Service","Hermes-Agents (Nous Research) als gemanagter Dienst auf DGX-Spark-Hardware in der Schweiz. Persistentes Gedächtnis, Tool-Use, Datenhoheit. Kosten und Einsatz.","Hermes Agents as a Service — souverän & gemanagt | Twentyone",[46,73,87,99,111,123,135,155,182],{"id":47,"position":48,"content_type":49,"fields":52},8105,1,{"identifier":50,"name":51},"cluster_grid","Themen-Grid",{"headline":53,"subnav_label":54,"subnav_anchor":55,"items":56},"Hermes Agents im Überblick","Überblick","ueberblick",[57,61,65,69],{"title":58,"description":59,"description_html":60},"Hermes von Nous Research","Offene Modelle, die auf Tool-Use und agentisches Verhalten ausgelegt sind. Kein geschlossenes Blackbox-System.","\u003Cp>Offene Modelle, die auf Tool-Use und agentisches Verhalten ausgelegt sind. Kein geschlossenes Blackbox-System.\u003C\u002Fp>\n",{"title":62,"description":63,"description_html":64},"Persistentes Gedächtnis","Der Agent vergisst nicht nach jedem Aufruf. Kontext und Wissen bleiben über Sitzungen erhalten.","\u003Cp>Der Agent vergisst nicht nach jedem Aufruf. Kontext und Wissen bleiben über Sitzungen erhalten.\u003C\u002Fp>\n",{"title":66,"description":67,"description_html":68},"Tool-Use","Der Agent ruft Funktionen, APIs und Datenquellen auf, statt nur Text zu produzieren. Er handelt, nicht nur antwortet.","\u003Cp>Der Agent ruft Funktionen, APIs und Datenquellen auf, statt nur Text zu produzieren. Er handelt, nicht nur antwortet.\u003C\u002Fp>\n",{"title":70,"description":71,"description_html":72},"Souverän und gemanagt","Läuft auf unserer DGX-Spark-Hardware in der Schweiz. Wir betreiben den Agent, deine Daten bleiben im Land.","\u003Cp>Läuft auf unserer DGX-Spark-Hardware in der Schweiz. Wir betreiben den Agent, deine Daten bleiben im Land.\u003C\u002Fp>\n",{"id":74,"position":75,"content_type":76,"fields":79},8106,2,{"identifier":77,"name":78},"big5_section","TAYA-Sektion",{"pillar":80,"eyebrow":81,"headline":82,"subnav_label":83,"subnav_anchor":84,"body":85,"body_html":86},"cost","Was kostet das?","Was Agents as a Service kostet","Kosten","kosten","Agents rechnen wir monatsweise ab: eine Pauschale für den laufenden Agent samt dem Endpoint, der ihn versorgt. Planbare Kosten statt Abrechnung pro Aufruf.\n\nWas die Pauschale bestimmt: wie gross das Modell dahinter ist, wie viel Kapazität der Agent reserviert und wie viel Gedächtnis er vorhält. Die Ansätze stehen auf der [Preisseite](\u002Fde\u002Fpreise).\n\nWeil wir den Betrieb übernehmen, sparst du dir die versteckten Kosten: Bereitschaft, Monitoring und das Tuning, das ein Agent im Dauerbetrieb braucht.","\u003Cp>Agents rechnen wir monatsweise ab: eine Pauschale für den laufenden Agent samt dem Endpoint, der ihn versorgt. Planbare Kosten statt Abrechnung pro Aufruf.\u003C\u002Fp>\n\n\u003Cp>Was die Pauschale bestimmt: wie gross das Modell dahinter ist, wie viel Kapazität der Agent reserviert und wie viel Gedächtnis er vorhält. Die Ansätze stehen auf der \u003Ca href=\"\u002Fde\u002Fpreise\">Preisseite\u003C\u002Fa>.\u003C\u002Fp>\n\n\u003Cp>Weil wir den Betrieb übernehmen, sparst du dir die versteckten Kosten: Bereitschaft, Monitoring und das Tuning, das ein Agent im Dauerbetrieb braucht.\u003C\u002Fp>\n",{"id":88,"position":89,"content_type":90,"fields":91},8107,3,{"identifier":77,"name":78},{"pillar":92,"eyebrow":93,"headline":94,"subnav_label":95,"subnav_anchor":96,"body":97,"body_html":98},"problems","Passt das zu mir?","Wann ein gemanagter Agent sinnvoll ist","Wann sinnvoll","wann-sinnvoll","Ein gemanagter Agent passt, wenn du eine wiederkehrende Aufgabe automatisieren willst, die mehr als eine Antwort braucht: recherchieren, Werkzeuge bedienen, Zwischenstand merken, weitermachen.\n\nEr ist die falsche Wahl, wenn ein einfacher Prompt an ein Modell reicht. Dann nimmst du einen [Endpoint](\u002Fde\u002Fmanaged-inference) und sparst dir die Agent-Schicht.\n\nEhrlich: Agentische Systeme sind jünger und brauchen mehr Begleitung als ein reiner Endpoint. Wir sagen dir, wenn dein Anwendungsfall dafür noch nicht reif ist.","\u003Cp>Ein gemanagter Agent passt, wenn du eine wiederkehrende Aufgabe automatisieren willst, die mehr als eine Antwort braucht: recherchieren, Werkzeuge bedienen, Zwischenstand merken, weitermachen.\u003C\u002Fp>\n\n\u003Cp>Er ist die falsche Wahl, wenn ein einfacher Prompt an ein Modell reicht. Dann nimmst du einen \u003Ca href=\"\u002Fde\u002Fmanaged-inference\">Endpoint\u003C\u002Fa> und sparst dir die Agent-Schicht.\u003C\u002Fp>\n\n\u003Cp>Ehrlich: Agentische Systeme sind jünger und brauchen mehr Begleitung als ein reiner Endpoint. Wir sagen dir, wenn dein Anwendungsfall dafür noch nicht reif ist.\u003C\u002Fp>\n",{"id":100,"position":101,"content_type":102,"fields":103},8108,4,{"identifier":77,"name":78},{"pillar":104,"eyebrow":105,"headline":106,"subnav_label":107,"subnav_anchor":108,"body":109,"body_html":110},"comparisons","Wie unterscheidet sich das?","Hermes Agents oder eine geschlossene Agent-Plattform","Vergleich","vergleich","**Geschlossene Agent-Plattformen** der grossen Anbieter sind bequem, aber deine Daten und deine Logik liegen in deren Cloud, und du bist an deren Modell gebunden.\n\n**Alles selbst bauen** gibt dir Kontrolle, kostet dich aber den ganzen Unterbau: Modell, Gedächtnis, Tool-Anbindung, Betrieb.\n\n**Hermes Agents bei twentyone** geben dir offene Modelle und Schweizer Datenhoheit, ohne dass du den Unterbau selbst stemmst. Wir betreiben den Agent, du behältst die Hoheit über Daten und Verhalten.","\u003Cp>\u003Cstrong>Geschlossene Agent-Plattformen\u003C\u002Fstrong> der grossen Anbieter sind bequem, aber deine Daten und deine Logik liegen in deren Cloud, und du bist an deren Modell gebunden.\u003C\u002Fp>\n\n\u003Cp>\u003Cstrong>Alles selbst bauen\u003C\u002Fstrong> gibt dir Kontrolle, kostet dich aber den ganzen Unterbau: Modell, Gedächtnis, Tool-Anbindung, Betrieb.\u003C\u002Fp>\n\n\u003Cp>\u003Cstrong>Hermes Agents bei twentyone\u003C\u002Fstrong> geben dir offene Modelle und Schweizer Datenhoheit, ohne dass du den Unterbau selbst stemmst. Wir betreiben den Agent, du behältst die Hoheit über Daten und Verhalten.\u003C\u002Fp>\n",{"id":112,"position":113,"content_type":114,"fields":115},8109,5,{"identifier":77,"name":78},{"pillar":116,"eyebrow":117,"headline":118,"subnav_label":119,"subnav_anchor":120,"body":121,"body_html":122},"reviews","Habt ihr Beispiele?","Unsere eigenen Agents laufen hier","Beispiele","beispiele","Wir betreiben Hermes-Agents für unsere eigene Arbeit, auf derselben Hardware, die du buchst. Das ist der Grund, warum wir überhaupt von Agents as a Service reden: Wir nutzen sie täglich.\n\nWir kennen ihre Stärken und Grenzen aus echten Fällen, nicht aus dem Hochglanzprospekt.","\u003Cp>Wir betreiben Hermes-Agents für unsere eigene Arbeit, auf derselben Hardware, die du buchst. Das ist der Grund, warum wir überhaupt von Agents as a Service reden: Wir nutzen sie täglich.\u003C\u002Fp>\n\n\u003Cp>Wir kennen ihre Stärken und Grenzen aus echten Fällen, nicht aus dem Hochglanzprospekt.\u003C\u002Fp>\n",{"id":124,"position":125,"content_type":126,"fields":127},8110,6,{"identifier":77,"name":78},{"pillar":128,"eyebrow":129,"headline":130,"subnav_label":131,"subnav_anchor":132,"body":133,"body_html":134},"bestof","Was empfehlt ihr?","So startest du mit einem Agent","Empfehlung","empfehlung","Fang mit einer einzigen, klar umrissenen Aufgabe an. Ein Agent, der eine Sache zuverlässig erledigt, ist mehr wert als einer, der vieles halb kann.\n\nGib ihm nur die Werkzeuge, die er wirklich braucht. Jedes zusätzliche Tool ist eine zusätzliche Fehlerquelle.\n\nPlane eine Begleitphase ein. Agentische Systeme werden gut, wenn man sie an echten Fällen beobachtet und nachschärft. Genau das machen wir mit dir, statt dir eine fertige Blackbox hinzustellen.","\u003Cp>Fang mit einer einzigen, klar umrissenen Aufgabe an. Ein Agent, der eine Sache zuverlässig erledigt, ist mehr wert als einer, der vieles halb kann.\u003C\u002Fp>\n\n\u003Cp>Gib ihm nur die Werkzeuge, die er wirklich braucht. Jedes zusätzliche Tool ist eine zusätzliche Fehlerquelle.\u003C\u002Fp>\n\n\u003Cp>Plane eine Begleitphase ein. Agentische Systeme werden gut, wenn man sie an echten Fällen beobachtet und nachschärft. Genau das machen wir mit dir, statt dir eine fertige Blackbox hinzustellen.\u003C\u002Fp>\n",{"id":136,"position":137,"content_type":138,"fields":141},8111,7,{"identifier":139,"name":140},"pricing_teaser","Preis-Teaser",{"eyebrow":24,"headline":142,"body":143,"body_html":144,"cta":145},"Monatlich abgerechnet","Du zahlst eine Monatspauschale für den laufenden Agent samt Endpoint dahinter, planbar statt pro Aufruf. Die Ansätze stehen offen auf der Preisseite.","\u003Cp>Du zahlst eine Monatspauschale für den laufenden Agent samt Endpoint dahinter, planbar statt pro Aufruf. Die Ansätze stehen offen auf der Preisseite.\u003C\u002Fp>\n",{"type":146,"label":147,"target":148,"page":149,"url":25},"internal","Preise ansehen",null,{"id":150,"slug":151,"path":25,"page_type":152,"published":153,"type":154},678,"preise","page",true,"Cms::Page",{"id":156,"position":157,"content_type":158,"fields":161},8112,8,{"identifier":159,"name":160},"faq_list","FAQ-Liste",{"headline":162,"subnav_label":163,"subnav_anchor":164,"items":165},"Häufige Fragen zu Hermes Agents","FAQs","faqs",[166,170,174,178],{"question":167,"answer":168,"answer_html":169},"Was ist Hermes?","Eine Familie offener Modelle von Nous Research, die auf Tool-Use und agentisches Verhalten ausgelegt sind.","\u003Cp>Eine Familie offener Modelle von Nous Research, die auf Tool-Use und agentisches Verhalten ausgelegt sind.\u003C\u002Fp>\n",{"question":171,"answer":172,"answer_html":173},"Wo läuft der Agent?","Auf unserer DGX-Spark-Hardware in der Schweiz. Daten und Gedächtnis des Agents bleiben im Land.","\u003Cp>Auf unserer DGX-Spark-Hardware in der Schweiz. Daten und Gedächtnis des Agents bleiben im Land.\u003C\u002Fp>\n",{"question":175,"answer":176,"answer_html":177},"Kann der Agent auf meine Systeme zugreifen?","Nur auf die Werkzeuge und Datenquellen, die du ihm freigibst. Du bestimmst, was er darf.","\u003Cp>Nur auf die Werkzeuge und Datenquellen, die du ihm freigibst. Du bestimmst, was er darf.\u003C\u002Fp>\n",{"question":179,"answer":180,"answer_html":181},"Betreibt ihr den Agent oder muss ich das?","Wir betreiben ihn. Du bekommst das Ergebnis und behältst die Hoheit über Daten und Verhalten.","\u003Cp>Wir betreiben ihn. Du bekommst das Ergebnis und behältst die Hoheit über Daten und Verhalten.\u003C\u002Fp>\n",{"id":183,"position":184,"content_type":185,"fields":188},8113,9,{"identifier":186,"name":187},"cta","CTA Block",{"headline":189,"subline":190,"cta":191,"mode":197},"Ein Agent, der wirklich etwas erledigt","Beschreib uns die Aufgabe, die du automatisieren willst. Wir sagen dir, ob ein Agent der richtige Weg ist.",{"type":146,"label":192,"target":148,"page":193,"url":196},"Kontakt aufnehmen",{"id":194,"slug":195,"path":196,"page_type":152,"published":153,"type":154},682,"kontakt","\u002Fde\u002Fkontakt","dark",[199,206],{"title":200,"links":201},"Leistungen",[202,203,204,205],{"title":5,"href":6},{"title":9,"href":10},{"title":13,"href":14},{"title":17,"href":18},{"title":207,"links":208},"Unternehmen",[209,210,211,212],{"title":30,"href":31},{"title":27,"href":28},{"title":24,"href":25},{"title":213,"href":196},"Kontakt",[215,224,235,242,249,256,263,270,276,282,288,295,301,307,313,319,325,332],{"path":216,"slug":217,"title":218,"summary":219,"image":148,"publication_date":220,"big5_category":104,"hubs":221},"\u002Fde\u002Fwissen\u002Fazure-openai-bedrock-alternative-schweiz","azure-openai-bedrock-alternative-schweiz","Souveräne Inferenz gegen Azure OpenAI und AWS Bedrock: was sich im Alltag ändert","Azure OpenAI und AWS Bedrock gegen einen souverän betriebenen Endpoint: warum der Schweizer Serverstandort der Hyperscaler das Kernproblem nicht löst und was der Unterschied im Betrieb bedeutet.","2026-07-13T00:00:00Z",[222],{"slug":223,"title":13},"managed-inference",{"path":225,"slug":226,"title":227,"summary":228,"image":148,"publication_date":220,"big5_category":128,"hubs":229},"\u002Fde\u002Fwissen\u002Fbeste-gpu-llm-inferenz","beste-gpu-llm-inferenz","Die beste GPU für LLM-Inferenz: DGX Spark, H100, L40S und RTX im Vergleich","Welche GPU für eigene Inferenz? DGX Spark, H100, L40S und RTX 4090 nach dem, was zählt: wie viel Modell hineinpasst, wie viel Durchsatz herauskommt und was der Monat kostet.",[230,233],{"slug":231,"title":232},"bare-metal","Bare Metal GPU mit Root-Zugriff",{"slug":234,"title":5},"dgx-spark",{"path":236,"slug":237,"title":238,"summary":239,"image":148,"publication_date":220,"big5_category":116,"hubs":240},"\u002Fde\u002Fwissen\u002Fhermes-agent-erfahrungsbericht","hermes-agent-erfahrungsbericht","Hermes-Agent im Realbetrieb: was ein souveräner Agent wirklich leistet","Ein Erfahrungsbericht statt Hochglanzprospekt: wie sich ein souverän betriebener Hermes-Agent im täglichen Einsatz verhält, wo er glänzt und wo die Begleitung anfängt.",[241],{"slug":35,"title":42},{"path":243,"slug":244,"title":245,"summary":246,"image":148,"publication_date":220,"big5_category":92,"hubs":247},"\u002Fde\u002Fwissen\u002Fki-regulierte-daten-schweiz","ki-regulierte-daten-schweiz","KI mit regulierten Daten: LLMs nutzen, ohne dass die Daten die Schweiz verlassen","Für Branchen, in denen Daten das Land nicht verlassen dürfen: was revDSG, Berufsgeheimnis und der CLOUD Act für KI-Projekte bedeuten, und wie souveräne Inferenz den Rahmen einhält.",[248],{"slug":223,"title":13},{"path":250,"slug":251,"title":252,"summary":253,"image":148,"publication_date":220,"big5_category":80,"hubs":254},"\u002Fde\u002Fwissen\u002Fopenai-api-kosten-vs-eigener-endpoint","openai-api-kosten-vs-eigener-endpoint","Ab welchem Volumen sich ein eigener Endpoint gegen die API rechnet","Die Pay-per-Token-API ist günstig, bis sie es nicht mehr ist. Wo genau der Break-even zu einem reservierten Endpoint mit fester Monatspauschale liegt, an einem konkreten Beispiel durchgerechnet.",[255],{"slug":223,"title":13},{"path":257,"slug":258,"title":259,"summary":260,"image":148,"publication_date":261,"big5_category":104,"hubs":262},"\u002Fde\u002Fwissen\u002Ffine-tuning-rag-prompt","fine-tuning-rag-prompt","Fine-Tuning, RAG oder besserer Prompt? Die klare Entscheidungsregel","Fine-Tuning ist meistens nicht die Antwort auf „das Modell kennt unsere Daten nicht“. Wann Prompting, RAG oder Fine-Tuning wirklich das richtige Werkzeug sind und wie du die Eskalationsleiter korrekt durchläufst.","2026-07-07T00:00:00Z",[],{"path":264,"slug":265,"title":266,"summary":267,"image":148,"publication_date":261,"big5_category":268,"hubs":269},"\u002Fde\u002Fwissen\u002Fopenai-api-migration","openai-api-migration","Von der OpenAI-API zu souveräner Inferenz: die Migration in der Praxis","Der Umstieg von OpenAI oder Anthropic auf ein selbst betriebenes offenes Modell in der Schweiz sieht dank OpenAI-kompatibler Endpoints nach einer Ein-Zeilen-Änderung aus, ist aber doch mehr. Wo Prompts, Tool-Calling und Feature-Lücken zur Stolperfalle werden.","how-to",[],{"path":271,"slug":272,"title":273,"summary":274,"image":148,"publication_date":261,"big5_category":92,"hubs":275},"\u002Fde\u002Fwissen\u002Fquantisierung-int4-int8-awq-gptq-gguf","quantisierung-int4-int8-awq-gptq-gguf","Quantisierung ohne Qualitätsverlust: int4, int8, AWQ, GPTQ, GGUF entzaubert","int8 ist fast immer verlustfrei, int4 meistens auch, aber nicht bei Reasoning, Code und langen Agenten-Ketten. Wir zeigen dir ungeschönt, was Quantisierung wirklich kostet und wo GPTQ, AWQ, GGUF und bitsandbytes hingehören.",[],{"path":277,"slug":278,"title":279,"summary":280,"image":148,"publication_date":261,"big5_category":92,"hubs":281},"\u002Fde\u002Fwissen\u002Frag-schlechte-antworten","rag-schlechte-antworten","RAG richtig gebaut: warum eure Wissensbasis schlechte Antworten gibt","Die meisten RAG-Systeme scheitern nicht am Sprachmodell, sondern am Retrieval davor. Wir zeigen die häufigsten Fehlerquellen bei Chunking, Embeddings und Retrieval-Strategie sowie, wie du Retrieval- und Generationsfehler sauber auseinanderhältst.",[],{"path":283,"slug":284,"title":285,"summary":286,"image":148,"publication_date":261,"big5_category":268,"hubs":287},"\u002Fde\u002Fwissen\u002Fvram-modell-gpu-berechnen","vram-modell-gpu-berechnen","Welches Modell passt auf welche GPU? VRAM richtig berechnen","Bevor du GPUs kaufst oder mietest: die Faustformel für Gewichte, KV-Cache und Overhead, damit du weisst, welches Modell wirklich auf deine Hardware passt.",[],{"path":289,"slug":290,"title":291,"summary":292,"image":148,"publication_date":293,"big5_category":92,"hubs":294},"\u002Fde\u002Fwissen\u002Fagent-oder-endpoint","agent-oder-endpoint","Braucht ihr wirklich einen Agent oder reicht ein Endpoint?","Agenten sind im Trend, aber oft die teurere und fragilere Lösung für ein Problem, das ein einfacher Endpoint löst. Wann sich der Aufwand lohnt und wann nicht.","2026-06-30T00:00:00Z",[],{"path":296,"slug":297,"title":298,"summary":299,"image":148,"publication_date":293,"big5_category":92,"hubs":300},"\u002Fde\u002Fwissen\u002Fdatenhoheit-was-bedeutet-das","datenhoheit-was-bedeutet-das","Was Datenhoheit konkret heisst und wo deine Prompts wirklich landen","Datenhoheit ist mehr als ein Hosting-Standort. Was rechtlich, technisch und vertraglich dahintersteckt, und welche Fragen du jedem AI-Anbieter stellen solltest.",[],{"path":302,"slug":303,"title":304,"summary":305,"image":148,"publication_date":293,"big5_category":116,"hubs":306},"\u002Fde\u002Fwissen\u002Fdgx-spark-erfahrungsbericht","dgx-spark-erfahrungsbericht","DGX Spark im Betrieb: was die Maschine nach drei Monaten wirklich kann","Kein Datenblatt, sondern ein Erfahrungsbericht. Wo die DGX Spark im täglichen Betrieb glänzt, wo ihre Grenzen liegen und für wen sich die Maschine lohnt.",[],{"path":308,"slug":309,"title":310,"summary":311,"image":148,"publication_date":293,"big5_category":268,"hubs":312},"\u002Fde\u002Fwissen\u002Fllm-endpoint-aufsetzen","llm-endpoint-aufsetzen","Eigenen LLM Endpoint aufsetzen: von der GPU zum ersten Token","Ein realistischer Weg vom blanken Server zum produktiven Inferenz-Endpoint. Die Schritte, die Reihenfolge und die Stolpersteine, die zwischen „läuft lokal“ und „läuft produktiv“ liegen.",[],{"path":314,"slug":315,"title":316,"summary":317,"image":148,"publication_date":293,"big5_category":128,"hubs":318},"\u002Fde\u002Fwissen\u002Foffene-modelle-auswahl","offene-modelle-auswahl","Welches offene Modell für welche Aufgabe? Llama, Qwen, Mistral & Co.","Nicht das grösste Modell gewinnt, sondern das passende. Wie du offene Modelle nach Aufgabe, Speicherbedarf und Lizenz auswählst, statt Benchmarks hinterherzulaufen.",[],{"path":320,"slug":321,"title":322,"summary":323,"image":148,"publication_date":293,"big5_category":104,"hubs":324},"\u002Fde\u002Fwissen\u002Fvllm-ollama-tgi-vergleich","vllm-ollama-tgi-vergleich","vLLM, Ollama oder TGI: welche Inference Engine für welchen Fall","Die Engine entscheidet über Durchsatz, Latenz und Betriebsaufwand. Ein nüchterner Vergleich der drei verbreitetsten Optionen, inklusive der Fälle, in denen die einfache Lösung gewinnt.",[],{"path":326,"slug":327,"title":328,"summary":329,"image":148,"publication_date":330,"big5_category":104,"hubs":331},"\u002Fde\u002Fwissen\u002Fdgx-spark-vs-cloud-gpu","dgx-spark-vs-cloud-gpu","DGX Spark gegen Cloud-GPU: wann sich eigene Hardware lohnt","Unified Memory gegen rohen Durchsatz, Schweizer Hardware gegen Hyperscaler. Ein nüchterner Vergleich, inklusive der Fälle, in denen die Cloud gewinnt.","2026-06-18T00:00:00Z",[],{"path":333,"slug":334,"title":335,"summary":336,"image":148,"publication_date":330,"big5_category":80,"hubs":337},"\u002Fde\u002Fwissen\u002Fllm-selbst-betreiben-kosten","llm-selbst-betreiben-kosten","Was kostet es, ein LLM selbst zu betreiben?","Die nüchterne Rechnung hinter eigenen LLM-Endpoints: Hardware, Betrieb und der Punkt, ab dem sich Selbermachen wirklich lohnt.",[]]