KI-Beratung · On-Premise-KI · Lösungen

Künstliche Intelligenz, die Ihnen gehört.

Beraten. Umsetzen. Souverän betreiben.

Wir begleiten ein KI-Vorhaben über alle drei Stufen: Wir beraten herstellerunabhängig, was sich lohnt, bauen das System mit Open-Weights-Modellen auf und betreiben es weiter – beim Kunden vor Ort oder gehostet in Europa. Sie entscheiden, wo die Daten liegen; wir dokumentieren, was diese Wahl für Kosten, Betrieb und Datenschutz bedeutet.

✓ 100 % herstellerunabhängig ✓ Kein Cloud-Zwang ✓ DSGVO-konform ✓ Open-Weights Modelle ✓ Infrastruktur in Europa
Leistungen

KI – praxisnah und wertschöpfend

Wir bieten drei Dinge: herstellerunabhängige Beratung – Potenzial- und Reifegrad-Analyse, Use-Case-Bewertung, Roadmap –, On-Premise-KI mit GPU-Server-Hardware und Installation vor Ort samt lokal laufenden Open-Weights-LLMs sowie fertige Lösungen mit Schulung, vom RAG-Wissensassistenten bis zum Prompt-Engineering. Jedes davon ist einzeln beauftragbar und jede Empfehlung bleibt ohne Produktbindung.

KI-Beratung

Potenzialanalyse, Kosten-Nutzen, Roadmap – unabhängige Empfehlungen ohne Produktbindung.

  • Potenzial- & Reifegrad-Analyse
  • Use-Case-Bewertung
  • Roadmap & Konzeption

On-Premise-KI

Lokale KI-Systeme, direkt beim Kunden vor Ort aufgesetzt – die Daten bleiben vollständig im Haus.

  • GPU-Server Hardware & Installation vor Ort
  • Open-Weights LLMs lokal
  • Integration in Ihre Systeme

Lösungen & Schulung

Konkrete Anwendungen, Prompt-Engineering und Team-Enablement – damit KI ankommt.

  • RAG & Wissensassistenten
  • Workshops & Schulungen
  • Compliance & Governance
US-Cloud · Nokkela gehostet · On-Premise

Drei Wege zu souveräner KI

Wir stellen drei Wege gegenüber, damit die Entscheidung auf Fakten fällt und nicht auf Hype. US-Cloud-KI startet schnell, führt Daten aber aus Europa heraus; unsere gehostete Variante hält sie in Rechenzentren in Europa bei planbaren Kosten; On-Premise hält alles im eigenen Haus, Air-Gapped-Betrieb möglich, dafür mit Einmal-Investition in Hardware.

KriteriumUS-Cloud-KInokkela.ai · gehostetOn-Premise (beim Kunden)
Betrieb / StandortUS-Cloud, weltweitRechenzentren in EuropaBeim Kunden vor Ort
DatenhoheitDaten verlassen EuropaDaten bleiben in EuropaDaten bleiben im Haus
DSGVODrittland-Transfer kritischDSGVO-konform (EU)Ohne externe Verarbeitung
KostenmodellPro Token / AboPlanbar (Pro Token / Paket)Einmal-Invest + Betrieb
AnbieterbindungHoch (Lock-in)Offen (Nokkela Fine-Tuned Open-Weights & diverse Externe)Offen, volle Kontrolle
Offline-BetriebNeinNein (gehostet)Air-Gapped möglich
Use Cases

Wo KI heute Wert schafft

Wir setzen dort an, wo der Nutzen heute messbar ist: internes Wissen per RAG durchsuchbar machen, Rechnungen, Verträge und E-Mails automatisch erfassen, Support und FAQ unterstützen, Auswertungen und Reports erstellen, Texte mit Qualitätskontrolle entwerfen und Workflows automatisieren – oft zusammen mit nokkela.io. Jeden Anwendungsfall bewerten wir vorab nach Aufwand und Nutzen, damit nichts zum Selbstzweck automatisiert wird.

Wissensmanagement

Interne Dokumente durchsuchbar machen (RAG) – Antworten statt Suchen.

Dokumentenverarbeitung

Rechnungen, Verträge, E-Mails automatisch erfassen und strukturieren.

Kundenkommunikation

Assistenz für Support, FAQ-Bots und Textentwürfe.

Datenanalyse

Muster erkennen, Reports erstellen, Entscheidungen unterstützen.

Content-Erstellung

Marketing- und Fachtexte effizient mit Qualitätskontrolle.

Automatisierung

Workflows verschlanken – oft im Zusammenspiel mit nokkela.io.

Modelle

Bewährte Open-Weights Modelle

Wir wählen das Modell nach der Aufgabe, nicht nach einer Herstellerbeziehung: Mistral, Qwen, Gemma 4, GPT-OSS, Nemotron und DeepSeek laufen alle lokal und GPU-beschleunigt. Modelle für Audio wie Whisper und Kokoro decken Spracherkennung und Sprachausgabe ab. Weil die Gewichte offen sind, bleibt das Modell auf Ihrer eigenen Hardware lauffähig – ohne Bindung an einen einzelnen Anbieter.

Mistral Nemotron GPT-OSS Gemma 4 Qwen MiniMax DeepSeek GLM MiMo Kimi-K2 Phi Whisper (STT) Kokoro (TTS) Voxtral (TTS)
Häufige Fragen

Fragen zu KI-Beratung

Hier finden Sie die Fragen, die uns zu diesem Bereich am häufigsten gestellt werden. Jede Antwort ist so geschrieben, dass sie für sich lesbar und auch einzeln zitiert korrekt bleibt.

Was bedeutet Open Weights und warum setzt nokkela.ai darauf statt auf eine Cloud-KI-API?

Open-Weights-Modelle sind Modelle, deren trainierte Parameter zum Download veröffentlicht sind – nokkela.ai kann sie deshalb auf Hardware betreiben, die unter Ihrer Kontrolle steht, statt eine fremde API aufzurufen. Erst das macht On-Premise und das Hosting in Europa möglich: Das Modell liegt neben Ihren Daten. Die Lizenzbedingungen unterscheiden sich je Modell; wir prüfen sie für Ihren Einsatzzweck und benennen das Modell im Konzept.

Mit welchen Open-Weights-Modellen arbeitet nokkela.ai und wie wird das passende ausgewählt?

nokkela.ai arbeitet mit einem breiten Katalog an Open-Weights-Modellen – darunter Mistral, Qwen, Gemma 4, GPT-OSS, Nemotron, DeepSeek, GLM, MiMo, MiniMax, Kimi-K2 und Phi – dazu Audio-Modelle wie Whisper für die Spracherkennung und Kokoro für die Sprachausgabe. Die Auswahl erfolgt herstellerunabhängig: Anwendungsfall, beteiligte Sprachen, geforderte Antwortqualität und verfügbarer GPU-Speicher entscheiden. Die engere Auswahl testen wir an Ihrem eigenen Material, bevor wir uns festlegen.

Welche Hardware und Infrastruktur braucht ein On-Premise-KI-System?

Ein On-Premise-KI-System von nokkela.ai braucht einen GPU-Server, einen lokalen Inferenz-Dienst und die Integration in Ihre bestehenden Systeme; die Hardware legen wir aus, beschaffen sie und installieren sie beim Kunden vor Ort. Die Dimensionierung folgt der Last: Größe des gewählten Modells und Zahl gleichzeitiger Nutzer bestimmen den nötigen GPU-Speicher. Das legen wir im Konzept fest; Netzwerk, Storage und Backup planen wir mit.

Kann ein On-Premise-KI-System komplett offline ohne Internetverbindung laufen?

Ein On-Premise-KI-System von nokkela.ai lässt sich air-gapped betreiben, denn das Open-Weights-Modell und der Suchindex liegen auf Ihrer eigenen Hardware; keine Anfrage geht an eine externe API. Modelldateien, Inferenz-Stack und Updates bringen wir über Ihren eigenen Change-Prozess ein statt per Live-Download. Die gehostete Variante kann das nicht – sie läuft in Rechenzentren in Europa und braucht eine Verbindung.

Worin unterscheidet sich die gehostete Variante von nokkela.ai vom Betrieb im eigenen Haus?

nokkela.ai bietet beides: Gehostet laufen die Modelle in Rechenzentren in Europa, On-Premise laufen sie auf Ihrer Hardware im eigenen Haus. Gehostet bleiben die Kosten planbar – pro Token oder als Paket – und Sie investieren nicht in Hardware; On-Premise bedeutet Einmal-Investition plus Betrieb, dafür verlassen die Daten das Haus nie und Offline-Betrieb ist möglich. Beide Wege vermeiden den Drittland-Transfer in eine US-Cloud.

Wie funktioniert ein RAG-Wissensassistent und welche Daten benötigen Sie dafür von uns?

Ein RAG-Wissensassistent von nokkela.ai durchsucht zuerst Ihre eigenen Dokumente und lässt das Sprachmodell dann auf Basis der gefundenen Passagen antworten – Mitarbeitende bekommen Antworten statt Trefferlisten. Von Ihnen brauchen wir Zugang zu den Dokumentquellen – Dateiablagen, Wikis, Ticketsysteme, Verträge – und Ihre Berechtigungen, denn der Assistent muss die bestehenden Zugriffsrechte einhalten. Wir starten mit einem klar abgegrenzten Dokumentenbestand statt mit allem auf einmal.

Werden unsere Prompts und Dokumente zum Training von Modellen genutzt und wo landen sie?

Bei nokkela.ai bleibt alles, was in ein On-Premise-System eingeht, in Ihrem Netz: Das Modell läuft auf Ihrer eigenen Hardware, Prompts, Dokumente und der daraus gebaute Index gehen also an keinen externen Anbieter und stehen für fremdes Training nicht zur Verfügung. In der gehosteten Variante wird auf Infrastruktur in Europa verarbeitet statt bei einem US-Anbieter. Wird ein Fremdmodell gebraucht, benennen wir es samt Bedingungen vorab im Konzept.

Kontakt & Beratung

Sprechen wir über Ihren KI-Anwendungsfall

Wir beginnen mit einem kostenlosen Erstgespräch von bis zu 30 Minuten: Sie schildern den Anwendungsfall, wir sagen ehrlich, ob KI das richtige Mittel ist und welcher Weg – gehostet oder On-Premise – passt. Auf Anfragen antworten wir in der Regel binnen eines Werktags. Ein schriftliches Konzept mit Umfang und Kosten folgt, bevor umgesetzt wird.

nokkela.ai – ein Dienst der Nokkela-IT-Concept GmbH

E-Mail: contact@nokkela-it-concept.com

KI-Agenten gewünscht? nokkela.io

Antwort i. d. R. binnen 1 Werktag Keine Weitergabe an Dritte

* Pflichtfelder. Ihre Daten werden ausschließlich zur Bearbeitung genutzt.