KI-Assistenten und Chatbots
Ein Assistent, der aus Ihren Daten antwortet, nicht aus Vermutungen.
Retrieval über Ihren eigenen Katalog, Ihre Dokumentation oder Richtlinien, mit Übergabe an einen Menschen und einem Protokoll des Gesagten. Ausgespielt im Shop, im Hilfebereich oder in einem Messenger.
Projektpreis
Ab 1.750 €
Das deckt einen Assistenten auf einem Kanal ab, der aus einer gepflegten Quelle antwortet, mit Übergabe an einen Menschen. Weitere Kanäle, Bestellabfragen und ein mehrsprachiger Bestand laufen bis 7.500 €.
Schicken Sie die Beschreibung, Sie bekommen eine Zahl zurück.
Projekt beschreibenDer Bot antwortet selbstbewusst und liegt falsch
Der Assistent wurde eingeführt, um den Support zu entlasten. Er antwortet sofort, und genau das ist das Problem: Er erfindet eine Rückgabefrist, die es nicht gibt, nennt einen Preis, der sich im Frühjahr geändert hat, und verspricht Lieferung in ein Land, in das Sie nicht liefern. Der Support bearbeitet jetzt die ursprünglichen Anfragen plus die, die der Bot erzeugt hat. Gleichzeitig kann niemand sehen, was er tatsächlich gesagt hat, weil es kein brauchbares Protokoll gibt, und niemand kann ihm ein Thema verbieten, weil er nie eine verbindliche Quelle bekommen hat.
Was gebaut wird
Antworten aus Ihrem eigenen Material
Katalog, Richtlinien und Hilfeartikel, indiziert und synchron gehalten. Der Assistent antwortet aus gefundenen Passagen und nennt sie, damit eine Antwort geprüft und nicht geglaubt werden muss.
Ein Themenrahmen, an den er sich hält
Fragen außerhalb des Rahmens bekommen eine kurze ehrliche Antwort und einen Weg zu einem Menschen statt einer flüssigen Vermutung. Was außerhalb liegt, ist eine Liste, die Sie freigeben, und keine Stimmung des Modells.
Übergabe und Protokoll
Ein Weg zu einer Person mit angehängtem Gesprächsverlauf, damit Kundinnen und Kunden sich nicht wiederholen. Jedes Gespräch gespeichert und durchsuchbar, damit Sie nachlesen können, was letzte Woche gesagt wurde, und die Quelle korrigieren statt der Formulierung.
Warum es so gebaut wird
Grounding ist eine Steuerung, keine Technik
Ein Assistent, der aus gefundenen Dokumenten antwortet, wird korrigiert, indem man ein Dokument ändert. Einer, der aus dem Modell antwortet, lässt sich nur durch Diskussion korrigieren. Das erste ist ein Supportprozess, das zweite ein dauerhaftes Risiko.
Eskalation ist eine Funktion, kein Versagen
Der Wert liegt in den Fragen, die der Assistent abschließt, nicht in denen, die er nicht loslässt. Eine schnelle saubere Übergabe bei den schweren Fällen ist es, was das Vertrauen in die leichten erhält.
Wie es abläuft
Ein Blick darauf, was Kundinnen und Kunden tatsächlich fragen, entnommen aus Ihren bestehenden Tickets statt ausgedacht, und aufgeteilt in das, was ein Assistent beantworten soll, was er übergeben soll und was er nie anfassen darf.
Die verbindliche Quelle zusammengestellt: welche Dokumente, welche Katalogfelder, wer sie verantwortet und wie sie aktualisiert werden. Nichts wird aus Material beantwortet, das niemand pflegt.
Der Assistent mit Retrieval, Quellenangabe und Themenliste gebaut und gegen die echten Fragen aus dem ersten Schritt getestet, bevor ihn jemand zu sehen bekommt.
Ausspielung zuerst auf einem Kanal, mit Übergabe dorthin, wo Ihr Team ohnehin arbeitet, und einer durchsuchbaren Protokollansicht.
Zwei Wochen gemeinsames Lesen der Protokolle, dann eine Runde Korrekturen an der Quelle. Daher kommt die Genauigkeit, und das ist eingeplant statt erhofft.
Hintergrund
Warum die meisten Shop-Assistenten enttäuschen
Das Problem ist meist der Bestand, nicht das Modell
Assistenten scheitern an veralteten Rückgaberegeln, geänderten Preisen und Versandregeln, die nur in einem Kopf existieren. Das Modell tut genau das, worum es gebeten wurde, mit dem Material, das es bekommen hat, und keine Prompt-Arbeit repariert ein Dokument, das seit dem Launch niemand angefasst hat.
Quellenangaben machen aus der Blackbox einen Prozess
Wenn eine Antwort auf die Passage zeigt, aus der sie stammt, wird eine falsche Antwort zu einem Ticket gegen ein Dokument. Der Support korrigiert das in Minuten, ohne Entwicklung, und die Korrektur gilt für jedes weitere Gespräch.
Am Themenrahmen wird der Assistent gemessen
Man verzeiht einem Assistenten, der sagt, dass er es nicht weiß, und einen Menschen holt. Man verzeiht keinem, der sicher klingt und eine Lieferung kostet. Vorher festzulegen, worüber er nicht spricht, ist die günstigste Qualitätsverbesserung, die es gibt.
Protokolle sind die Roadmap
Was Kundschaft einen Assistenten fragt, ist ein saubereres Signal als jede Umfrage: unaufgefordert, in eigenen Worten, im Moment der Kaufabsicht. Zwei Wochen davon zu lesen ändert den Plan für die Website meist stärker als den für den Bot.
Verwandte Leistungen
LLM-Integration
Ein Modell in Ihrem Produkt, mit Kosten und Fehlern unter Kontrolle.
Personalisierung und Empfehlungen
Empfehlungen aus Ihren eigenen Daten statt aus einem gemieteten Widget.
WhatsApp Business API
Bestellupdates und Support in der App, die Ihre Kunden ohnehin nutzen.
86 Leistungen
Projekt beschreiben
Sagen Sie, was vorhanden ist und was sich ändern soll. Innerhalb von zwei Werktagen bekommen Sie eine schriftliche Kalkulation: den Umfang nach Teilen aufgeschlüsselt mit einem Preis je Teil, oder die Fragen, die dafür noch fehlen. Kein Kennenlerngespräch dazwischen.
Fragen
Assistenten, gefragt und beantwortet
Er kann es, deshalb ist er so gebaut, dass er nur aus gefundenem Material antwortet und deutlich sagt, wenn er nichts hat. Das Restrisiko ist eine richtig klingende Antwort aus einem veralteten Dokument, und dagegen hilft die Pflege der Dokumente, nicht das Tunen des Modells.
Ja, über Ihre eigene API, mit vorher geprüfter Identität und einem Werkzeug, das nur zeigt, was diese Kundin sehen darf. Dieser Teil wird bewusst langsam gebaut: Ein Assistent, der Bestelldaten lesen kann, kann sie bei nachlässiger Einschränkung auch preisgeben.
Der, den Ihre Kundschaft ohnehin am meisten nutzt, meist der Shop oder der Hilfebereich. Ein Kanal richtig gemacht schlägt drei halb verkabelte, und der zweite ist günstig, sobald die Retrieval-Schicht steht.
So viele, wie Ihr Quellmaterial abdeckt. Die Grenze ist nicht das Modell, sondern ob Richtlinien und Katalog in dieser Sprache existieren; sonst übersetzt der Assistent im Betrieb und verliert dabei still die Details, auf die es ankommt.
Pro Gespräch, und das wird während des Baus gemessen statt hinterher geschätzt. Retrieval hält die Prompts klein, Caching fängt die Wiederholungsfragen ab, und ein Tageslimit verhindert, dass ein fehlerhaftes Skript aus Traffic eine Rechnung macht.