Begrenzte Agenten, die echte Arbeit leisten, mit Logs, denen Sie vertrauen können.
Agenten-Demos sind einfach. Agenten, die den Kontakt mit echten Daten, echten Berechtigungen und echten Randfällen überleben, sind es nicht. Ich baue begrenzte Agenten, die Tools nutzen, Berechtigungen respektieren, jede Aktion loggen und an einen Menschen übergeben, wenn sie es sollten. Angeschlossen an Ihre Workflows, gemessen mit Evals — und sicher genug für echte Arbeit.
Fester Projektpreis, zugeschnitten auf den Agenten. Komplexität (Tools, Autonomie, Integrationen) bestimmt die Spanne.
Die meisten Agenten-Demos erreichen nie die Produktion.
Die Lücke zwischen einer Demo und einem deployten Agenten heißt Berechtigungen, Logging, Evals und Fehlerbehandlung. Eine Demo beantwortet einen Happy-Path-Prompt. Ein Produktions-Agent muss wissen, was er darf, beweisen, was er getan hat, und sicher scheitern, wenn der Input seltsam ist. Diese Lücke ist die Arbeit.
Begrenzte Agenten mit Tool-Nutzung, Berechtigungen, Logs, Evals und Freigabe.
Zugeschnitten auf einen echten Job, ausgestattet nur mit den Tools und Berechtigungen, die er braucht — und so instrumentiert, dass Sie jeden Lauf sehen und ihm vertrauen können.
Received escalation from the WhatsApp channel.
Order #8412 shipped twice — drafting a refund for the duplicate.
Illustrativ: das Lauf-Log, das jeder begrenzte Agent schreibt
Wenige Schritte, jeder einzelne überprüfbar.
Jede Phase liefert ihre eigenen Ergebnisse — Sie sehen den Fortschritt und können nachsteuern, bevor die nächste beginnt.
Job abgrenzen
Wir definieren genau, was der Agent tut, was er anfassen darf und wo ein Mensch in der Schleife bleibt.
Agent bauen
Ich baue den Agenten, seine Tools und seine Guardrails gegen Ihre echten Systeme.
Instrumentieren und evaluieren
Logging, Tool-Call-Historie und eine Eval-Suite kommen hinein, damit Qualität gemessen wird statt angenommen.
Shippen und besitzen
Der Agent und seine Instrumentierung gehören Ihnen. Ein optionaler Retainer hält die Evals ehrlich, wenn er skaliert.
Ich verkaufe keine autonome Belegschaft. Ich verkaufe begrenzte Agenten, die funktionieren.
Keine Agenten-Armee, keine KI-Mitarbeiter, keine autonome Firma. Begrenzte Agenten mit Logs, Berechtigungen, Freigaben — und einer Zahl dafür, wie gut sie den Job machen.
Ich berate nicht über KI von außen. Ich baue diese Systeme zuerst in meinen eigenen Produkten, lebe mit den Fehlermodi und baue die Teile neu, die unter echten Nutzern brechen. Die Muster, die ich in Ihren Build einbringe, habe ich in meinen eigenen bereits bezahlt.
Ein Projektpreis. Zugeschnitten auf den Job.
Fester Projektpreis, zugeschnitten auf den Agenten. Komplexität (Tools, Autonomie, Integrationen) bestimmt die Spanne.
Ein begrenzter Produktions-Agent mit Tools, Berechtigungen, Logs und Evals.
Multi-Tool-, autonome oder tief integrierte Agenten liegen höher in der Spanne.
Bevor Sie anfragen
Starten Sie mit einem kurzen Gespräch. Eine klare Antwort, so oder so.
Wir klären die Passung, definieren den Umfang und entscheiden, ob wir mit dem Intensive starten oder direkt in den Build gehen.
Ein Brief, jeden Sonntag. Funktionierende Systeme, keine heißen Takes.
Build-Logs, funktionierende Systeme und Feldnotizen aus einem Portfolio laufender KI-Ventures.