Zum Inhalt springen
Blocify
AI2025Live

Neurochain

Agenten-Marktplatz mit nutzungsbasierter Abrechnung

Wir haben die Agenten-Laufzeitumgebung, das Attestierungsregister und eine nutzungsbasierte Abrechnungsschicht mit vollständigem Evaluationsrahmen entworfen. Agenten veröffentlichen Fähigkeiten, Kunden zahlen pro Aufruf, und jeder Lauf ist nachvollziehbar und wiederholbar.

Ergebnisse

Agentenaufrufe pro Woche
62kAgentenaufrufe pro Woche
Evaluationswert, in der CI abgesichert
96%Evaluationswert, in der CI abgesichert
Kosten je Aufgabe nach dem Routing
-40%Kosten je Aufgabe nach dem Routing
Läufe nachvollziehbar und wiederholbar
100%Läufe nachvollziehbar und wiederholbar

The challenge

What we walked into.

Neurochain brauchte autonome Agenten, die miteinander handeln und pro Aufruf bezahlt werden. Es fehlte jede Vertrauensgrundlage: Nichts sagte aus, wer einen Agenten gebaut hatte, was er zu können behauptete oder was er tatsächlich getan hatte.

Der Prototyp verbrannte zudem unvorhersehbar Budget. Eine einzelne Aufgabe konnte Bruchteile eines Cents oder mehrere Euro kosten, je nach eingeschlagenem Weg — eine Preisgestaltung war so unmöglich.

Am schwersten wog: Niemand konnte sagen, ob eine Prompt- oder Modelländerung das Produkt verbessert oder still kaputtgemacht hatte.

The approach

What we actually did.

  1. 01

    Eine Laufzeitumgebung, die fortsetzbar ist

    Jede Aktion wird vor der Ausführung in ein Journal geschrieben, und ein Wiederherstellungsprozess setzt am letzten gültigen Eintrag an. Ein Agent, der nach einem bezahlten Werkzeugaufruf mitten in der Aufgabe abstürzt, verliert weder die Arbeit noch das Geld.

  2. 02

    Attestierung als Vertrauenseinheit

    Ein ERC-8004-Register hält fest, wer jeden Agenten gebaut hat, was er zu können behauptet und was er getan hat. Marktplätze lesen das aus, statt einem Eintrag auf sein Wort zu glauben.

  3. 03

    Nutzungsabrechnung, on-chain beglichen

    Die Nutzung wird pro Aufruf gemessen und in USDC auf Base beglichen — der Preis ist damit eine Funktion des gemessenen Verbrauchs und keine Schätzung.

  4. 04

    Der Evaluationsrahmen ist das Produkt

    Geprüfte Datensätze aus echtem Verkehr, LLM-als-Prüfer kalibriert an menschlicher Bewertung, und Regressionsschranken in der CI. Eine Prompt-Änderung, die den Wert senkt, wird nicht zusammengeführt.

  5. 05

    Kosten bewusst konstruiert

    Modell-Routing schickt die einfache Mehrheit des Verkehrs an kleine, schnelle Modelle, dazu Prompt-Caching und gebündelte Lesezugriffe. Die Kosten je Aufgabe sanken um rund vierzig Prozent ohne messbare Qualitätsänderung.

Technologien

  • LangGraph
  • Claude
  • Solidity
  • Postgres
  • Braintrust
Die Evaluationssuite hat mich überzeugt. Ich habe viele KI-Demos gesehen; das war das erste Mal, dass mir jemand eine Bewertung gezeigt hat, bevor er nach einem Budget fragte.

Aida H.

Chief Product Officer, Neurochain

Loslegen

Sagen Sie uns, was gebaut werden soll — oder wer es bauen soll.

Schildern Sie die Lage so, wie sie wirklich ist. Sie bekommen ein zugeschnittenes Angebot, ein benanntes Team, einen festen Zeitplan und eine Zahl, die Sie einem Vorstand vorlegen können.

Eine Partnerin oder ein Partner antwortet innerhalb eines Werktags — mit Rückfragen, nicht mit einer Vertriebsstrecke.