Neurochain
Agenten-Marktplatz mit nutzungsbasierter Abrechnung
Wir haben die Agenten-Laufzeitumgebung, das Attestierungsregister und eine nutzungsbasierte Abrechnungsschicht mit vollständigem Evaluationsrahmen entworfen. Agenten veröffentlichen Fähigkeiten, Kunden zahlen pro Aufruf, und jeder Lauf ist nachvollziehbar und wiederholbar.
Ergebnisse
- Agentenaufrufe pro Woche
- 62kAgentenaufrufe pro Woche
- Evaluationswert, in der CI abgesichert
- 96%Evaluationswert, in der CI abgesichert
- Kosten je Aufgabe nach dem Routing
- -40%Kosten je Aufgabe nach dem Routing
- Läufe nachvollziehbar und wiederholbar
- 100%Läufe nachvollziehbar und wiederholbar
The challenge
What we walked into.
Neurochain brauchte autonome Agenten, die miteinander handeln und pro Aufruf bezahlt werden. Es fehlte jede Vertrauensgrundlage: Nichts sagte aus, wer einen Agenten gebaut hatte, was er zu können behauptete oder was er tatsächlich getan hatte.
Der Prototyp verbrannte zudem unvorhersehbar Budget. Eine einzelne Aufgabe konnte Bruchteile eines Cents oder mehrere Euro kosten, je nach eingeschlagenem Weg — eine Preisgestaltung war so unmöglich.
Am schwersten wog: Niemand konnte sagen, ob eine Prompt- oder Modelländerung das Produkt verbessert oder still kaputtgemacht hatte.
The approach
What we actually did.
- 01
Eine Laufzeitumgebung, die fortsetzbar ist
Jede Aktion wird vor der Ausführung in ein Journal geschrieben, und ein Wiederherstellungsprozess setzt am letzten gültigen Eintrag an. Ein Agent, der nach einem bezahlten Werkzeugaufruf mitten in der Aufgabe abstürzt, verliert weder die Arbeit noch das Geld.
- 02
Attestierung als Vertrauenseinheit
Ein ERC-8004-Register hält fest, wer jeden Agenten gebaut hat, was er zu können behauptet und was er getan hat. Marktplätze lesen das aus, statt einem Eintrag auf sein Wort zu glauben.
- 03
Nutzungsabrechnung, on-chain beglichen
Die Nutzung wird pro Aufruf gemessen und in USDC auf Base beglichen — der Preis ist damit eine Funktion des gemessenen Verbrauchs und keine Schätzung.
- 04
Der Evaluationsrahmen ist das Produkt
Geprüfte Datensätze aus echtem Verkehr, LLM-als-Prüfer kalibriert an menschlicher Bewertung, und Regressionsschranken in der CI. Eine Prompt-Änderung, die den Wert senkt, wird nicht zusammengeführt.
- 05
Kosten bewusst konstruiert
Modell-Routing schickt die einfache Mehrheit des Verkehrs an kleine, schnelle Modelle, dazu Prompt-Caching und gebündelte Lesezugriffe. Die Kosten je Aufgabe sanken um rund vierzig Prozent ohne messbare Qualitätsänderung.
Technologien
- LangGraph
- Claude
- Solidity
- Postgres
- Braintrust
Die Evaluationssuite hat mich überzeugt. Ich habe viele KI-Demos gesehen; das war das erste Mal, dass mir jemand eine Bewertung gezeigt hat, bevor er nach einem Budget fragte.
Aida H.
Chief Product Officer, Neurochain
Practices used
Loslegen
Sagen Sie uns, was gebaut werden soll — oder wer es bauen soll.
Schildern Sie die Lage so, wie sie wirklich ist. Sie bekommen ein zugeschnittenes Angebot, ein benanntes Team, einen festen Zeitplan und eine Zahl, die Sie einem Vorstand vorlegen können.
Eine Partnerin oder ein Partner antwortet innerhalb eines Werktags — mit Rückfragen, nicht mit einer Vertriebsstrecke.