sixty

sixty und dein Coding-Agent

Dein Agent behebt Fehler. Sixty findet sie.

Das, was deinen Code schreibt, ist im nächsten Fenster offen. Der einzige Grund, warum es die Regression von Dienstag nicht längst behebt, ist, dass ihm niemand gesagt hat, dass es eine gibt.

live finding#1842
regression · after deploy 8f31c2

Checkout got 3.4× slower

OrdersController#create now runs the same inventory query 14 times per request.

p95
184 → 631 ms
since
Aug 19, 14:32
likely cause
missing preload
agent

I found the call site. I’ll add the preload, run the request spec, and keep this open until the fix reports.

● Working in orders_controller.rb

01 / THE LOOP

Die Schleife, in fünf Takten

Du bist im ersten. Nichts danach braucht dich.

  1. Du lieferst aus

    Das ist der einzige Schritt mit einem Menschen darin. Verglichen wird gegen Releases statt gegen die Uhr, es wird also nichts beurteilt, bevor es ein Vorher und ein Nachher gibt.

  2. Die Form bewegt sich, und ein Befund schreibt sich selbst

    Aus einer Abfrage pro Render wurden vierzehn. Die Statistik findet die Kandidaten, das Modell entscheidet, für welche es sich lohnt, jemanden zu unterbrechen, und vierzehn Abweichungen, die in Wahrheit ein fehlender Index sind, kommen als ein Befund an statt als vierzehn.

  3. Dein Agent fragt, was passiert ist

    Über MCP, aus dem Editor, der schon auf dem Repository offen ist. Kein Dashboard zu besuchen, kein Kopieren aus einem Screenshot, niemand, der sich daran erinnern muss, dass es den Verlauf gibt.

  4. Er bekommt mehr, als der Bildschirm zeigt

    Mit Absicht. Der Verlauf verdichtet für einen Menschen, der den Rest aus dem Code im nächsten Fenster ergänzen kann; ein Agent kann das nicht, also bekommt er jeden erfassten Frame statt des wahrscheinlichsten, das normalisierte SQL und welche untergeordneten Aufrufe die Änderung erklären, je übergeordnetem Aufruf.

  5. Er schreibt die Lösung und sagt, was er geändert hat

    Ein Abschluss ohne Beschreibung wird abgelehnt. Welche Änderung, in welchen Dateien, und warum sie diese Messung adressiert statt nur mit ihr zusammenzufallen — das ist das Einzige, was nur die schließende Partei weiß, und es ist einen Monat später nicht wiederherstellbar.

Dann lieferst du die Lösung aus, und der fünfte Takt wird wieder zum ersten. Das ist die ganze Form.

02 / MCP

Was er tatsächlich kann

Fünf Werkzeuge. Alles in beiden Tarifen — den Agenten zu beschränken hieße, das Produkt zu beschränken.

$ claude mcp add sixty \
  -e SIXTY_API_KEY=sixty_sk_… \
  -e SIXTY_ENDPOINT=https://ingest.sixty.sh \
  -- npx -y @sixty-sh/mcp

Cursor, VS Code, Codex und alles andere, das MCP spricht, nehmen dieselben zwei Werte als Konfigurationsblock.

list_findings
Was offen ist, geordnet, mit Ids.
get_finding
Ein Befund in voller Länge: Frames, SQL, die Aufschlüsselung der untergeordneten Aufrufe und die anderen Befunde mit derselben Ursache.
get_change
Das Diff des Pull Requests in diesem Deployment, der diesen Code berührt hat — die Dateien, in denen der Befund läuft, zuerst.
close_finding
Lösen, verwerfen oder wieder öffnen — eine Begründung ist Pflicht.
check_service
Kommt überhaupt etwas an, und wenn nicht, warum nicht.
install_sixty
Die Installationsanleitung für diese Art von Projekt.

03 / TRUST BOUNDARY

Wir gehen davon aus, dass er sagt, er sei fertig

Ein Agent, der seine eigenen Tickets schließt, ist die Stelle, an der eine sorgfältige Leserin innehält. Zu Recht. Hier ist, was der Code dagegen tut.

  • Schließen ist eine Behauptung, keine Überprüfung. Der stärkste Anreiz, den ein Agent hat, ist fertig zu werden, und ein Befund, der gegen eine nie ausgelieferte Lösung geschlossen wurde, ist aus der Liste verschwunden, die ein Mensch liest. Deshalb heißt resolved, dass ein Release mit der Lösung gemeldet hat und die Zahlen sich bewegt haben — und bis das passiert ist, bleibt er offen.
  • Ein Muster, das sich weiterhin reproduziert, wird wieder geöffnet. Was auch immer jemand behauptet hat: der Detektor läuft beim nächsten Durchgang erneut und stellt es zurück.
  • Jeder Abschluss hält fest, wer ihn gemacht hat — user:[email protected] oder agent:sixty_sk_abcd. Du kannst immer erkennen, wer von euch entschieden hat, dass es erledigt ist.
  • Der Schlüssel, mit dem er liest, kann keine Telemetrie schreiben, und der Schlüssel in deiner Produktionsumgebung kann nichts lesen. Ein geleakter Melde-Schlüssel heißt, jemand kann gefälschte Latenzzahlen schicken; ein geleakter Lese-Schlüssel heißt, jemand hat deine Befunde. Das ist nicht dasselbe Risiko und nicht dasselbe Credential.
  • Befunde enthalten Text, den hier niemand geschrieben hat. Ein Operationsname kommt aus deiner Anwendung, und ein Agent mit einer Shell ist eine andere Art von Leser als ein Browser. Deshalb flacht der Collector alles ab, was strukturell eine Zeile ist — Namen, Dateien, Releases, SQL — und der MCP-Server markiert geliehenen Text, damit ein Befund nicht die Struktur um sich herum imitieren kann. Das macht Prosa nicht harmlos; es entfernt die Hälfte, die Fälschung ist statt Überzeugung.

Lass ihn den beheben, den du am Dienstag ausgeliefert hast.

Anmelden Preise
Sixty und dein Coding-Agent — die Schleife, die sich selbst schließt