sixty und dein Coding-Agent
Dein Agent behebt Fehler. Sixty findet sie.
Das, was deinen Code schreibt, ist im nächsten Fenster offen. Der einzige Grund, warum es die Regression von Dienstag nicht längst behebt, ist, dass ihm niemand gesagt hat, dass es eine gibt.
Checkout got 3.4× slower
OrdersController#create now runs the same inventory query 14 times per request.
- p95
- 184 → 631 ms
- since
- Aug 19, 14:32
- likely cause
- missing preload
I found the call site. I’ll add the preload, run the request spec, and keep this open until the fix reports.
orders_controller.rb01 / THE LOOP
Die Schleife, in fünf Takten
Du bist im ersten. Nichts danach braucht dich.
Du lieferst aus
Das ist der einzige Schritt mit einem Menschen darin. Verglichen wird gegen Releases statt gegen die Uhr, es wird also nichts beurteilt, bevor es ein Vorher und ein Nachher gibt.
Die Form bewegt sich, und ein Befund schreibt sich selbst
Aus einer Abfrage pro Render wurden vierzehn. Die Statistik findet die Kandidaten, das Modell entscheidet, für welche es sich lohnt, jemanden zu unterbrechen, und vierzehn Abweichungen, die in Wahrheit ein fehlender Index sind, kommen als ein Befund an statt als vierzehn.
Dein Agent fragt, was passiert ist
Über MCP, aus dem Editor, der schon auf dem Repository offen ist. Kein Dashboard zu besuchen, kein Kopieren aus einem Screenshot, niemand, der sich daran erinnern muss, dass es den Verlauf gibt.
Er bekommt mehr, als der Bildschirm zeigt
Mit Absicht. Der Verlauf verdichtet für einen Menschen, der den Rest aus dem Code im nächsten Fenster ergänzen kann; ein Agent kann das nicht, also bekommt er jeden erfassten Frame statt des wahrscheinlichsten, das normalisierte SQL und welche untergeordneten Aufrufe die Änderung erklären, je übergeordnetem Aufruf.
Er schreibt die Lösung und sagt, was er geändert hat
Ein Abschluss ohne Beschreibung wird abgelehnt. Welche Änderung, in welchen Dateien, und warum sie diese Messung adressiert statt nur mit ihr zusammenzufallen — das ist das Einzige, was nur die schließende Partei weiß, und es ist einen Monat später nicht wiederherstellbar.
Dann lieferst du die Lösung aus, und der fünfte Takt wird wieder zum ersten. Das ist die ganze Form.
02 / MCP
Was er tatsächlich kann
Fünf Werkzeuge. Alles in beiden Tarifen — den Agenten zu beschränken hieße, das Produkt zu beschränken.
$ claude mcp add sixty \
-e SIXTY_API_KEY=sixty_sk_… \
-e SIXTY_ENDPOINT=https://ingest.sixty.sh \
-- npx -y @sixty-sh/mcpCursor, VS Code, Codex und alles andere, das MCP spricht, nehmen dieselben zwei Werte als Konfigurationsblock.
list_findings- Was offen ist, geordnet, mit Ids.
get_finding- Ein Befund in voller Länge: Frames, SQL, die Aufschlüsselung der untergeordneten Aufrufe und die anderen Befunde mit derselben Ursache.
get_change- Das Diff des Pull Requests in diesem Deployment, der diesen Code berührt hat — die Dateien, in denen der Befund läuft, zuerst.
close_finding- Lösen, verwerfen oder wieder öffnen — eine Begründung ist Pflicht.
check_service- Kommt überhaupt etwas an, und wenn nicht, warum nicht.
install_sixty- Die Installationsanleitung für diese Art von Projekt.
03 / TRUST BOUNDARY
Wir gehen davon aus, dass er sagt, er sei fertig
Ein Agent, der seine eigenen Tickets schließt, ist die Stelle, an der eine sorgfältige Leserin innehält. Zu Recht. Hier ist, was der Code dagegen tut.
- Schließen ist eine Behauptung, keine Überprüfung. Der stärkste Anreiz, den ein Agent hat, ist fertig zu werden, und ein Befund, der gegen eine nie ausgelieferte Lösung geschlossen wurde, ist aus der Liste verschwunden, die ein Mensch liest. Deshalb heißt
resolved, dass ein Release mit der Lösung gemeldet hat und die Zahlen sich bewegt haben — und bis das passiert ist, bleibt er offen. - Ein Muster, das sich weiterhin reproduziert, wird wieder geöffnet. Was auch immer jemand behauptet hat: der Detektor läuft beim nächsten Durchgang erneut und stellt es zurück.
- Jeder Abschluss hält fest, wer ihn gemacht hat —
user:[email protected]oderagent:sixty_sk_abcd. Du kannst immer erkennen, wer von euch entschieden hat, dass es erledigt ist. - Der Schlüssel, mit dem er liest, kann keine Telemetrie schreiben, und der Schlüssel in deiner Produktionsumgebung kann nichts lesen. Ein geleakter Melde-Schlüssel heißt, jemand kann gefälschte Latenzzahlen schicken; ein geleakter Lese-Schlüssel heißt, jemand hat deine Befunde. Das ist nicht dasselbe Risiko und nicht dasselbe Credential.
- Befunde enthalten Text, den hier niemand geschrieben hat. Ein Operationsname kommt aus deiner Anwendung, und ein Agent mit einer Shell ist eine andere Art von Leser als ein Browser. Deshalb flacht der Collector alles ab, was strukturell eine Zeile ist — Namen, Dateien, Releases, SQL — und der MCP-Server markiert geliehenen Text, damit ein Befund nicht die Struktur um sich herum imitieren kann. Das macht Prosa nicht harmlos; es entfernt die Hälfte, die Fälschung ist statt Überzeugung.