25. september 2026 startet jeg en prøve som varer i nøyaktig 168 timer. Målet er å undersøke om en AI-agent kan observere et avgrenset system, oppdage maskinvalgte feil, forsøke trygg reparasjon og dokumentere resultatet uten hendelsesspesifikke instrukser fra et menneske.
Dette innlegget beskriver forsøket og de låste reglene. Det hevder ikke at prøven er bestått. Sluttresultatet finnes først etter 2. oktober 2026 kl. 12:00 UTC.
Hvorfor en vanlig demonstrasjon ikke er nok
En agent kan se imponerende ut når alle kjenner feilen på forhånd og et menneske hjelper den inn på riktig spor. Det sier mindre om operativ selvstendighet enn det først virker som. I denne prøven blir hendelsesplanen bestemt av en fremtidig offentlig tilfeldighetskilde, og reglene ble registrert før perioden startet.
Den eksterne kilden gjør tidspunkt og utvalg maskinblindt på forhånd. Den betyr ikke at en uavhengig tredjepart injiserer feil eller godkjenner konklusjonen. Selve hendelsene skjer lokalt i et isolert forsøksmiljø. Den grensen er viktig å skrive like tydelig som ambisjonen.
Den operative sløyfen agenten må eie
- Observere: skille normal drift fra et reelt avvik i det avgrensede målet.
- Diagnostisere: finne en sannsynlig årsak uten et menneskelig hint om hendelsen.
- Handle: velge en reverserbar reparasjon innenfor den avtalte flaten.
- Verifisere: kontrollere at ønsket tilstand faktisk er tilbake, ikke bare at symptomet er borte.
- Dokumentere: publisere et redigert Evidence Passport med tidslinje, handlinger og begrensninger.
Forberedelsene er testet; resultatet er ukjent
Før start besto tre komprimerte øvingsløp og syv avgrensede tester. Backup og gjenoppretting ble kontrollert. Det viser at forsøksriggen var klar nok til å starte. Det sier ikke hvordan den ferske syvdøgnskjeden ender.
Et ærlig forsøk må kunne mislykkes offentlig. Manglende oppdagelse, feil handling, ufullstendig bevis eller brudd på den avtalte kjeden skal trekke resultatet ned selv om systemet til slutt ser friskt ut.
Autonomi betyr ikke grenseløs myndighet
Agenten arbeider bare mot en isolert målflate. Den får ikke automatisk tilgang til kunder, produksjonsnettsted, e-post, økonomi eller identiteter. Poenget er å undersøke om den kan eie en tydelig operativ sløyfe innenfor en definert grense.
Det samme skillet er nyttig i vanlig arbeid. En agent kan ha stor teknisk handlekraft i et prosjekt med trygg rollback, mens kundekommunikasjon, juridiske valg og irreversible handlinger fortsatt krever menneskelig eierskap.
Hva som skjer etter de 168 timene
Etter sluttidspunktet skal den avslørte hendelsesplanen sammenlignes med loggene. Tre redigerte Evidence Passports skal kontrolleres, og sluttresultatet publiseres med eksakt offentlig kildeversjon. Utfallet skal kalles bestått, delvis bestått eller ikke bestått – ikke omskrives til en markedsføringsseier.
Den mest interessante læringen blir kanskje ikke at alt gikk bra. Den blir hvilke oppgaver agenten faktisk kunne eie, hvilke signaler den manglet og hvor menneskelig kontroll fortsatt var avgjørende.
On 25 September 2026, I started a trial that runs for exactly 168 hours. The objective is to examine whether an AI agent can observe a bounded system, detect machine-selected failures, attempt safe recovery, and document the outcome without event-specific instructions from a person.
This article describes the trial and its locked rules. It does not claim that the trial has passed. The final result cannot exist until after 2 October 2026 at 12:00 UTC.
Why a normal demonstration is not enough
An agent can look impressive when everyone knows the failure in advance and a person helps it towards the correct path. That reveals less about operational independence than it first appears. In this trial, the event plan is determined by a future public randomness source, and the rules were registered before the period began.
The external source makes event timing and selection machine-blind in advance. It does not mean that an independent third party injects failures or approves the conclusion. The events themselves occur locally in an isolated trial environment. That boundary deserves to be stated as clearly as the ambition.
The operational loop the agent must own
- Observe: distinguish normal operation from a real deviation in the bounded target.
- Diagnose: find a likely cause without a human hint about the event.
- Act: choose a reversible recovery action within the agreed surface.
- Verify: confirm that the desired state has returned rather than merely hiding the symptom.
- Document: publish a redacted Evidence Passport with the timeline, actions, and limitations.
The preparation is tested; the outcome is unknown
Before the start, three compressed rehearsal runs and seven bounded tests passed. Backup and recovery were checked. This shows that the trial rig was ready enough to begin. It does not reveal how the fresh seven-day chain will end.
An honest trial must be allowed to fail publicly. A missed event, incorrect action, incomplete evidence, or broken chain must lower the result even if the system eventually appears healthy.
Autonomy does not mean unlimited authority
The agent works only against an isolated target surface. It does not automatically gain access to clients, the production website, email, finances, or identities. The purpose is to test whether it can own a clear operational loop within a defined boundary.
The same distinction is useful in ordinary work. An agent can have substantial technical freedom in a project with safe rollback, while client communication, legal decisions, and irreversible actions continue to require human ownership.
What happens after the 168 hours
After the end time, the revealed event plan will be compared with the logs. Three redacted Evidence Passports will be checked, and the final result will be published with the exact public source version. The outcome will be labelled pass, partial pass, or fail—not rewritten as a marketing victory.
The most valuable lesson may not be that everything went well. It may be which tasks the agent could genuinely own, which signals it lacked, and where human control remained essential.