FA Finn Andre Hotvedt Tekniske feltnotater

Kan en AI-agent arbeide selvstendig i syv døgn?

Jeg har startet en 168-timers prøve med låste regler, isolert mål og offentlig kilde. Dette beskriver forsøket – ikke et resultat som ennå ikke finnes.

25. september 2026 startet jeg en prøve som varer i nøyaktig 168 timer. Målet er å undersøke om en AI-agent kan observere et avgrenset system, oppdage maskinvalgte feil, forsøke trygg reparasjon og dokumentere resultatet uten hendelsesspesifikke instrukser fra et menneske.

Dette innlegget beskriver forsøket og de låste reglene. Det hevder ikke at prøven er bestått. Sluttresultatet finnes først etter 2. oktober 2026 kl. 12:00 UTC.

StatusPågår
Start25. september 2026 kl. 12:00 UTC
Slutt2. oktober 2026 kl. 12:00 UTC
Varighet168 timer
MålIsolert fra kunder og produksjon
Mulige utfallBestått, delvis eller ikke bestått

Hvorfor en vanlig demonstrasjon ikke er nok

En agent kan se imponerende ut når alle kjenner feilen på forhånd og et menneske hjelper den inn på riktig spor. Det sier mindre om operativ selvstendighet enn det først virker som. I denne prøven blir hendelsesplanen bestemt av en fremtidig offentlig tilfeldighetskilde, og reglene ble registrert før perioden startet.

Den eksterne kilden gjør tidspunkt og utvalg maskinblindt på forhånd. Den betyr ikke at en uavhengig tredjepart injiserer feil eller godkjenner konklusjonen. Selve hendelsene skjer lokalt i et isolert forsøksmiljø. Den grensen er viktig å skrive like tydelig som ambisjonen.

Den operative sløyfen agenten må eie

  1. Observere: skille normal drift fra et reelt avvik i det avgrensede målet.
  2. Diagnostisere: finne en sannsynlig årsak uten et menneskelig hint om hendelsen.
  3. Handle: velge en reverserbar reparasjon innenfor den avtalte flaten.
  4. Verifisere: kontrollere at ønsket tilstand faktisk er tilbake, ikke bare at symptomet er borte.
  5. Dokumentere: publisere et redigert Evidence Passport med tidslinje, handlinger og begrensninger.

Forberedelsene er testet; resultatet er ukjent

Før start besto tre komprimerte øvingsløp og syv avgrensede tester. Backup og gjenoppretting ble kontrollert. Det viser at forsøksriggen var klar nok til å starte. Det sier ikke hvordan den ferske syvdøgnskjeden ender.

Et ærlig forsøk må kunne mislykkes offentlig. Manglende oppdagelse, feil handling, ufullstendig bevis eller brudd på den avtalte kjeden skal trekke resultatet ned selv om systemet til slutt ser friskt ut.

Det vi ikke vet 25. september: Om alle planlagte hendelser blir oppdaget og reparert, om beviskjeden blir komplett eller hvilken sluttkarakter prøven får. Ingen resultatpåstand er gyldig før tidsvinduet er ferdig og kilden er kontrollert.

Autonomi betyr ikke grenseløs myndighet

Agenten arbeider bare mot en isolert målflate. Den får ikke automatisk tilgang til kunder, produksjonsnettsted, e-post, økonomi eller identiteter. Poenget er å undersøke om den kan eie en tydelig operativ sløyfe innenfor en definert grense.

Det samme skillet er nyttig i vanlig arbeid. En agent kan ha stor teknisk handlekraft i et prosjekt med trygg rollback, mens kundekommunikasjon, juridiske valg og irreversible handlinger fortsatt krever menneskelig eierskap.

Hva som skjer etter de 168 timene

Etter sluttidspunktet skal den avslørte hendelsesplanen sammenlignes med loggene. Tre redigerte Evidence Passports skal kontrolleres, og sluttresultatet publiseres med eksakt offentlig kildeversjon. Utfallet skal kalles bestått, delvis bestått eller ikke bestått – ikke omskrives til en markedsføringsseier.

Den mest interessante læringen blir kanskje ikke at alt gikk bra. Den blir hvilke oppgaver agenten faktisk kunne eie, hvilke signaler den manglet og hvor menneskelig kontroll fortsatt var avgjørende.

Skrevet avFinn Andre Hotvedt

Jeg bygger og videreutvikler systemer, nettsider, integrasjoner og tekniske produkter – fra den første skissen til løsningen er i drift.

Diskuter en lignende utfordring