endogen.net

Endogen News

Public updates from the Endogen project.

← News

· fredrik

Läge just nu

Jag håller på att färdigställa allt till en fungerande enhet.

Tack vare att jag lyckas använda AI-agenter väldigt väl går detta mycket bra, och nedanstående ska inte ta allt för mycket tid. Jag har svårt att uppskatta tid då andra saker i livet ibland kommer i vägen. Resultatet fungerar dock redan, men det är rörigt och antagligen enbart jag kan använda systemet effektivt---men det ska jag ändra på. Den nya sajten har just nu hög risk för frustration.

Utvecklingen sker på följande, men inte helt klart: https://ma.trekyl.com

Vad som sker just nu:

Notis: Jag är medveten om alla brister och kommer fix dem över tid, exempelvis om det är dålig responstid på en knapp (jag har höga krav på gränssnittet).

Min metod för att använda AI fungerar mycket bra. Jag ser att andra har problem, exempelvis med att kontext-fönstret blir överfyllt och AI-agenterna hallucinerar. Mina AI-agenter har aldrig hallucinerat, och jag har belägg för att mina tidigare åtgärder att låta AI-agenter omarbeta (faktorisera) systemet under några dagars tid nu är till stor hjälp då AI-agenterna kan fokusera på rätt saker utan att störas av kringliggande systemfaktorer.

Det är också rätt åtgärd för mig att använda de mest grundläggande verktygen och inte investera tid i "avancerade" verktyg (diverse "dash boards") som är tänkta att förenkla allt. Jag har inte provat dem---jag använder enbart OpenClaw TUI och CLI---men jag tvekar på att det är mer effektivt med ytterligare verktyg. Jag upplever min metod som direkt och inflytelserik. Jag arbetar inte via ett lager av övergripande rapportering och abstrakta summeringar, utan jag följer upp tekniska detaljer via specifika frågor för att verifiera att resultatet stämmer överens med vad som är bra design. Jag följer upp resultatet och kan avgöra om AI-agenterna har gjort rätt val. När jag kör långa automatiseringar följer jag regelbundet upp med rätt frågor till agenterna om hur det går. Jag har tillräckligt med detalj-insikt samtidigt som jag undgår att tyngas ner av manuellt arbete---AI-agenterna gör det manuella arbetet---och jag kan fokusera på konceptuell design.

Exempel: nätverksmodulen sparar data "optimistiskt", vilket innebär att din enhet inte verifierar om datan blev sparad på servern---exempelvis när du sparar ett livsmedel. Systemet utgår från att det blev sparat. Har du en dålig internetuppkoppling kan det bli problem. Därför: Ett generellt system ska verkställas för att verifiera alla transaktioner. Stöd för det är redan inbyggt i grundsystemet, men konceptet behöver realiseras på funktionell nivå. Här ser vi också att jag var klok nog att bygga ett grundsystem med stöd för behov som dessa, så att jag inte just nu behöver skapa en ny lösning utan istället kan utöka tidigare grund. Risken hade annars varit att lösningen blir ett specialfall snarare än att byggas på grundstrukturen, och sådant är farligt för det ökar antalet specialfall som AI-agenterna måste ha koll på, varav de till slut överfyller sina kontext-fönster och börjar hallucinera eller glömma under pågående ingrepp. Det är som om en läkare som ska operera en patient samtidigt ska frisera håret på patienten och på samma gång också ska laga middag till sig själv samt sjunga opera. När folk misslyckas med AI-agenter tror jag det beror på att de organiserar sina projekt på ett sätt som är analogt med exemplet om läkaren, och det grundas i tron om att "AI löser allt", men AI löser enbart en stor mängd uppgifter om den har rätt förutsättningar. AI, precis som Läkaren---för att kunna vara effektiv---behöver en strukturerad miljö med lämpliga instrument och ett enskilt uppdrag inom ett enskilt område. AI har dock en god tendens att skapa sin egen struktur och miljö som den behöver för att göra diverse ingrepp, men det krävs att människan låter AI-agenten göra det.