Usare Emma idag får oss att förstå varför en LLM inte är en riktig AI

Upptäck AI:n Emma, en språklig felaktighet med absurda svar. Trots perfekta formuleringar saknas genuin intelligens och förståelse i dessa stora språkmodeller (LLM). Använd för nöje eller satir!
För den som vill spela med AI:n Emma, som blev känd efter en kort livstid på bara 48 timmar, finns det en möjlighet. Hennes öppna språkmodell har återlanserats på en icke-officiell webbplats. Man kan ställa en enkel gåta om vikten av ett kilo bly och ett kilo fjädrar och få något absurt som svar; blyet väger mer, eller att de sju dvärgarna är åtta eller tvåhundra miljoner. Denna surrealistiska upplevelse finns kvar i version 5 av Egomnias språkmodell.
Istället för att bara förlöjliga en uppenbart bristfällig mjukvara, kan vi använda denna IT-katastrof för att förstå hur ett neuralt nätverk fungerar. Emma blottar en stor medieförvirring: de LLM som ligger till grund för AI som ChatGPT, Grok och Gemini är inte verklig AI. De har ingen sann intelligens, saknar mänskligt resonemang och kan inte ens säga "jag vet inte".
Tricket bakom perfekta men utan logik
De som använt Matteo Achillis mjukvara har märkt ett gemensamt fel. AI:n svarar på frågor utan att ha svar, som en elev som bluffar för att imponera på läraren. Grammatik och verbböjningar kan vara perfekta, men innehållet är solsken av fantasier. Det blir till och med så absurda kopplingar att de nästan kan ses som konstverk.
Systemen saknar förståelse för begrepp. De fungerar mer som en automatiskt rättningssystem på smartphone, konstant pressade till det yttersta. De konsulterar inte verklig information utan gissar vilket ord som logiskt följer efter ett annat, baserat på miljarder exempel från nätet. De är matematiska papegojor. Det är språk utan förståelse för vad ett kilo bly eller en fjäder innebär. Istället för att erkänna bristen på kunskap, hittar de på något som låter rimligt för att fylla utrymmet.
Varför en liten modell felaktigt
Emmas brister kan härledas till så kallade parametrar. Tänk på parametrar som sidorna i en intern ordbok för programmet. Fler sidor ger fler begrepp att koppla samman. Den italienska modellen började med 550 miljoner parametrar, mycket men inte nog. Riktiga system har miljarder.
Få parametrar är som att försöka beskriva hela världens historia med ett intetsägande nothäfte. Utrymmet för logikens regler är för litet. Utan robust databas gissar programmet, vilket ger en mjukvara som skriver väl men resonerar svagt, och som får alla med grundläggande skolkunskaper att skratta.
MarEmma använder samma motor för satir
Medan officiella servrar stängdes, dök applikationen Maremma snabbt upp. Det handlar inte om en parodi (det är Emmas syster), utan om hur Emma borde ha presenterats för att inte bli hånad. Den är en portning av version 5 av den öppna LLM från Egomnia, nu fritt tillgänglig på huggingface.
Skaparen av maremma-app har tagit de ursprungliga filerna och integrerat dem i ett gränssnitt som slår det gamla. Med bättre finjustering får man svar som, trots att de nästan alltid är felaktiga, är mer precisa.
Följ TekniskaKneps anvisningar för att installera dessa små modeller, så förstår ni hur samma kod kan vara en katastrof som professionellt verktyg, men bli en smart fritidssysselsättning inom satir.
Tekniska begränsningar blir en styrka. Användarna förväntar sig absurd humor och skratt.
Den verkliga skillnaden mellan IA, LLM och SLM
För att se bortom marknadsföringsfloskler är det värt att förstå vad som egentligen döljer sig i chattverktygen.
- Artificiell Intelligens (AI) omfattar allt från smarta termostater till radar i flygplan. Maskinen tänker inte; den följer regler för specifika uppgifter. En maskin som resonera som människor? Fortfarande science fiction.
- Stora Språkmodeller (LLM) är monster som ChatGPT. De bearbetar enorma mängder skrivet material online. Bra på att generera text och översätta, men de är endast sannolikhetsmotorer, inte medvetna varelser.
- Små Språkmodeller (SLM) är enklare varianter, som de från Emma och Maremma, designade för billig hårdvara eller smartphones. De är inte tillförlitliga för att avgöra fakta; de kan namnet hitta på saker.
Tekniska curiositeter och vanliga frågor om chatbotar
- Botar tilldelar numeriska värden till ord för att styra sin text.
- Programmet kan glömma inledande meddelanden efter några minuter.
- Ett kraftfullt grafikkort behövs; processorn räcker inte.
- Det finns kvalitetskillnader mellan universitets gratismodeller och kommersiella, stängda alternativ som erbjuder prenumerationer.
För många företag poppar upp med halvfärdiga AI-lösningar, enbart för att hänga med i trenden. Att skapa en solid modell kräver miljardinvesteringar och år av testande; pressmeddelanden räcker inte. Maremma visar att intellektuell ärlighet vinner. Det är mer värdefullt med mjukvara som erkänner sin underhållande sida än en som pretenderar vara teknologi i framkant och gör misstag. Använd dessa verktyg för nöje och lärande, men överlämna aldrig viktiga beslut eller historisk forskning till en chatbot utan att dubbelkolla källorna i en bok.
Nu när du har läst klart Usare Emma idag får oss att förstå varför en LLM inte är en riktig AI, inbjuder vi dig att utforska kategorin Ansökningar ytterligare. Där hittar du fler intressanta artiklar som kommer att utöka dina kunskaper och hålla dig informerad. Sluta inte läsa och upptäcka mer!

Lämna ett svar