Installera gratis generativa bildmodeller med IA Stable Diffusion på PC

Installera gratis generativa bildmodeller med IA Stable Diffusion på PC
Index
  1. Premiss
  2. Krav för Stable Diffusion på PC
  3. Ladda ner och Installera Stable Diffusion på PC
  4. Lägg till modeller eller checkpoints
  5. Stabil Diffusion online
  6. Flux
  7. Skrivning av text eller prompt
  8. Vanliga frågor lösta
    1. Är Stable Diffusion gratis att ladda ner?
    2. Var lägger man checkpoints i stabil diffusion?

Upptäck hur du kan generera konsekventa bilder med AI på din PC, utan kostnad, och lär dig grunderna för att installera och använda Stable Diffusion.

Tutti pratar om det, alla provar det, men hur fungerar bildgenerering med AI egentligen? Det är en sak att gå till en av de många webbplatser som skapar bilder och be att få se en solnedgång, ett landskap eller en slumpmässig person. Något helt annat är att generera en uppsättning liknande eller konsekventa bilder, som kanske föreställer samma ämne.

En annan fråga som dyker upp, och som är mer praktisk, är: kan vi generera nya bilder, fantasibaserade eller realistiska, utan att använda externa tjänster, utan bara med vår PC och kanske även gratis utan krediter och olika begränsningar och censurer?

Om jag skriver den här artikeln är det tydligt att vi kan generera alla bilder vi vill, även konsekventa, från vår PC med hjälp av fria och öppen källkodsmodeller för generering.

Premiss

Innan vi går till hur man gör det, är det verkligen nödvändigt att förstå två eller tre koncept för att veta vad vi gör, annars riskerar vi att använda ett verktyg slumpmässigt som aldrig kommer att ge de förväntade eller önskade resultaten. Det här blir en super kort och grundläggande genomgång.

Så, när vi återkommer till ämnet guiden för att installera en AI på PC, om vi för textbaserade chattar bara behöver en språkmodell eller LLM, så behöver vi för GenAI eller generativ AI, en deep learning-modell (djupinlärning), text-bild.

Exempel på dessa text-bildmodeller är de välkända DALL-E från Open AI, den första som kom ut, sedan Midjourney, som jag talade utförligt om för ett tag sedan, Grock från X, Imagen från Google och, framför allt, den mest betydelsefulla för oss alla, Stable Diffusion.

Stable Diffusion, vars historia och funktion kan läsas på Wikipedia är den gratis open source-modellen för latent text-bild diffusion från Stability AI som alla kan använda fritt. Stable Diffusion är även en lättare modell än DALL-E och Midjourney, som kan installeras på sin egen PC och används av den stora majoriteten av webbplatser och applikationer som erbjuder bildgenereringstjänster.

Krav för Stable Diffusion på PC

Vi tackar därför skaparna av Stable Diffusion, men det finns två problem för dem som vill leka med generativ AI.

Det första problemet är kostnaden i termer av videominne: för att skapa bilder med AI behövs en PC med minst 12 GB VRAM, det vill säga minnets kapacitet på grafikkortet, för Stable Diffusion. Därför, om du verkligen vill göra allt hemma, måste du köpa ett NVIDIA GeForce-grafikkort med mycket VRAM, minst 12 GB, vilket som vi sett kostar minst 600 Euro (och trots den kostnaden kommer vi ha precis det minimum som behövs). För tester kan även 6 GB VRAM räcka, men det här problemet går också att lösa enkelt utan att köpa något, med hjälp av molnet, som vi snart kommer att se.

Det andra problemet är kopplat till inlärningen av AI. I stora drag, om vi installerar programvaran och sedan ber om att få en bild på en flicka, kommer hon att dyka upp med ett visst utseende. Vid andra tillfället kommer hon att se helt annorlunda ut, och kanske kommer hon att framställas som en tecknad figur eller som en 3D-digital bild. I grunden måste vi ge AI:n kontroll så att bilderna är av samma typ. För att lösa detta krävs endast lite tålamod för att förstå och använda verktygen.

Andra krav är rent mjukvarubaserade. PC:n måste ha installerat Python och sedan verktyget Git.

Ladda ner och Installera Stable Diffusion på PC

Det finns tre huvudprogram för att installera Stable Diffusion AI på sin PC, alla tre är open source och fungerar på liknande sätt, men erbjuder olika installations- och konfigurationsmetoder. Dessa är:

  • AUTOMATIC1111 eller A1111, tillgänglig för Mac och Windows samt på molnet. Guide och bruksanvisningar finns på StableDiffusion.art.
  • Fooocus, ett liknande program för Windows och Linux, som kan laddas ner från Github där alla instruktioner finns.
  • Fooocus är ganska enkelt att använda eftersom det också stöder bildgenerering från en bild, så du kan ladda upp ett eget foto eller göra en ansiktsbyten.
  • ComfyUI är inte bara det kraftfullaste programmet utan också det enklaste. Detta beror på att det finns ett paket för Windows som har allt inkluderat, så du behöver ingen konfigurationskommando och kan använda det direkt. Om du har en dator med NVIDIA-grafik kan du ladda ner programmet ComfyUI_windows_portable_nvidia.7z från release-sidan, som bara behöver packas upp och köras.

Som du kan se från webbplatserna för dessa program, om du inte har en tillräckligt kraftfull dator eller om du inte vill lägga för mycket tid på manuell installation, kan du starta dem i molnet tack vare plattformen Google Colab. Colab är i huvudsak en Google-tjänst som gör att du kan koppla upp dig och låna en server från Google med 16 GB VRAM för att köra Python-kommandon. Åtkomst kräver bara ett Google Drive-konto och är gratis under en viss tid. Du kan därför starta programmen på Colab (genom att trycka på Play-knappen bredvid kommandoraderna):

ComfyUI kan också köras i molnet, komplett med modeller och checkpoints, från webbplatsen RunComfy.com, som gör att du kan låna en virtuell maskin med 16 GB VRAM gratis eller hyra, utan abonnemang, och bara betala för den tid du använder eller för mer minne.

Lägg till modeller eller checkpoints

Oavsett vilket program vi använder, rekommenderar jag ComfyUI eller Fooocus. För att generera bilder är det nödvändigt att ladda upp så kallade checkpoints, det vill säga AI-modeller som inte ingår. Stable Diffusion är en av dessa AI-modeller, men det finns flera andra. Dessa AI-modeller eller checkpoints är filer i .safetensors-format och måste laddas ner och placeras i modeller-mappen (öppna programmappen och navigera till models/checkpoint och kopiera där filerna .safetensors).

Safetensors-modeller kan laddas ner från webbplatsen HuggingFace som samlar alla, eller från webbplatsen Civit.ai som är mindre teknisk och komplett, men också enklare att navigera och söka. Till exempel kan du ladda ner Stable Diffusion XL 1.0 (gå till File and versions på sidan för att hitta nedladdningarna).

Som du kan se, är området för generativa AI-bilder en oerhört stor värld, där det är lätt att experimentera, men det kräver en hel del erfarenhet om du vill ta det på allvar. För att komma igång skulle jag rekommendera, om du vill skapa realistiska bilder som fotografier, att ladda ner modellen Juggernaut XL på Civitai baserad på SD XL. Om du vill skapa Anime-bilder eller 3D-grafik eller något annat, kan du ladda ner önskad checkpoint alltid från Civitai eller Huggingface.

Diskussionen om modeller slutar inte här. Efter de första försöken kommer du att känna att modellen ger slumpmässiga resultat och inte följer prompten. Av denna anledning finns det så kallade LORA (Low-Rank Adaptation), som är delmodeller som begränsar variationen i bildskapandet så att du kan definiera bättre vad du vill och är nödvändiga för att skapa konsekventa bilder. För att förstå historien bättre kan vi tänka på LORA som olika fotofilter. Till exempel, om vi vill skapa bilder av en vacker tjej med perfekt hy, kan vi ladda ner den passande LORA (Realism); om vi vill ha en.

För att få bilder av en känd person, som den mycket trendiga Billie Eilish, måste du ladda ner LORA. Civitai har en stor samling av LORA som kan sökas och laddas ner gratis.

Vi kan också skapa en LORA genom träning (i grunden behöver man ladda upp 50 eller 60 foton av samma subjekt eller detalj) som kan göras online på Civit.ai (även om man måste köpa minst 5 Euro i krediter).

Var uppmärksam på begreppet Workflow, som på ComfyUI representeras som flödesscheman. Workflows är stegen som algoritmen måste genomgå (genom checkpoints, LORA och många andra parametrar) för att generera bilden och kan verkligen vara komplexa. På webbplatsen Runcomfy.com kan du ladda ner många färdiga workflows.

Stabil Diffusion online

Den som inte har en PC med 12 GB VRAM kan prova dessa program, men bildgenereringen kommer att vara mycket långsam. Lyckligtvis finns det online-tjänster. Nu finns det verkligen många online-tjänster som integrerar Stabil Diffusion. Dessa laddar helt enkelt ner det open source-programmet, till exempel ComfyUI, som är välkonfigurerat med Checkpoint och LORA, och erbjuder abonnemang.

Vi har gjort en liten lista över de bästa sidorna för att generera bilder via AI gratis i en annan artikel.

Från de gjorda forskningar har jag funnit att de bästa sidorna är Civit.ai och Tensor.art, eftersom de fungerar som online-versioner av ComfyUI, kompletta med alla mest använda checkpoints och LORA, och med avseende på kreditförbrukning är de bland de mest generösa och kan användas gratis för många tester, inte bara 5 eller 10 bilder.

Flux

Två ord om Flux från Black Forest Lab, en annan generativ AI Text-to-Image open source-modell, liknande Stabil Diffusion, men mer recent och med högre kvalitet. På de ovan nämnda sidorna kan man prova att skapa bilder med Flux och jämföra dem med de som genererats via SD XL eller SD 1.5. Även om Flux är bättre, är det dock mer "kostsamt" både i termer av videominne (på din egen PC behövs minst 16 GB VRAM för Flux) och i termer av priser på online-tjänster.

Det enklaste sättet att prova Flux gratis är via webbplatsen Hugging Face. Genom att trycka på Flux.1 Dev öppnas sidan där du kan skriva in prompten eller ladda upp en bild för att få en ny.

Skrivning av text eller prompt

Mycket information i denna artikel, och jag kan föreställa mig att den som är intresserad kommer att göra många fler sökningar för guider. Hur som helst, om vi har lyckats konfigurera programmet på PC:n eller om vi har registrerat oss på en online-tjänst för att göra det lättare, kommer nu den svåraste delen: skrivning av prompten. Ja, för att generera en välgjord, realistisk eller fantasifull bild är det nödvändigt att beskriva alla detaljer i prompten, annars blir resultatet dåligt eller oexakt.

I detta kan den normala AI:n vara till hjälp, som ChatGPT eller, ännu bättre, Google Gemini som fungerar bra för att generera textpromptar. Du kan öppna Gemini Studio och sedan fråga något i stil med "generate prompt for stable Diffusion for a photorealistic image of a woman.... ". Utdata kan sedan klistras in i bildgenereringsverktyget. Kom ihåg att skriva promptar på engelska, det är verkligen obligatoriskt.

En utmärkt webbplats för att hitta färdiga promptar att bara kopiera och klistra in för StableDiffusion och Flux är prompthero.com.

Jag påminner också om att det är möjligt att använda generativa AI:er för att byta ansikte på en bild med FaceSwap, en operation som har utvecklats mycket det senaste året.

Svaret, denna gång, är nej, det är fortfarande för tidigt att prata om. För att börja med är den gratis modellen Stable Video Diffusion nyligen lanserad och fungerar fortfarande inte särskilt bra. Dessutom krävs det ännu mer videominne för att generera videor, så det kan bli riktigt kostsamt.

För videogenerering är de mer avancerade tjänsterna Kling, Hailuo, Hedra, Pika och Runway, som nämns i listan över webbplatser för...

Generera video genom AI.

Om du har svårigheter eller frågor, med tanke på att ämnet är komplext och ständigt utvecklas, låt oss veta.

Vanliga frågor lösta

Är Stable Diffusion gratis att ladda ner?

Stable Diffusion är en serie modeller med öppen källkod som har gjorts allmänt tillgängliga av Stability AI. Här är några viktiga punkter:

    • -

Öppen källkod

    : Modellerna är gratis och tillgängliga för alla att använda.

  • Nedladdning: Du kan ladda ner modellerna utan kostnad.
  • Användningsområden: De är avsedda för personligt bruk och kan användas för att utveckla egna projekt och idéer. Sammanfattningsvis, ja, Stable Diffusion är gratis att ladda ner.

Var lägger man checkpoints i stabil diffusion?

För att lägga in checkpoints i Stable Diffusion, följ dessa steg:

 

  • Navigera till mappen: Öppna mappen där din Stable Diffusion-installation finns.
  • Plats för checkpoints: Leta efter en textfil med namnet 'Placera stabila diffusionskontrollpunkter här'. Denna fil indikerar var du ska lägga checkpoint-filerna.
  • Flytta filerna: Efter att du har laddat ner din stabila diffusionsmodell, flytta den till den angivna mappen.
  • Kontrollera formatet: Se till att de nedladdade filerna är i rätt format och namnkonventioner som stöds av Stable Diffusion. Genom att följa dessa steg kan du enkelt hantera checkpoints i Stable Diffusion.

 

Nu när du har läst klart Installera gratis generativa bildmodeller med IA Stable Diffusion på PC, inbjuder vi dig att utforska kategorin Windows ytterligare. Där hittar du fler intressanta artiklar som kommer att utöka dina kunskaper och hålla dig informerad. Sluta inte läsa och upptäcka mer!

Lämna ett svar

Din e-postadress kommer inte publiceras. Obligatoriska fält är märkta *

Go up