NYTT
Google släpper två snabbare Gemini-modeller
Gemini 3.6 Flash och 3.5 Flash-Lite är byggda för uppgifter där svarstid och kostnad spelar stor roll. Modellerna finns nu för utvecklare, företag och i Gemini-appen, medan den säkerhetsinriktade Flash Cyber får betydligt mer begränsad tillgång.
Publicerad 28 juli 2026, 11.06

Google har släppt Gemini 3.6 Flash och Gemini 3.5 Flash-Lite. Det är två AI-modeller för uppgifter där många svar ska tas fram snabbt, till exempel dokumentsortering, kodarbete och AI-agenter som använder flera verktyg.
Gemini 3.6 Flash är den mer kapabla av de två. Den kan ta emot text, bild, video, ljud och pdf-filer och lämnar text som svar. Modellen stöder bland annat filsökning, kodkörning och funktionsanrop. Datorstyrning finns som förhandsversion, vilket betyder att funktionen fortfarande kan ändras.
Priset är 1,50 dollar per miljon indatatoken och 7,50 dollar per miljon utdatatoken. En token är en liten textdel som modellen läser eller skriver. Kostnaden beror därför både på hur mycket underlag som skickas in och hur långa svar modellen ger.
Gemini 3.5 Flash-Lite riktar sig till större mängder enklare arbete. I global trafik kostar den 0,30 dollar per miljon indatatoken och 2,50 dollar per miljon utdatatoken. Google tar ett något högre pris för viss trafik som inte körs globalt.
Båda modellerna finns i Gemini API via Google AI Studio och i Googles plattform för företagsagenter. Google anger också att modellerna finns i Gemini-appen. Flash-Lite rullas dessutom ut i Google Sök, men företaget publicerar ingen fullständig land- eller språklista i lanseringsinlägget.
Google presenterade samtidigt Gemini 3.5 Flash Cyber, en specialmodell för att hitta och rätta säkerhetsbrister i kod. Den är inte allmänt tillgänglig. Google planerar en begränsad pilot för myndigheter och betrodda partner genom säkerhetsverktyget CodeMender.
Jämförelserna av kvalitet, hastighet och motståndskraft bygger främst på Googles egna tester och utvalda kunduppgifter. Några hastighetsmått kommer från Artificial Analysis, men de säger inte vad modellerna kostar eller presterar i en viss svensk verksamhets egna flöden.
Varför det spelar roll
För verksamheter som bygger AI-stöd kan modellvalet påverka både svarstid och löpande kostnad. En billigare modell kan passa enkla uppgifter i stor volym, medan en mer kapabel modell kan behövas när underlaget är blandat eller arbetet har många steg. Prislistan ersätter inte ett test med verkliga uppgifter, säkerhetskrav och mänsklig granskning.
Gör så här
- Mät kostnad, svarstid och kvalitet på samma representativa uppgifter innan ni byter modell.
- Använd den lättare modellen för enkla flöden först och flytta bara svårare fall till en dyrare modell.
- Begränsa verktyg och behörigheter när en modell får styra datorn eller andra system, särskilt medan funktionen är i förhandsversion.