Google har presenterat två nya modeller för Gemini Live, tjänsten där användaren pratar med AI:n med rösten. Nyheten är att Gemini Live i högre grad ska kunna hålla igång ett naturligt samtal samtidigt som den granskar det du visar med kameran eller arbetar med en uppgift i bakgrunden.
Rösthjälpen ska kunna följa med i samtalet
I praktiken kan det till exempel handla om att be om hjälp att felsöka något hemma medan du visar det med mobilen, eller att resonera igenom en uppgift utan att behöva vänta tyst medan AI:n tänker. Google säger också att modellen kan växla mellan 97 språk under samma samtal.
Den enklare modellen heter Gemini 3.8 Live och är gjord för snabba, löpande samtal. Gemini 3.8 Live Extended Thinking är avsedd för mer krävande uppgifter med flera steg. Där kan AI:n ge en kort bekräftelse och fortsätta prata medan den arbetar vidare i bakgrunden.
För vanliga användare är den viktigaste förändringen inte modellnamnen, utan att röststyrd AI kan bli mindre lik en fråga-svar-tjänst. Tanken är i stället att du ska kunna prata, visa och följa upp som i ett vanligt samtal.
Samtidigt är det klokt att kontrollera viktiga svar själv. En AI kan misstolka det den ser, missa sammanhang eller ge fel råd. Det gäller särskilt frågor om pengar, hälsa, juridik och säkerhet.
Google uppger att Gemini 3.8 Live börjar rullas ut i Search Live, medan den mer avancerade Extended Thinking-versionen också kommer till Gemini Live och vissa delar av Googles arbetsverktyg. Tillgången kan variera mellan tjänster, abonnemang och marknader.
Källor
Läs också
Ämnen i artikeln
- Gemini Live
- Röstassistenter