Google DeepMind afslører Gemini 2.0 AI-model med nativ billede- og lydoutput

Google DeepMind afslører Gemini 2.0 AI-model med nativ billede- og lydoutput

Mindre end et år efter debuten af ​​Gemini 1.5 var Googles DeepMind-afdeling tilbage onsdag for at afsløre AI’s næste generations model, Gemini 2.0. Den nye model tilbyder indbygget billed- og lydoutput og “vil gøre os i stand til at bygge nye AI-agenter, der bringer os tættere på vores vision om en universel assistent,” skrev virksomheden i dets annonceringsblogindlæg.

Fra onsdag er Gemini 2.0 tilgængelig på alle abonnementsniveauer, inklusive gratis. Som Googles nye flagskibs-AI-model kan du forvente at se den begynde at drive AI-funktioner på tværs af virksomhedens økosystem i de kommende måneder. Som med OpenAI’s o1-model er den første udgivelse af Gemini 2.0 ikke virksomhedens fuldgyldige version, men snarere en mindre, mindre kapabel “eksperimentel preview”-iteration, der vil blive opgraderet i Google Gemini i de kommende måneder.

Anbefalede videoer

“Effektivt,” fortalte Google DeepMind CEO Demis Hassabis The Verge“det er lige så godt, som den nuværende Pro-model er. Så du kan tænke på det som en hel række bedre, for den samme omkostningseffektivitet og ydeevne effektivitet og hastighed. Det er vi rigtig glade for.”

Google udgiver også en letvægtsversion af modellen, døbt Gemini 2.0 Flash, til udviklere.

Introduktion til Gemini 2.0 | Vores hidtil mest dygtige AI-model

Med udgivelsen af ​​en mere dygtig Gemini-model fremmer Google sin AI-agentdagsorden, som ville se mindre, specialbyggede modeller tage selvstændige handlinger på brugerens vegne. Gemini 2.o forventes at øge Googles bestræbelser på at udrulle sit Project Astra markant, som kombinerer Gemini Lives samtaleevner med video- og billedanalyse i realtid for at give brugerne information om deres omgivende miljø gennem en smart brillegrænseflade.

Google annoncerede også onsdag udgivelsen af Projekt Marinervirksomhedens svar på Anthropics computerkontrolfunktion. Denne Chrome-udvidelse er i stand til at styre en stationær computer, inklusive tastetryk og museklik, på samme måde som menneskelige brugere gør. Virksomheden udruller også en AI-kodningsassistent kaldet Jules, der kan hjælpe udviklere med at finde og forbedre clunky kode, samt en “Deep Research”-funktion, der kan generere detaljerede rapporter om de emner, du får den til at søge på internettet efter.

Deep Research, som ser ud til at tjene samme funktion som Perplextiy AI og ChatGPT Search, er i øjeblikket tilgængelig for engelsksprogede Gemini Advanced-abonnenter. Systemet fungerer ved først at generere en “flertrinsforskningsplan”, som det indsender til brugeren til godkendelse inden implementering.

Når du har tilmeldt dig planen, vil forskningsagenten foretage en søgning på det givne emne og derefter hoppe ned i alle relevante kaninhuller, den finder. Når den er færdig med at søge, vil AI’en lave en rapport om, hvad den har fundet, inklusive nøgleresultater og henvisningslinks til, hvor den fandt sine oplysninger. Du kan vælge det fra chatbottens rullemenu for valg af model øverst på Gemini-hjemmesiden.

Støt vores arbejde ❤️

Hvis du kunne lide denne artikel, kan du overveje at give drikkepenge for at hjælpe os med fortsat at udgive kvalitetsindhold.

Sikker betaling med PayPal