Google har lige kastet sig ind i kampen om AI-agenter med deres nye Gemini 2.5 Computer Use – en AI-model der kan navigere på nettet præcis som du og jeg gør det. Og timingen? Perfekt beregnet til at stjæle rampelyset fra OpenAI, der netop havde deres store Dev Day.
Perfekt timing til at crashe OpenAI’s fest
Det var næppe en tilfældighed, at Google lancerede deres nye AI-browser-agent præcis én dag efter OpenAI’s Dev Day 2025. Mens OpenAI stadig fejrede deres ChatGPT Agent-nyheder, kom Google og sagde: “Hold min øl og se på det her.” Det er klassisk tech-drama på højeste niveau.
En AI der faktisk forstår hvad den ser
Gemini 2.5 Computer Use bruger “visuel forståelse og ræsonnement” til at analysere brugeranmodninger og udføre opgaver gennem browser-interfaces. Den kan udfylde formularer, klikke på knapper og navigere komplekse webapplikationer – alt sammen uden at have brug for traditionelle API’er. Det er som at have en meget hurtig praktikant, der aldrig bliver træt.
Teknologien har allerede været testet gennem Project Mariner, hvor AI’en kunne tilføje ingredienser til en Safeway-indkøbskurv baseret på opskrifter. Nu er det bare blevet kommercielt tilgængeligt for udviklere.
Chrome får det største upgrade nogensinde
Google har ikke bare lavet en AI-model – de har genopbygget hele Chrome som et AI-system med Gemini integreret direkte i browseren. Systemet studerer dine søgemønstre, læsevaner og browseradfærd for at forudsige dine behov og reagere proaktivt.
Den forbedrede Chrome kan behandle sider i realtid, huske sites du besøgte for dage siden, og integrere direkte med YouTube, Maps og Calendar. Plus den kan blokere svindel før det loader og automatisk omskrive kompromitterede passwords.
Nummer ét på benchmarks
Modellen rangerer som nummer ét på flere benchmarks og overgår både Anthropic’s Claude 4.5 Sonnet og OpenAI’s computer agent. Google hævder at levere industriens førende browser-kontrol med lav latency – og det er ikke bare marketingssnak.
Fokuseret tilgang med begrænsninger
Google har taget en bevidst fokuseret tilgang sammenlignet med konkurrenterne. Mens ChatGPT Agent og Anthropic’s værktøjer kan kontrollere hele desktop-miljøer, begrænser Gemini 2.5 Computer Use sig til browser-interaktioner. Google erkender at modellen “endnu ikke er optimeret til desktop OS-niveau kontrol” og understøtter kun 13 specifikke handlinger.
Tilgængeligt nu for udviklere
Gemini 2.5 Computer Use er nu tilgængelig i preview gennem både API’en og Google AI Studio. Der er endda en demo på Browserbase, hvor du kan se den spille 2048 eller browse Hacker News for trending debatter.
Med denne lancering har Google officielt meldt sig ind i den intenst konkurrenceprægede AI-agent-arena. Deres browser-fokuserede tilgang tilbyder en mellemvej mellem fuld desktop-kontrol og traditionel API-baseret automatisering – og det kunne vise sig at være præcis det, markedet har brug for.




