Spring til indhold
AiNews.dkDanske nyheder om Kunstig Intelligens

Frontier

AI-telefoner overtager kundeservice

GPT-Live-1 kan lytte og tale samtidig og koster 0,05 dollar i minuttet.

1 kildeVedtaget af NIel AutopilotRettet 10. september 2026 kl. 20.37

Læs i dit tempo

Kort

OpenAI har udgivet talemodellen GPT-Live-1 til udviklere via API, som kan lytte og tale samtidigt.

Modellen klarer sig markant bedre end tidligere versioner i tests, med hurtigere svar og højere præcision, hvilket gør den attraktiv for virksomheder som Yelp.

Udviklere kan nu bruge modellen mod betaling per minut, og flere detaljer følger i API-dokumentationen.

Begynder

OpenAI har nu gjort deres nye talemodel, GPT-Live-1, tilgængelig for udviklere gennem en API, som er en slags digital forbindelse, der lader andre programmer bruge modellen. Denne model kan både lytte og tale samtidig, hvilket kaldes full-duplex. Det betyder, at den kan forstå dig, mens du stadig taler, ligesom i en naturlig samtale, hvor man afbryder og svarer uden at vente på stilhed. Modellen er allerede i brug inde i ChatGPT, så mange kender den derfra.

Udviklere kan vælge at kombinere GPT-Live-1 med andre bagvedliggende modeller, alt efter hvad opgaven kræver. På den måde kan de styre, hvor dybt modellen skal tænke, hvor hurtigt den svarer, og hvad det koster. Prisen er fastsat til 0,05 dollar per minut, hvilket svarer til cirka 35 øre. Et eksempel på brug er firmaet Yelp, som bruger modellen til telefonbaserede reservationer. Deres tekniske chef, Alex Levy, siger, at modellen håndterer opkald bedre end tidligere løsninger.

Sammenlignet med sine forgængere klarer GPT-Live-1 sig markant bedre på OpenAIs egne tests. I test af full-duplex-interaktion scorer den 80,1 procent, hvor den tidligere model GPT-Realtime-2.1 kun nåede 45,4 procent. Tiden for at skifte mellem at tale og lytte er også faldet fra 1,4 sekunder til 0,8 sekunder. Når modellen skal bruge værktøjer, som at lave en reservation, er præcisionen steget fra 60 procent til 87 procent. I en test med bankstemme-support, hvor kunder skal guides gennem en opgave, stiger gennemførelsesraten fra 12,4 procent til 32 procent.

GPT-Live-1 kommer også med tolv nye stemmer, der dækker forskellige accenter, dialekter og sprog. Den leverer automatisk transskriptioner af tale og svartekst, så udviklere nemt kan få tekst ud af samtalerne. Alle tekniske detaljer vil være at finde i API-dokumentationen, som er den officielle vejledning til udviklere.

Redaktionel illustration til „AI-telefoner overtager kundeservice“
Genereret illustration · ikke et fotografi fra historien

OpenAI gør GPT-Live-1 tilgængelig for udviklere som API. Talemodellen kan lytte og tale på samme tid, en egenskab der kaldes full-duplex, og den kører allerede inde i ChatGPT.

Udviklere kan parre modellen med forskellige bagvedliggende modeller afhængigt af opgaven, så de kan matche ræsonnementets dybde, hastighed og pris til hvert brugstilfælde. Prisen er 0,05 dollar per minut.

Yelp bruger modellen til telefonbaserede reservationer og rapporterer bedre håndtering af opkald, ifølge CTO Alex Levy.

På OpenAIs benchmarks klarer GPT-Live-1 sig markant bedre end sine forgængere. I full-duplex-interaktionstests scorer den 80,1 procent mod 45,4 procent for GPT-Realtime-2.1. Latensen for turtagning falder til 0,8 sekunder fra 1,4 sekunder. Præcisionen i værktøjskald springer til 87 procent fra 60 procent. I et benchmark for bankstemme-support når GPT-Live-1 en gennemførelsesrate på 32 procent, op fra 12,4 procent for den tidligere model.

GPT-Live-1 leveres også med tolv nye stemmer, der spænder over forskellige accenter, dialekter og sprog. Den giver ASR-transskriptioner og svartekst ud af boksen. Fuldstændige detaljer vil være tilgængelige i API-dokumentationen.

Kilder

  1. OpenAI's GPT-Live-1 API lets developers build apps that talk and listen at the same time the-decoder.com
Produktionshistorie
  1. Radar Signal ? af 100 · spredning 1 kilder
  2. Vurdering Nyheds 5/5 — Ny API til realtids tale og lytning, direkte relevant for udviklere.
  3. Skrevet Model: deepseek-v4-flash · temperatur 0.4
  4. Overskrift 5 kandidater, valgt af deepseek-v4-flash
  5. Billede Genereret af gemini-2.5-flash-image
  6. Vedtagelse ainews-auto-v3 · score 0.4431