GPT-6 Intelligent UI: interaktive svar i ChatGPT

Intelligent UI er en funktion i ChatGPT, hvor GPT-6 kan forme et svar som en interaktiv brugerflade med tekst, knapper, formularer og diagrammer. Du kan dermed undersøge en forklaring ved at ændre dens input. Det ændrer præsentationen, men dokumenterer ikke i sig selv, at forklaringen er korrekt.

Artiklens hovedpointer:

Interaktive AI-svar kan gøre det muligt at afprøve en forklaring ved at ændre dens input, men layoutet dokumenterer ikke korrekthed. GPT-6 Intelligent UI kombinerer tekst og betjening i ChatGPT, mens faglig kontrol, dansk talformatering, tilgængelighed og behandling af personoplysninger fortsat kræver en konkret vurdering.

Hvad har OpenAI lanceret?

OpenAI annoncerede GPT-6 med Intelligent UI den 7. oktober 2026. Funktionen kan blandt andet skabe sammenligninger og små beregnere direkte i samtalen. Modellen kan også vælge almindelig tekst.

Nyheden handler dermed om både modellen og den måde, svaret præsenteres på. Et praktisk spørgsmål ved vurderingen er, om samspillet mellem de to gør en bestemt opgave lettere at løse og kontrollere.

Hvordan bliver brugerfladen bygget?

OpenAI beskriver et bibliotek af indbyggede komponenter og en compiler, som behandler grænsefladen, mens modellen genererer den. Delene kan derfor vises løbende, før hele svaret er færdigt.

Teknisk er der to forskellige vurderinger: om komponenterne fungerer, og om indholdet i dem holder. En knap kan reagere som forventet, selv om beregningen bag den bruger en forkert antagelse. En velordnet oversigt kan tilsvarende mangle en relevant mulighed.

Ved afprøvning giver det derfor mening at skelne mellem betjening og fagligt resultat. Hvis en beregner ændrer resultatet, når du ændrer et tal, viser det interaktion. Det viser først en korrekt beregning, når resultatet også stemmer med en uafhængig kontrol.

Hvem får adgang til de nye svar?

Den globale udrulning starter på Plus, Pro, Business og Enterprise den 7. oktober og udvides til Free og Go fra 8. oktober. Enterprise-adgang afhænger af administratorindstillinger. En udrulningsdato er ikke en bekræftelse på adgang for hver enkelt konto.

Modeller i Chat ved den annoncerede udrulning
AbonnementModel i Chat
Plus, Pro, Business og EnterpriseGPT-6 Sol
Free og GoGPT-6 Luna

Systemkortet skelner mellem oktoberudgaverne i Chat og de tidligere udgaver i Work og Codex. Navnet Sol er derfor ikke tilstrækkeligt til at fastslå produkt og version. Den tidligere lancering af GPT-6.1 Sol til komplekse arbejdsopgaver beskriver en anden opdatering.

Er en interaktiv brugerflade det samme som en AI-agent?

Interaktion og selvstændig handling er forskellige egenskaber. En AI-agent kan indgå i et system, der bruger værktøjer til at udføre en opgave. En beregner i et svar kan derimod nøjes med at vise, hvordan et resultat ændrer sig.

Et illustrativt eksempel er en plan for et arrangement. Du kan forestille dig en brugerflade, hvor antal deltagere ændrer et beregnet budget. Det er ikke det samme som, at systemet bestiller lokaler eller overfører penge. Sådanne handlinger kræver særskilte funktioner og rettigheder.

Lanceringen dokumenterer ikke, at et interaktivt svar kan erstatte et færdigt eksternt driftssystem. Hvis en arbejdsproces omfatter andre tjenester, må dens funktioner, tilladelser og kontrolpunkter undersøges særskilt.

Bliver svarene mere pålidelige af at være interaktive?

Et layout er ikke en kilde. En AI-hallucination kan også optræde som en forkert figurtekst, et opdigtet beløb eller en manglende betingelse i en formular.

OpenAIs systemkort beskriver sikkerhedsforbedringer, men også tilbagegang i nogle evalueringer. Flere prøver bruger særligt vanskelige tilfælde og udføres uden tjenestens øvrige sikkerhedsværn. Deres fejlrater kan ikke læses som fejlhyppigheden i almindelig ChatGPT-brug.

Den praktiske vurdering er derfor at undersøge det konkrete svar. Hvilke data bygger det på? Hvilke antagelser er indbygget? Kan resultatet efterprøves? At en model har klaret en test bedre, besvarer ikke automatisk disse spørgsmål for en bestemt beregner eller forklaring.

Hvordan kan du kontrollere et lille beregningsværktøj?

En enkel afprøvning kan adskille fejl i input, regneregel og visning. Følgende er et illustrativt kontrolforløb, ikke et målt resultat for Intelligent UI:

  1. Beskriv reglen med ord. Ved ligelig deling af en udgift er reglen det samlede beløb divideret med antal deltagere.
  2. Brug et kendt resultat. En udgift på 600 kroner fordelt på tre deltagere skal give 200 kroner pr. person.
  3. Ændr én størrelse ad gangen. Seks deltagere ved samme udgift skal give 100 kroner pr. person.
  4. Undersøg et randtilfælde. Nul deltagere skal håndteres som et ugyldigt input frem for et meningsfuldt fordelingsresultat.
  5. Sammenhold resultatet med en separat beregning, før det bruges i en beslutning.

For mere sammensatte opgaver kan en lille test kun vise, at de afprøvede tilfælde fungerer. Den dokumenterer ikke, at alle input eller skjulte antagelser er dækket. Et værktøj med renter, afgifter eller særlige aftalevilkår kræver kontrol af netop disse regler.

Hvad kan det betyde for undervisning og studier?

En mulig anvendelse er at undersøge sammenhænge ved at ændre én variabel ad gangen. I en undervisningsøvelse kunne en elev først forudsige et resultat, derefter afprøve det og til sidst forklare forskellen. Det gør elevens begrundelse til en del af arbejdet med grænsefladen.

Det er en didaktisk mulighed, ikke dokumentation for bedre læring. Lanceringen fremlægger ikke en undersøgelse, der viser, at Intelligent UI forbedrer elevers forståelse eller karakterer. En undervisningsaktivitet må vurderes ud fra dens faglige mål og det, eleverne faktisk kan forklare efterfølgende.

Kritisk tænkning med AI kan her omfatte at finde antagelser, formulere modeksempler og forklare, hvorfor et resultat gælder. En tekstlig forklaring kan være et nyttigt supplement, når interaktionen gør det svært at følge argumentet trin for trin.

Hvad ændrer det for virksomheder og offentlige arbejdspladser?

En mulig anvendelse er at afprøve en oversigt eller en beregning, før den omsættes til en fast arbejdsgang. Som eksempel kunne en medarbejder undersøge, hvordan et tænkt projektbudget fordeler sig mellem aktiviteter. Det er en afprøvning med opstillede forudsætninger, ikke et valideret økonomisystem.

NISTs AI Risk Management Framework behandler risici gennem AI-systemers udvikling, brug og evaluering. Rammen er frivillig og kan støtte en systematisk vurdering; den er hverken dansk lov eller en godkendelse af ChatGPT.

  • Faglig kvalitet: Passer oplysninger og beregninger til opgaven?
  • Betjening: Kan medarbejderen forstå input, resultat og begrænsninger?
  • Ansvar: Hvem kontrollerer resultatet, før det anvendes eller deles?
  • Dokumentation: Kan de relevante forudsætninger gengives, så en kollega kan efterprøve dem?

Disse kontrolpunkter er en praktisk fortolkning af behovet for evaluering. Den relevante gevinst må måles på den konkrete opgave, eksempelvis tid inklusive efterkontrol og antal rettelser. Lanceringen dokumenterer ikke en bestemt tidsbesparelse på arbejdspladser i Danmark.

Hvilke forhold skal afprøves på dansk?

Den globale annoncering indeholder ikke særskilte resultater for kvalitet på dansk. Et relevant lokalt forsøg kan derfor undersøge både formuleringer og talbehandling i det arbejdssprog, som medarbejdere eller studerende bruger.

Illustrative testpunkter er, om en brugerflade skelner mellem decimalkomma og tusindtalsseparator, viser kroner frem for en antaget anden valuta og bruger datoer entydigt. Hvis et felt indeholder tallet 1,5, må den valgte fortolkning være tydelig i resultatet.

Det er foreslåede kontrolpunkter, ikke konstaterede fejl i funktionen. En forståelig dansk etikette dokumenterer heller ikke korrekt behandling af en lokal regel. Hvis en beregning afhænger af danske regler eller en organisations egne vilkår, må disse forudsætninger fremgå og kontrolleres mod de relevante kilder.

Hvad betyder interaktive svar for GDPR og data?

GDPR-vurderingen følger behandlingen af personoplysninger. Den nye svarform dokumenterer ikke i sig selv, hvor data lagres, hvem der kan få adgang til dem, eller om de må bruges til et bestemt formål.

Datatilsynets cloudvejledning beskriver den dataansvarliges ansvar for overblik over leverandørkæden og behandlingerne. Væsentlige ændringer i behandlingsaktiviteter kan kræve en fornyet risikovurdering. Adgang fra et tredjeland kan også udgøre en overførsel, selv om oplysningerne lagres i EU.

For en organisation, der overvejer at indtaste kunde-, personale- eller elevoplysninger, bliver vurderingen derfor konkret: Hvilke oplysninger behandles, på hvilket grundlag og med hvilke modtagere? Hvilke vilkår og sikkerhedsforanstaltninger gælder for det valgte abonnement og eventuelle tilknyttede tjenester?

En første afprøvning med opdigtede eksempler kan undersøge funktion og betjening uden at inddrage virkelige personoplysninger. Det erstatter ikke en senere vurdering af en faktisk arbejdsproces. Artiklen lægger heller ikke til grund, at UI-lanceringen ændrer leverandørens datavilkår.

Hvordan kan tilgængeligheden undersøges?

W3C’s forklaring af WCAG-kriteriet om tastaturbetjening beskriver, at funktionalitet som udgangspunkt skal kunne betjenes via et tastatur. Der er en afgrænset undtagelse for funktioner, hvis underliggende input afhænger af selve bevægelsesbanen. Tastaturadgang har blandt andet betydning for personer med syns- eller bevægelseshandicap.

Ved afprøvning af en interaktiv forklaring kan du undersøge, om det relevante input kan ændres uden mus, og om det nye resultat kan findes og forstås. En figur med flere tilstande bør også vurderes ud fra, hvordan brugeren får adgang til den samme faglige forklaring.

Det er kontrolprincipper, ikke en konklusion om ChatGPTs overholdelse af WCAG. En konkret tilgængelighedstest kræver adgang til den faktiske brugerflade og de hjælpemidler, målgruppen anvender. Artiklen dokumenterer ikke en sådan test.

Hvilke kilder ligger til grund?

Funktion og adgang bygger på OpenAIs lancering af GPT-6 med Intelligent UI. Modelversioner og testforbehold er kontrolleret i oktoberudgavernes systemkort. Den praktiske fortolkning støttes af NISTs ramme for AI-risikostyring, Datatilsynets cloudvejledning og W3C’s forklaring af tastaturbetjening.