Modelarkitekturer
Den halvdel af en model, der skriver output ét token ad gangen, hvor hvert nyt token kun bygger på det, der kom før.
Formelt
En stak af lag i et neuralt netværk, hvor hvert token kun må kigge på tidligere tokens, så stakken kan gætte næste token, føje det til teksten og gentage; rene decoder-designs dropper encoderen helt.
Forklaret enkelt
Som en historiefortæller ved lejrbålet, der kan høre alt, hvad der er sagt indtil nu, men aldrig kigger frem, og lægger ét ord til ad gangen.
I praksis
En produktejer i en webshop ser, at produkttekster, der er dobbelt så lange, tager omtrent dobbelt så lang tid at lave og koster det dobbelte, fordi decoderen skal frembringe hvert token for sig.
Hvorfor det betyder noget
Næsten alle store sprogmodeller er rene decodere, og derfor kommer svar gradvist, og derfor er det svarets længde, ikke kun spørgsmålets, der driver prisen.