Ordlista
Transformer
En AI-modellarkitektur, introducerad 2017, som ligger till grund för de flesta moderna stora språkmodeller.
Transformer-arkitekturen introducerade en mekanism kallad attention, som gör det möjligt för modellen att väga betydelsen av olika delar av en text i förhållande till varandra, oavsett avstånd mellan dem. Detta gjorde det möjligt att träna betydligt större och mer kapabla språkmodeller än tidigare arkitekturer klarade av. GPT, Claude och Gemini bygger alla, i olika varianter, på transformer-arkitekturen.

Skrivet av
Simon TernRelaterade termer
Deep Learning
En gren av maskininlärning som använder neurala nätverk med många lager för att lära sig komplexa mönster i data.
LLM
Large language model, en stor AI-modell tränad på enorma mängder text för att förstå och generera språk.
Neurala Nätverk
En typ av AI-modell inspirerad av hjärnans struktur, uppbyggd av sammankopplade noder organiserade i lager.
Fler frågor om transformer?
Jag hjälper er reda ut vad som faktiskt spelar roll för er verksamhet.
Prata med Simon →