Miksi AI-mallisi loistaa yhdessä tehtävässä ja kompuroi toisessa: domain-tason totuus LLM:n itseymmärryksestä
Frontier-mallit ovat kuuluisia epätasaisuudestaan – ne loistavat käytännön tiedossa mutta kompuroivat muodollisessa päättelyssä. Puretaan massiivinen 33-mallin tutkimus, joka paljastaa tekoälyn …