arXiv cs.CL
· Papers
Evaluating Dedicated Monolingual and Joint Multilingual Causal Models for Dravidian Languages
arXiv:2608.07727v1 Announce Type: new Abstract: Dravidian languages, mainly Tamil, Telugu, Kannada, and Malayalam make up only a small part of the data used to train multilingual language models, so it's not clear how much per-language ability these models actually keep. I have trained five GPT-2 architecture models fr