매일 아침, 어제의 AI를 한 통으로 정리해 보내드립니다메일로 받아보기

METAL LAB

Evaluating Dedicated Monolingual and Joint Multilingual Causal Models for Dravidian Languages

arXiv:2608.077272026-08-11

arXiv:2608.07727v1 Announce Type: new Abstract: Dravidian languages, mainly Tamil, Telugu, Kannada, and Malayalam make up only a small part of the data used to train multilingual language models, so it's not clear how much per-language ability these models actually keep. I have trained five GPT-2 architecture models from scratch to compare four monolingual models (one each for Tamil, Telugu, Kannada, and Malayalam, each with its own 32K-vocabulary subword tokenizer) against one multilingual mode

저자 · Venkata Naga Sai Vishnu Rohit Pulipaka

arXiv에서 원문 보기