SinLlama -- A Large Language Model for Sinhala
cs.CL
Submitted: 2025-08-12
Updated: 2026-08-31
DOI: 10.1109/MERCon67903.2025.11217094
Code: https://github.com/openai/tiktoken
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- The Llama 3 Herd of Models
- Gemma: Open Models Based on Gemini Research and Technology
- Survey on Publicly Available Sinhala Natural Language Processing Tools and Research
- BERTifying Sinhala -- A Comprehensive Analysis of Pre-trained Language Models for Sinhala Text Classification
- MaLA-500: Massive Language Adaptation of Large Language Models
- Aya Model: An Instruction Finetuned Open-Access Multilingual Language Model
- GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding
- Mistral 7B
- MEGA: Multilingual Evaluation of Generative AI
- LlamaTurk: Adapting Open-Source Generative Large Language Models for Low-Resource Language
- TaCo: Enhancing Cross-Lingual Transfer for Low-Resource Languages in LLMs through Translation-Assisted Chain-of-Thought Processes
- Adaptive Machine Translation with Large Language Models
- Zero-shot Sentiment Analysis in Low-Resource Languages Using a Multilingual Sentiment Lexicon
- RoBERTa: A Robustly Optimized BERT Pretraining Approach
- PolyLM: An Open Source Polyglot Large Language Model
- The Falcon Series of Open Language Models
- Crosslingual Generalization through Multitask Finetuning
- Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone
- OPT: Open Pre-trained Transformer Language Models
- BigTranslate: Augmenting Large Language Models with Multilingual Translation Capability over 100 Languages
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering