Ladin digital tools News
UI language
Login
Archiv

News archive

New project notes and publications will appear here when they are available.

9 News 9 Papers
Archiv

Latest updates

Project notes, releases, and research updates in a calmer reading layout.

06 05.2026
Publicaziun Samuel Frontull und Thomas Ströhle

Kontextualisierung als Schlüssel: Optimierung der maschinellen Übersetzung für das Ladinische mit großen Sprachmodellen

Wir freuen uns mitteilen zu können, dass unsere Forschungsarbeit "Every Word Presented in Context: Syntactic Coverage as Objective for Low-Resource Machine Translation with Large Language Models" für die 15th Language Resources and Evaluation Conference (LREC 2026) akzeptiert wurde. Die Ergebnisse unserer Studie werden am 15. Mai in Palma de Mallorca präsentiert.

20 03.2026
Publicaziun Samuel Frontull und Simon Haller-Seeber

AlignFix: Unser Tool für parallele Korpora bei der EACL 2026!

Wir freuen uns bekannt zu geben, dass unser Beitrag zu AlignFix für die EACL 2026 in Marokko akzeptiert wurde!

13 02.2026
Publicaziun Simon Haller-Seeber und Samuel Frontull

KI-gestützte Transkription, Übersetzung und Zusammenfassung in Echtzeit – mit besonderem Fokus auf das Ladinische

Wir freuen uns, die Veröffentlichung unserer wissenschaftlichen Dokumentation zu TransLoco bekanntzugeben – einem frei verfügbaren, selbst gehosteten Framework, das Audio in Echtzeit transkribiert, übersetzt und automatisch zusammenfasst. Das Projekt wurde im Rahmen der Konferenz Medien-Wissen-Bildung 2025 erstmals live demonstriert.

26 01.2026
News

KI-basierte Schreibassistenz für das Ladinische

Im Rahmen unseres Forschungsprojekts am Institut für Informatik der Universität Innsbruck in Kooperation mit dem Ladinischen Kulturinstitut "Micurá de Rü" veröffentlichen wir nun einen ersten Prototyp für eine intelligente ladinische Schreibassistenz.

04 12.2025
Publicaziun

WMT 2025 - Bringing Ladin to FLORES+

Wir freuen uns, einen wichtigen Meilenstein unserer gemeinsamen Forschungsarbeit vorstellen zu können. Mit dem Beitrag „Bringing Ladin to FLORES+“ wurde Ladin in den internationalen Evaluationsdatensatz FLORES+ für maschinelle Übersetzung integriert. Unsere Arbeit wurde im Rahmen der Open Language Data Initiative Shared Task 2025 in Suzhou (China) präsentiert.

Research

Papers and publications

Open project papers directly as PDFs. Cards show the first-page preview when an image is available.

Every Word Presented in Context: Syntactic Coverage as Objective for Low-Resource Machine Translation with Large Language Models
2026 LREC 2026

Every Word Presented in Context: Syntactic Coverage as Objective for Low-Resource Machine Translation with Large Language Models

Samuel Frontull and Thomas Ströhle

This paper introduces Fragment-Shot Prompting, a few-shot prompting method that retrieves examples for every word in the input sentence. It evaluates low-resource translation between Italian, Ladin Val Badia, and Ladin Gherdëina across several large language models.

Open PDF
AlignFix: A Tool for Parallel Corpora Augmentation and Refinement
2026 EACL 2026 System Demonstrations

AlignFix: A Tool for Parallel Corpora Augmentation and Refinement

Samuel Frontull and Simon Haller-Seeber

AlignFix is an open-source browser-based tool for augmenting, inspecting, and correcting parallel corpora. It uses word alignments to extract consistent phrase pairs, support targeted replacements, and keep alignments updated locally on the client side.

Open PDF
TransLoco: AI-Driven Real-Time Transcription, Translation, and Summarization
2026 Medien - Wissen - Bildung 2025

TransLoco: AI-Driven Real-Time Transcription, Translation, and Summarization

Simon Haller-Seeber and Samuel Frontull

TransLoco is a self-hosted free-software framework for near real-time transcription, translation, and summarization of audio streams. The paper presents a local deployment path for advanced AI tools and includes an Italian-Ladin translation model optimized for fast inference.

Open PDF
Bringing Ladin to FLORES+
2025 WMT 2025 Shared Task Papers

Bringing Ladin to FLORES+

Samuel Frontull, Thomas Ströhle, Carlo Zoli, Werner Pescosta, Ulrike Frenademez, Matteo Ruggeri, Daria Valentin, Karin Comploj, Gabriel Perathoner, Silvia Liotto, and Paolo Anvidalfarei

This paper extends the FLORES+ dataset for the Ladin Val Badia and Gherdëina variants and releases additional parallel datasets. It validates the resources with state-of-the-art large language models and neural machine translation systems.

Open PDF
LaTeXMT: Machine Translation for LaTeX Documents
2025 EMNLP 2025 System Demonstrations

LaTeXMT: Machine Translation for LaTeX Documents

Calvin Hoy, Samuel Frontull, and Georg Moser

LaTeXMT is a structure-preserving source-to-source translation tool for LaTeX documents. It separates translatable text from document structure so machine translation systems can process LaTeX source while preserving markup.

Open PDF
Rule-Based, Neural and LLM Back-Translation: Comparative Insights from a Variant of Ladin
2024 LoResMT 2024

Rule-Based, Neural and LLM Back-Translation: Comparative Insights from a Variant of Ladin

Samuel Frontull and Georg Moser

This paper compares rule-based, neural, and large-language-model back-translation for machine translation in the Val Badia variant of Ladin. It establishes baseline results and analyzes the effect of synthetic data in a low-resource setting.

Open PDF
Traduzione automatica "neurale" per il ladino della Val Badia
2024 Ladinia XLVIII

Traduzione automatica "neurale" per il ladino della Val Badia

Samuel Frontull and Georg Moser

This article presents a neural machine translation approach for the Val Badia variant of Ladin. It discusses low-resource translation challenges, limited parallel data, and the role of Dolomitic Ladin variants.

Open PDF
Arbeitsbericht: Maschinelle Übersetzung für das Gadertalische
2022 Ladinia XLVI

Arbeitsbericht: Maschinelle Übersetzung für das Gadertalische

Samuel Frontull and Tobias Hell

This working report documents machine translation for Gadertal Ladin, framing Ladin as a low-resource language and discussing data, methods, and digital language technology for a protected minority language.

Open PDF
2023 News

Presentazione al Convegno Lessicografia tradizionale e in rete in una quotidianità plurilingue

Al convegno scientifico “Lessicografia tradizionale e in rete in una quotidianità plurilingue” dedicato a Luca Serianni (30-31 marzo 2023, Eurac Research, Bolzano) abbiamo presentato il nostro contributo “Traduzione automatica per il ladino della Val Badia”. In questa relazione è stato esaminato come la traduzione automatica neurale (NMT) possa essere applicata al ladino, nonostante le risorse di dati limitate e la presenza di diverse varietà regionali. La presentazione ha reso visibili i primi risultati della ricerca e ha mostrato come le moderne tecnologie di traduzione possano essere trasferite a una lingua con risorse limitate.

Open PDF