Recursos

Explora los datos y recursos usados en LatamGPT

Catálogo Referencial del Corpus

El Catálogo Referencial de LatamGPT (v1.0) es la guía esencial para entender la composición del corpus de datos en esta primera etapa. Resume la historia de las alianzas institucionales que hicieron posible el proyecto y detalla la gobernanza de los datos, abarcando las políticas de gestión de riesgo, los marcos de licencias y los criterios éticos y legales aplicados a la información de la región.

LatamGPT
Catálogo Referencial

Copuchat - Contribuye con Datos

Copuchat es una aplicación experimental basada en LatamGPT-SFT, nuestro modelo de lenguaje de código abierto, que simula conversaciones reales con usuarios de América Latina y el Caribe para mejorar el alineamiento de futuras versiones de LatamGPT.

Ayuda a mejorar LatamGPT y participa en conversaciones anónimas que serán útiles para entrenar el modelo.

Abrir Copuchat

Participa en conversaciones para contribuir al entrenamiento de LatamGPT

CopuChat
Interfaz de chat interactiva
Nuevo recurso

Construye el benchmark latinoamericano

Trueque necesita tu conocimiento. Ayuda a crear el benchmark de preguntas sobre conocimiento y cultura latinoamericana más grande de la región, generando preguntas sobre tu país, tu historia y tu cultura.

Súmate a construir el benchmark de conocimiento más grande de Latinoamérica.

Trueque
Tu conocimiento, tu región

Reporte Técnico

El reporte técnico de LatamGPT ya está disponible. Descárgalo para conocer en detalle la metodología, los datos y los resultados del proyecto.

LatamGPT
Reporte Técnico

Modelo LatamGPT 1.0

LatamGPT-SFT-1.0 es la primera versión del modelo de lenguaje latinoamericano, basado en Llama 3.1 de 70 mil millones de parámetros y entrenado con Continued Pretraining (CPT) y Supervised Fine-Tuning (SFT) utilizando datos regionales.

Descarga el modelo directamente con Hugging Face.

Ver en Hugging Face

Modelo disponible en Hugging Face

LatamGPTCPT + SFT v1.0
70B
Parámetros
CPT + SFT
Entrenamiento
Modelo baseLlama 3.1

Trueque Benchmark

Trueque es un benchmark de evaluación colaborativo y revisado por humanos para medir el desempeño de LLMs en preguntas sobre conocimiento y cultura latinoamericana.

Explora las 500 preguntas curadas sobre historia, cultura, geografía y gastronomía de 20 países de América Latina.

Ver en Hugging Face

Dataset disponible en Hugging Face

Trueque BenchmarkBeta v0.1
500
Preguntas
20
Países
LicenciaApache 2.0
IdiomasES / PT

CHOCLO

CHOCLO es un benchmark especializado en conocimiento cultural latinoamericano para evaluar qué tan bien los modelos de lenguaje comprenden y representan la cultura de la región.

Más de 100.000 filas con preguntas sobre geografía, fauna, flora, tradiciones, gastronomía y figuras públicas de 18 países, con tres niveles de dificultad.

Ver en Hugging Face

Dataset disponible en Hugging Face

CHOCLO
104K+
Filas
18
Países
LicenciaMIT
Categorías7