A partir de un documento digitalizado (PDF con o sin OCR, DOCX, imagen escaneada, texto), el asistente propone valores para los campos de las normas internacionales del Consejo Internacional de Archivos. Desarrollado en Python puede ser ejecutado localmente

Machine Translate es un wiki colaborativo dedicado a conformar una Wiki de referencia sobre traducción automática para traductores y terminólogos.

AustLang es una base de datos en línea de lenguas aborígenes de Australia e isleñas del Estrecho de Torres. Funciona como recurso de investigación y punto de partida fiable para conocer y aprender sobre estas lenguas. Permite consultar datos descriptivos sobre cada lengua, su localización y la descarga de datos

GROBID Tools es una herramienta web para extraer metadatos bibliográficos y datos de citas en documentos PDF. Utiliza PDF.js y pdf-lib.

Librería de código abierto que convierte Word, PowerPoint, Excel, PDF y otros formatos a Markdown con formato de GitHub. Dispone de interfaz de linea de comandos y formulario web

Marker convierte documentos PDF, imágenes, PPTX, DOCX, XLSX, HTML y EPUB a Markdown, JSON y HTML

Herramienta de código abierto, basada en Rust, que clasifica archivos PDF y convierte a texto desde archivos PDF.

Repositorio de evaluaciones comparativas para IAs. Analiza agentes y modelos, los entornos que los soportan y los chips en los que se ejecutan

El Embedding Projector de TensorFlow (projector.tensorflow.org) es una herramienta web gratuita e interactiva para visualizar y analizar datos de alta dimensionalidad (vectores o embeddings) en espacios tridimensionales o bidimensionales.

El Banco de datos terminológicos de las Ciencias de la información ofrece y recopila datos terminológicos de la archivística, la bibliotecología, la museología y la documentación.<br /> Es de acceso libre y contiene información terminológica monolingüe en español con equivalentes en portugués e inglés.