• Idioma es exacto "Inglés"
El Embedding Projector de TensorFlow (projector.tensorflow.org) es una herramienta web gratuita e interactiva para visualizar y analizar datos de alta dimensionalidad (vectores o embeddings) en espacios tridimensionales o bidimensionales.

Repositorio de evaluaciones comparativas para IAs. Analiza agentes y modelos, los entornos que los soportan y los chips en los que se ejecutan

Herramienta de código abierto, basada en Rust, que clasifica archivos PDF y convierte a texto desde archivos PDF.

Marker convierte documentos PDF, imágenes, PPTX, DOCX, XLSX, HTML y EPUB a Markdown, JSON y HTML

Librería de código abierto que convierte Word, PowerPoint, Excel, PDF y otros formatos a Markdown con formato de GitHub. Dispone de interfaz de linea de comandos y formulario web

GROBID Tools es una herramienta web para extraer metadatos bibliográficos y datos de citas en documentos PDF. Utiliza PDF.js y pdf-lib.

AustLang es una base de datos en línea de lenguas aborígenes de Australia e isleñas del Estrecho de Torres. Funciona como recurso de investigación y punto de partida fiable para conocer y aprender sobre estas lenguas. Permite consultar datos descriptivos sobre cada lengua, su localización y la descarga de datos

Machine Translate es un wiki colaborativo dedicado a conformar una Wiki de referencia sobre traducción automática para traductores y terminólogos.

Presidio es un conjunto de herramientas de código abierto desarrolladas mayormente en Python orientadas a identificar y anonimizar información de identificación personal (PII) en textos, imágenes y datos estructurados.

Texture es un conjunto de herramientas diseñado para la producción de contenido científico-académico. Utiliza el formato Dar, que define una versión más estricta del estándar XML JATS ().

La Base de conocimientos es una colección de documentos, informes, políticas y estadísticas relevantes para las políticas de Acceso Abierto (Open Access) en el contexto de la Unión Europea. La colección se creó en el marco del proyecto PALOMERA

Etiquetas


Ernie (cuyo nombre completo es Enhanced Representation through kNowledge IntEgration) es un modelo de lenguaje grande (LLM) desarrollado por la empresa tecnológica china Baidu. Fue entrenado desde cero con una enorme cantidad de datos en idioma chino (mandarín y cantonés), está diseñado para conectar palabras y frases con una "base de conocimiento" estructurada (hechos sobre el mundo real, entidades, relaciones) a partir de la integración con el buscador de Baidu

Herramienta ofrece una interfaz navegable para explorar las entidades, atributos y relaciones dentro del marco Record-in-Context (RiC-CM). Incluye un formulario que permite simular el proceso de registro de entidades, relaciones y atributos según el modelo.

Etiquetas

, ,

F-UJI es una herramienta que evalúa el grado de cumplimiento de 16 de las 17 métricas principales de evaluación de objetivos FAIR. Ofrece una perspectiva uniforme y comparable entre plataformas del grado de cumplimiento de métricas de interoperabilidad, diponibilidad, accesibilidad y portabilidad de los recursos. Desarrollada y provista por FAIRsFAIR

AnyStyle es una herramienta libre desarrollada en Ruby que permite parsear (analizar y procesar) citas académicas redactadas según pautas normalizadas y reconvertirlas a diferentes estructuras (XML, JSON, etc)

Fatcat es un repositorio que compila, resguarda y disponibiliza artículos, comunicaciones, set de datos y recursos científicos y académicas. El proyecto es mantenido y provisto por InternetArchive.

Scripts PHP generan un juego de cartas en PDF de la ontología CIDOC-CRM a partir del archivo RDF de la versión 7.1.2 de CIDOC CRM. Con este juego de cartas, puede implementar un modelo semántico de CIDOC CRM en una mesa, comprender cómo funciona la ontología de CIDOC CRM y realizar una lluvia de ideas sobre el desarrollo de un modelo de datos. El juego se puede consultar https://ontomatchgame.huma-num.fr/papercards/

Local Contexts es un proyecto orientado a formalizar categorías de atribución y descripción de derechos y propiedad en relación con la gestión de materiales del patrimonio cultural de manera acorde a las nociones de conocimiento de algunas comunidades indígenes. El proyecto surgió a partir de problemas abordados en la gestión de la plataforma Mukurtu CMS. Contempla vocabularios para categorías como Conocimiento tradicional, Datos bioculturales y otros <br />

DraCor es una infraestructura digital abierta desarrollada para el estudio computacional del drama (principalmente) europeo desde la antigüedad grecorromana hasta el siglo XX. El proyecto dispone de una API de consulta y expone los corpus codificados en TEI. Es mantenido por Frank Fischer.

OLAC (Open Language Archives Community) es una iniciativa que reúne y describe archivos dedicados a identificar, describir y preservar archivos lingüísticos