Tag: cinco

Cohere lanza Parse 5 (parse-v5.0): un modelo de lenguaje de visión de 2.300 millones que convierte documentos empresariales en rebajas[0]Cohere ha lanzado Parse (parse-v5.0), un modelo de análisis de documentos destinado a la ingesta empresarial de gran volumen. Es un modelo de lenguaje de visión de 2,300 millones de parámetros con una ventana de contexto de 8192 tokens y un espacio de ~4,6 GB, construido sobre la arquitectura North-Micro-Vision-Instruct de Cohere Labs. Parse toma una página PDF, PPT o JPEG como un URI de datos codificados en base64 y devuelve Markdown que contiene texto en orden de lectura, tablas representadas como HTML, listas, pares clave-valor, descripciones de imágenes y coordenadas del cuadro delimitador. No hay una etapa de OCR separada frente a él. Cohere fija el precio de la API de Parse a 1,50 dólares por cada 1.000 páginas y posiciona el modelo según la relación precio-rendimiento en lugar de la máxima precisión, una afirmación que la empresa respalda con una puntuación ParseBench autoinformada de 79,2 que, como detallamos a continuación, mide tres de las cinco dimensiones de ese punto de referencia. ¿Es desplegable? Sí, en producción. Parse generalmente está disponible a través de Cohere Parse API, Microsoft Foundry, AWS SageMaker y Model Vault de un solo inquilino. No hay lista de espera ni licencia de investigación. Qué empresas: Los equipos del mercado medio que ya ejecutan una pila RAG pueden comenzar con llamadas API medidas con una clave de prueba gratuita. Las grandes empresas con requisitos de residencia o de espacio aéreo van directamente a Model Vault o a una implementación privada. Las nuevas empresas en etapa inicial pueden usarlo, pero la economía solo comienza a importar a partir de aproximadamente 100.000 páginas al mes. Qué industrias: Cohere apunta a servicios financieros, seguros, atención médica y ciencias de la vida, sector público, telecomunicaciones, energía y manufactura: las verticales con gran cantidad de documentos donde los formularios escaneados y las tablas densas son la norma. Aplicaciones: ingesta de RAG, procesamiento inteligente de documentos, procesamiento de reclamaciones y facturas, búsqueda de contratos y presentaciones, y brindar contexto de documentos a los agentes. ¿Qué es el análisis? Parse es un modelo de lenguaje de visión de 2,300 millones de parámetros construido sobre la arquitectura North-Micro-Vision-Instruct de Cohere Labs, con una ventana de contexto de 8192 tokens y una huella de ~4,6 GB. Acepta páginas PDF, PPT y JPEG como URI de datos codificados en base64 y devuelve Markdown que contiene texto del documento, listas, tablas representadas como HTML, coordenadas del cuadro delimitador y descripciones de imágenes. No hay una etapa de OCR separada frente a él. El modelo recupera el texto y el orden de lectura, tablas, listas, formularios y pares clave-valor, imágenes y leyendas, y la ubicación de los límites de las páginas y los elementos visuales en una sola pasada. Nueve idiomas figuran como estables (árabe, inglés, francés, alemán, italiano, japonés, coreano, portugués y español) con soporte de disparo cero en otros lugares con menor precisión. En la práctica, dos modos de salida importan. El valor predeterminado devuelve una cadena Markdown por página. Configurar output_format=”blocks” devuelve bloques escritos, donde un bloque de tabla lleva su HTML, su cuadro delimitador y una descripción. Ese segundo modo es lo que hace posible la trazabilidad a nivel de cita. ‘+d

+’‘+d.toFixed(d?1:2)+’ ‘; }).unirse(”); } var dibujado=falso; función dibujarBarras(){ si(dibujado)retorno;dibujado=verdadero; filas(document.getElementById(‘setA’),A); filas(document.getElementById(‘setB’),B); setTimeout(función(){ .slice.call(document.querySelectorAll(‘.fill’)).forEach(function(f){f.style.width=f.dataset.w+’%’}); tamaño(); },60); } tamaño de función(){ try{parent.postMessage({mtpHeight:document.body.offsetHeight+40},’*’)}catch(e){} } window.addEventListener(‘load’,size); window.addEventListener(‘cambiar tamaño’,tamaño); setTimeout(tamaño,300);setTimeout(tamaño,900); })();

En 2023, se estima que uno de cada cinco artículos biomédicos en inglés contenía rastros lingüísticos de escritura asistida por IA. En diciembre de 2025, era casi nueve de cada diez, parte de un cambio de vocabulario que, según los investigadores, ya había superado incluso la perturbación máxima causada por el COVID-19.

Una nueva estimación sugiere que las huellas lingüísticas asociadas con grandes modelos lingüísticos se propagan a través de las publicaciones biomédicas en inglés a una velocidad extraordinaria. En 2023, la…

Dieciséis personas momificadas y un cánido momificado se acumularon en una única cámara lateral egipcia de poco más de cinco metros de largo durante al menos tres siglos, y los ataúdes que estructuraron los primeros entierros habían dejado de aparecer por completo en los últimos.

La arqueotanatología interpreta un entierro a partir de la posición del cuerpo: qué articulaciones aún están articuladas, qué toca el cuerpo, dónde se encuentra en el sedimento. Es el método…