Configuración de modelos

Gestor de modelos locales

Prepara en este navegador los recursos de segmentación, puntos faciales, detección de objetos, OCR y ejecución antes de usar las herramientas de IA local.

Paquetes de modelos ONNX (recorte / ampliación / borrado)

Estos paquetes impulsan el recorte con IA, la ampliación con IA y el borrado inteligente. Prepáralos aquí o deja que cada herramienta prepare su modelo la primera vez que la uses. Los modelos se descargan una sola vez, quedan en caché en este navegador y tus imágenes nunca salen de tu dispositivo.

Consejo para quien administra el sitio: ejecuta npm run models:fetch en el repositorio para incluir los modelos junto al sitio y que quienes lo visiten no necesiten ninguna descarga externa.

Modelo de recorte · Rápido (U²-Net small)

Recorte general ligero para exportar PNG transparentes rápidamente.

Disponible
Tamaño: 4.6 MB · Licencia: Apache-2.0Se usa en: Recorte IA · Fondo carné · Foco

Modelo de recorte · Calidad (Silueta)

Recorte general equilibrado con bordes claramente mejores en personas, productos y mascotas.

Disponible
Tamaño: 42.6 MB · Licencia: Apache-2.0Se usa en: Recorte IA · Fondo carné

Modelo de recorte · Máximo (ISNet)

Recorte general de máxima calidad, incluido el pelo y los bordes finos. Descarga grande.

Disponible
Tamaño: 170.0 MB · Licencia: Apache-2.0Se usa en: Recorte IA

Modelo de ampliación (Real-ESRGAN x4v3)

Ampliación 2x y 4x con reconstrucción de detalle para fotos y gráficos.

Disponible
Tamaño: 4.8 MB · Licencia: BSD-3-ClauseSe usa en: Ampliar IA

Modelo de borrado (MI-GAN)

Relleno generativo para quitar marcas de agua, transeúntes y objetos con reconstrucción natural.

Disponible
Tamaño: 27.0 MB · Licencia: MITSe usa en: Borrar objetos

Compatibilidad del navegador

Comprobando las capacidades del navegador…

Recursos de IA locales

La precarga guarda los runtimes y los pesos de los modelos en la caché de este navegador. Al procesar, las herramientas leen primero los recursos ya almacenados.

Runtime de visión MediaPipe

Ejecuta los modelos de segmentación y de puntos faciales en el propio navegador.

Precargar
Tamaño del recurso: 21.7 MBRuta del runtime: CPU / WebAssemblyHerramientas: Desenfoque de fondo, Foco en el sujeto, Quitar el fondo, Fondo para foto de carné, Herramientas de retratoPrecargar

Modelo de segmentación de retrato

Separa a las personas del fondo para el desenfoque de fondo, el foco en el sujeto, el PNG transparente y los fondos de foto de carné.

Precargar
Tamaño del recurso: 0.24 MBRuta del runtime: CPU / WebAssemblyHerramientas: Desenfoque de fondo, Foco en el sujeto, Quitar el fondo, Fondo para foto de carnéPrecargar

Modelo de puntos faciales

Lee la geometría del rostro para colocar el maquillaje y ajustar el tono del retrato, difuminar caras y previsualizar dientes, ojos y color de pelo.

Precargar
Tamaño del recurso: 3.59 MBRuta del runtime: CPU / WebAssemblyHerramientas: Vista previa de maquillaje, Vista previa de color de pelo, Mejorar luz del retrato, Difuminar caras por privacidad, Blanqueamiento dentalPrecargar

Modelo de segmentación del pelo

Detecta directamente la zona del pelo para la vista previa de color y una mayor protección del rostro.

Precargar
Tamaño del recurso: 0.75 MBRuta del runtime: CPU / WebAssemblyHerramientas: Vista previa de color de peloPrecargar

Modelo detallado de segmentación de partes del retrato

Separa pelo, piel del rostro, piel del cuerpo, ropa y accesorios para lograr efectos de retrato y color de pelo más precisos. Se descarga al usarlo por primera vez y queda en caché.

Precargar
Tamaño del recurso: 15.6 MBRuta del runtime: CPU / WebAssemblyHerramientas: Vista previa de color de pelo, Efectos de retratoPrecargar

Modelo de detección de objetos

Ejecuta la detección de objetos en el navegador para recuentos, inspecciones, etiquetas, estanterías, plazas de aparcamiento y otras herramientas de revisión visual.

Precargar
Tamaño del recurso: 4.50 MBRuta del runtime: CPU / WebAssemblyHerramientas: Auditoría de estantería, Etiquetas de almacén, Detección de plazas, Recuento de hojasPrecargar

Modelo YOLO nano universal

Ejecuta la detección de objetos YOLO en el navegador para objetos contables habituales como tazas, cuencos, botellas, vajilla, paquetes, personas y vehículos.

Precargar
Tamaño del recurso: 7.50 MBRuta del runtime: CPU / WebAssemblyHerramientas: Contador universal de objetos, Recuento visual localPrecargar

Paquete de modelo ONNX opcional para vajilla

Detecta objetos de mesa contables como palillos, brochetas de bambú, pinchos, platos, platillos, cuencos y tazas con un vocabulario fijo.

Precargar
Tamaño del recurso: 28.0 MBRuta del runtime: CPU / WebAssemblyHerramientas: Contador universal de objetos, Recuento de palillos, Recuento de vajillaPrecargar

Paquete de modelo ONNX opcional para palillos

Prioriza los extremos visibles de brochetas de bambú, pinchos, varillas de muestra y marcadores finos.

Precargar
Tamaño del recurso: 7.50 MBRuta del runtime: CPU / WebAssemblyHerramientas: Recuento de palillos en bandejaPrecargar

Modelos RapidOCR PP-OCRv4

Detección y reconocimiento de texto basado en PaddleOCR, con mayor precisión sobre todo en chino.

Precargar
Tamaño del recurso: 15.0 MBRuta del runtime: CPU / WebAssemblyHerramientas: OCR de imagen, Flujos de documentosPrecargar

Runtime de OCR del navegador

Carga el runtime de Tesseract.js del mismo origen, el núcleo LSTM y los datos rápidos de inglés y chino simplificado.

Precargar
Tamaño del recurso: 24.4 MBRuta del runtime: CPU / WebAssemblyHerramientas: Extraer texto (OCR), Flujos de trabajo de documentosPrecargar

Publicidad