Image OCR is now available with a New badge from both the main task area and the first position in the side shortcut menu. Fast supports Chinese, English, German, Spanish, Portuguese and French; Professional and Ultimate add Japanese. Models use a public download source first, switch automatically to the matching site-hosted file when needed, and reuse verified browser cache entries. Results rebuild visual rows, paragraphs and table columns from text-box geometry. Copy and TXT preserve source rows and separate table columns with tabs, and copying shows an immediate success confirmation. Regular column runs become Markdown tables, while JSON retains raw and corrected text, coordinates and confidence. The right panel uses a compact layout preview with collapsible line proofreading. The current unified model excludes Korean and does not claim arbitrary handwriting or formula semantics as reliable capabilities.
Lo que ya está disponible y lo que viene después
Un registro público del producto para sus usuarios. Solo incluye cambios que ya pueden utilizarse o percibirse; los planes futuros aparecen por separado y no se incluyen detalles operativos internos.
Ya están disponibles la composición multicapa, los filtros profesionales y el retoque de piel. El siguiente paso incorpora recorte, texto, formas, selecciones y edición local.
Ya disponible
Las siguientes entradas describen únicamente funciones, correcciones y mejoras visibles que ya se pueden utilizar.
New local multilingual image OCR workspace
Image OCR is now available with a New badge from both the main task area and the first position in the side shortcut menu. Fast supports Chinese, English, German, Spanish, Portuguese and French; Professional and Ultimate add Japanese. Models use a public download source first, switch automatically to the matching site-hosted file when needed, and reuse verified browser cache entries. Results rebuild visual rows, paragraphs and table columns from text-box geometry. Copy and TXT preserve source rows and separate table columns with tabs, and copying shows an immediate success confirmation. Regular column runs become Markdown tables, while JSON retains raw and corrected text, coordinates and confidence. The right panel uses a compact layout preview with collapsible line proofreading. The current unified model excludes Korean and does not claim arbitrary handwriting or formula semantics as reliable capabilities.
Animation Workshop reduces GIF and APNG delta size and improves multi-format defaults
GIF safely stores local changes and automatically clears full frames when a transparent outline changes, preventing ghosting. Animations that use exactly 256 colours also keep every real colour instead of sacrificing one for delta transparency. On the current 685×150, 134-frame sample, default GIF and APNG outputs are both about 1.17 MB and all 134 decoded frames remain pixel-identical to the source; the same APNG is about 6.55 MB with full frames. Colour-rich, high-frame-count material defaults to animated WebP, and multi-format ZIP export follows the selected delta- or full-frame mode.
Faster video matting without changing the current quality path
After previewing and confirming the first video frame, full export now reuses the established high-quality first-frame matte and temporal state, continuing from the next frame instead of repeating the most expensive calibration. Frame processing avoids unnecessary image copies and repeated memory preparation, while progress and output previews update at a steadier pace for a more responsive long-video workflow. The Experimental Ultimate model, RVM ResNet50 hair calibration, ten first-frame refinements, five-frame temporal-memory cadence, scene-cut rebuilding, aspect-matched analysis size and final output pixels remain unchanged.
AI cutout now starts local inference correctly on mobile WeChat and desktop
On first use, mobile WeChat and desktop browsers can now load and start local inference without stopping because a runtime address cannot be resolved or the inference backend fails after the model download completes. Mobile keeps the memory-safe Fast AI choice, while desktop retains Fast, Pro and Ultimate models. Models still use the public download source first, switch automatically to the site fallback when needed, and reuse completed browser downloads.
La compresión PDF continúa exactamente donde la dejaste
La compresión PDF conserva ahora el archivo actual, el ajuste, el modo de vista previa y el resultado generado al cerrar su ventana. Al volver a abrirla se restaura una vista previa válida en lugar de mostrar un archivo dañado. La lista de decisiones por imagen utiliza todo el espacio restante en pantallas altas y sigue siendo desplazable en pantallas más bajas, por lo que los detalles de la compresión ya no se cortan encima de una zona vacía.
Más gráficos, tablas y texto escalables al convertir HTML a PDF
HTML a PDF evita ahora que las sombras comunes conviertan gráficos, tablas o regiones de texto completas en imágenes cuando se puede conservar la apariencia; los efectos complejos sin equivalencia demostrada permanecen intactos. La minimización sin pérdidas se prepara en paralelo con la conversión y fusiona de forma recursiva las imágenes y máscaras de transparencia idénticas en la misma escritura. Así ya no hace falta volver a cargar el resultado en la compresión PDF para descubrir otra reducción estructural. En el informe actual de 14 páginas con muchos gráficos se mantienen el número y la geometría de las páginas, los fondos, las marcas de agua y las sombras; el texto extraíble sube de unos 1.297 a 2.716 caracteres, una sola pasada automática reduce el archivo de unos 4,82 MB a 1,56 MB y la generación de páginas de unos 5,3 a 2,6 segundos. El ahorro depende del contenido; Canvas, las imágenes reales y los efectos que requieren salida ráster siguen siendo contenido de píxeles.
Archivos PDF a HTML mucho más pequeños sin perder fidelidad de página
El motor local de diseño fijo avanza a la versión 1.3. Los componentes vectoriales, trazados y estilos de presentación repetidos que pueden compartirse con seguridad se guardan una sola vez en todo el documento, mientras que las fuentes TrueType y OpenType incrustadas con permiso se almacenan en un contenedor WOFF sin pérdidas. El proceso no reduce la calidad de las imágenes, no rasteriza las páginas ni elimina o sustituye fuentes permitidas; los componentes complejos sin equivalencia demostrada se conservan completamente desplegados. En el informe actual de 15 páginas con numerosos gráficos, la salida baja de 12.719.382 bytes a unos 4,75 MB, manteniendo las 15 páginas, 29 fuentes incrustadas, texto seleccionable y todos los gráficos. El ahorro depende de cuánto contenido reutilizable tenga cada PDF. El resultado sigue siendo un único HTML listo para abrir sin conexión y sin controles de visor.
Experiencias completas en español y portugués
El orden de idiomas es ahora Chino / EN / Japonés / Coreano / DE / ES / PT / FR. El español y el portugués incluyen, además de Inicio, los espacios de imagen y vídeo, la compresión de PDF, PDF a HTML, HTML a PDF, las guías y el historial de versiones. La primera visita reconoce las variantes regionales habituales de es y pt en la lista completa de preferencias del navegador; las URL con idioma explícito y la selección manual siempre tienen prioridad. Los diseños amplios muestran los nombres completos y los espacios reducidos usan etiquetas cortas, manteniendo las ocho opciones en una sola línea sin tapar la marca, el tema ni las herramientas.
Diseño online se convierte en un espacio de trabajo multipágina
Un proyecto de Diseño online puede contener hasta 24 páginas independientes, cada una con su propio tamaño de lienzo, fondo, imágenes, texto multilingüe editable y filtros. Los preajustes respetan las dimensiones reales e identifican los tamaños no estándar como personalizados. Las fuentes bajo demanda se redibujan al terminar de cargar y un cambio de fuente solo afecta a la capa de texto seleccionada. Se mantiene la exportación de una página y se añaden ZIP por páginas y HTML multipágina autónomo de alta resolución. El formato abierto .imging avanza a v3 con compatibilidad con v1 y v2.
Modo seguro para WeChat y protección de memoria para el recorte con IA en móvil
Los navegadores de WeChat, iPhone y Android comprueban la compatibilidad del modelo antes de descargarlo. Fast AI sigue disponible; Pro AI y Ultimate AI se identifican como exclusivos de escritorio y explican el motivo antes de descargar recursos de mucha memoria. Las fotos muy grandes conservan su proporción y usan un presupuesto de píxeles seguro para el dispositivo, sin recortes ni deformaciones. La vista compacta, el refinamiento profesional, la composición de fondo, la eliminación rápida de color y la exportación comparten dimensiones seguras. Los controles y objetivos táctiles son mayores en móvil; las imágenes permanecen en el dispositivo y el escritorio conserva todos los modelos y la salida a resolución completa.
Selección precisa entre seis idiomas a partir de toda la lista ordenada del navegador
El chino, inglés, japonés, coreano, alemán y francés reconocen sus variantes regionales y de escritura habituales. Si la primera preferencia no es compatible, se recorre la lista ordenada hasta encontrar el primer idioma admitido; solo se usa inglés cuando ninguno coincide. La elección manual y una URL de idioma explícita siempre tienen prioridad, evitando cambios incorrectos por país, proxy o detecciones posteriores. Inicio y los cinco accesos de imagen, vídeo y PDF comparten la misma regla.
PDF a HTML y HTML a PDF muestran de forma coherente su estado oficial
Las tarjetas de Inicio, los accesos y títulos de los espacios, las presentaciones y las guías ya no marcan PDF a HTML ni HTML a PDF como Beta. Los seis idiomas existentes permanecen alineados. El cambio refleja su estado oficial sin ocultar los límites de reconstrucción fija, compatibilidad del navegador o conversión Chromium en el servidor; el recorte de vídeo sigue en Beta.
Capas de texto multilingües en exportación de imágenes, diseño en línea y refinamiento profesional
La compresión y la exportación conservan la marca de agua de texto arrastrable y añaden fuentes para chino, inglés, japonés, coreano, alemán y francés. Diseño online incorpora capas de texto editables e independientes con contenido, fuente, tamaño, color, alineación, interlineado, opacidad, escala, rotación, orden y efectos 2.5D; el refinamiento profesional usa la misma capa de marca de agua. Las fuentes se cargan y almacenan en caché al seleccionarlas por primera vez, y vista previa y exportación esperan la misma fuente. El formato abierto .imging avanza a v2 con parámetros de texto legibles y compatibilidad con v1. Tras convertir HTML a PDF se bloquea el fotograma exacto de salida para que los efectos hover no lo cambien, y la decoración de Inicio se pausa al abrir un espacio a pantalla completa.
Experiencias completas en coreano y francés en un sistema de seis localidades
El orden de los idiomas ahora es chino/EN/japonés/coreano/DE/FR, utilizando etiquetas completas en pantallas anchas y etiquetas cortas de una línea en pantallas estrechas. El coreano y el francés son experiencias completas en lugar de botones solo de Inicio: ambos incluyen Inicio, espacios de trabajo de imágenes y videos, compresión de PDF, PDF a HTML, HTML a PDF, doce guías de tareas e historial de versiones. Las URL locales explícitas siempre ganan; Las primeras visitas a Inicio o a los cinco accesos directos al espacio de trabajo ahora coinciden con las preferencias del navegador en coreano y francés, mientras que los idiomas no admitidos siguen usando el inglés. Abrir o cerrar un espacio de trabajo, presionar Escape y navegar hacia atrás conservan el idioma activo.
Opciones separadas en chino, inglés, japonés y alemán con rutas localizadas completas
La barra superior muestra chino, EN, japonés y DE como cuatro opciones separadas con un estado activo visible. Las pantallas estrechas utilizan etiquetas cortas de una línea sin sobrecargar el control de marca o tema. La selección manual se almacena localmente y prevalece sobre la detección automática; una opción de consulta de un solo uso mantiene la conmutación confiable cuando el almacenamiento está bloqueado y se elimina inmediatamente después de la lectura. Las primeras visitas a Inicio y los cinco accesos directos al espacio de trabajo coinciden con las preferencias del navegador en chino, japonés o alemán y, en caso contrario, vuelven al inglés; Las URL locales explícitas nunca son secuestradas. Las cuatro configuraciones regionales incluyen rutas de espacios de trabajo, guía de tareas, notas de la versión y enlaces de idiomas homólogos.
Compresión de PDF con DPI de dos ejes, imágenes en línea y limpieza estructural basada en el contenido
La compresión de PDF continúa optimizando la estructura del documento original sin una reconstrucción HTML de ida y vuelta. El análisis de imágenes agrega la ubicación horizontal y vertical de forma independiente en cada uso, lo que permite que la ubicación no uniforme elija cada dimensión objetivo de forma segura. Las matrices de decodificación se aplican por componente, mientras que los espacios de color que no pueden demostrarse equivalentes permanecen intactos. Las imágenes en línea BI/ID/EI analizadas de forma segura se promocionan a Image XObjects estándar y entran en la misma clasificación, DPI efectivo y codificación que las imágenes incrustadas ordinarias. Los operadores de contenido impulsan la eliminación conservadora de fuentes, imágenes, estados de gráficos, espacios de color, patrones, sombreados y propiedades no utilizados; Los operadores desconocidos o flujos especiales mantienen su conjunto completo de recursos. Los flujos de contenido de páginas fragmentadas se fusionan sólo en límites léxicos seguros y sólo cuando son más pequeños. Las transmisiones de Flate existentes también ejecutan una nueva codificación sin pérdidas y cambian solo cuando gana. La salida se vuelve a leer para verificar el recuento de páginas, los cuadros de páginas, el texto seleccionable y la semántica de enlaces, con respaldo automático cuando la verificación difiere o el archivo completo no es más pequeño.
Las salidas del espacio de trabajo ahora restauran de manera confiable la URL de inicio y el idioma activo
Se corrigió el diseño en línea, el formato de video, la compresión de PDF, el cierre de PDF a HTML y de HTML a PDF visualmente mientras se deja el acceso directo a la herramienta en la barra de direcciones después de la importación, vista previa o procesamiento. Ya sea que se inicie desde Inicio o se abra directamente, X, Escape y el navegador Atrás ahora cierran el espacio de trabajo y restauran / para chino o /en/ para inglés. La actualización permanece en Inicio en lugar de volver a abrir la herramienta cerrada.
HTML a PDF con páginas reales y minimización genérica de vectores/recursos de fuentes sin pérdidas
HTML a PDF Beta mantiene Importar → Vista previa → Convertir explícitamente → Minimización automática → Guardar directo. Un solo HTML ofrece una vista previa inmediata, mientras que una carpeta completa puede autorizar CSS, imágenes, fuentes, scripts y datos relativos. La conversión resuelve documentos.fuentes, imágenes, gráficos y lienzos solo después de que el usuario hace clic en Convertir, luego deriva la geometría verdadera de CSS @page, metadatos por página de diseño fijo o el tamaño renderizado completo en lugar de aplicar A4 oculto. El ajuste preestablecido automático ahora es genéricamente sin pérdidas: no reconoce una biblioteca de gráficos o una plantilla SVG, pero promueve rutas rellenas matemáticamente idénticas en flujos de contenido PDF a formularios compartidos, preservando al mismo tiempo la transformación, el color, el alfa y el recorte de cada llamada. Las fuentes chinas y latinas visibles permanecen intactas; El dibujo de glifos de tipo 3 se compacta a sus métricas originales solo cuando se demuestra que cada uso es invisible y nunca recorta el texto. Los píxeles de la imagen no se vuelven a muestrear ni a codificar de forma predeterminada; imprimir 300 ppp, libros electrónicos y ajustes preestablecidos de pantalla requieren una elección explícita. El resultado se vuelve a leer para verificar el recuento de páginas, cada cuadro de página, los operadores de texto seleccionable y la semántica de enlaces, con respaldo automático cuando algo difiere o no existe un resultado menor. El tamaño final y el nombre de archivo sugerido se muestran antes de guardarlo directamente, sin volver a seleccionar la impresora ni el PDF. Durante la conversión, la acción superior mantiene un ancho fijo y una etiqueta de estado, mientras que las fases detalladas se actualizan solo en el panel de progreso, lo que evita que los controles del lado derecho parpadeen o cambien de flujo. Las fuentes, imágenes, gráficos dinámicos y mediciones de la página final ahora se preparan en una vista aislada invisible, por lo que la vista previa HTML de la fuente central nunca se recarga desde el clic hasta el guardado y la primera conversión ya no produce un destello blanco de página completa o un salto similar a una actualización. La vista previa instantánea ahora admite páginas de un solo archivo en espacio aislado que dependen de eval, WASM o Workers, y mantiene un estado de apertura explícito hasta que el iframe se haya cargado realmente en lugar de informar como completa una vista en blanco no renderizada. La configuración de fuente/imagen ahora informa recuentos reales completados, segundos transcurridos y una señal de progreso activo al mismo tiempo que distingue la decodificación local de las descargas de red. Las páginas dinámicas reutilizan las dimensiones reales medidas durante su primer renderizado aislado en lugar de cargar todas las fuentes e imágenes nuevamente simplemente para medir. Las páginas de diseño fijo ahora utilizan cada tamaño de página de metadatos directamente en lugar de derivar la altura de impresión a partir de una relación de aspecto; El recuento de páginas y cada cuadro de página se verifican antes de guardar para evitar páginas en blanco o desvíos de geometría. La capacidad de diseño se prepara antes de su uso y se reutiliza de forma segura entre trabajos, por lo que las páginas pequeñas ya no repiten una espera de inicio fija. Cuando no es necesario decodificar ninguna fuente web o imagen, la conversión continúa inmediatamente y el texto de progreso ya no sugiere una descarga de fuente.
PDF a HTML con máscaras entre versiones, color e informes de calidad específicos de la página
El motor local de diseño fijo ahora es la versión 1.2. Corrige gradientes invertidos e imágenes JPEG faltantes con SMask en archivos PDF de presentación reales, y agrega plantillas ImageMask de un bit, imágenes en línea, máscaras suaves JPEG, máscaras de luminosidad y alfa de estado gráfico común, respaldos basados en ICC, paletas indexadas, gradientes radiales y flujos de apariencia estática estándar para anotaciones y formularios. Se conservan el peso y el estilo de FontDescriptor, mientras que el contenido de la máscara suave y los glifos de tipo 3 se comparten entre páginas. El informe de calidad bilingüe asigna cada código de emisión a rangos de páginas exactos; CMYK JPEG, matrices Decode personalizadas, máscaras de clave de color, JPEG 2000, funciones especiales de transferencia de máscara suave y premultiplicación mate ya no se tratan silenciosamente como equivalentes.
Video Matting con nombres unificados y una declaración de calidad de nivel de laboratorio con alcance
Los iniciadores de inicio, el espacio de trabajo de video, las páginas de tareas bilingües y los pies de página ahora usan Video Matting de manera consistente. La función está posicionada como una versión Beta de laboratorio: el nivel máximo de MatAnyone2 entregó el mejor resultado general de mateado en muestras internas representativas actuales entre las soluciones comparables del lado del navegador evaluadas. La redacción también preserva el límite esencial de que se trata de un resultado interno provisional y con alcance en lugar de una clasificación absoluta de cada clip, dispositivo o producto industrial. Las URL /video y /video-editor/ existentes permanecen disponibles.
PDF a HTML con coordenadas de degradado corregidas, vectores más pequeños y una vista previa completa perfecta
El conversor de páginas limpias local lee CharProcs tipo 3, comparte contornos SVG idénticos en todo el documento y mantiene una capa de texto seleccionable transparente. Los patrones de mosaico PatternType 1 y los sombreados axiales PatternType 2 ahora usan la matriz de patrón absoluta ya proporcionada por el PDF en lugar de multiplicar nuevamente la matriz de gráficos activa. Esto restaura los gradientes de los gráficos en los archivos PDF de presentación de Chrome/Skia que anteriormente se colapsaron en un sólido oscuro. En un archivo de prueba real de 15 páginas, las definiciones repetidas de Tipo 3 disminuyeron de 3.625 a 1.012 y el tamaño de salida disminuyó de aproximadamente 6,3 MB a aproximadamente 4,38 MB. El informe ahora explica que los flujos de PDF comprimidos aún pueden expandirse cuando se representan como SVG sin secuencias de comandos y renderizado directamente con texto seleccionable. Un Web Worker entrega la página uno primero y continúa el mismo análisis para todas las páginas restantes; la vista previa se convierte automáticamente en el documento desplazable completo y Generar reutiliza ese resultado. Las páginas fuera de pantalla se muestran a pedido, al cerrarlas se descarga el documento y el PDF original sigue siendo un enlace de comparación opcional.
PDF a HTML con páginas de diseño fijo, fuentes con licencia y sin visor Chrome
La página de inicio ahora incluye un iniciador Beta de PDF a HTML además de accesos directos /pdf-html en ambos idiomas. El motor local de construcción propia analiza cuadros de páginas, rotación, flujos de contenido, estado de gráficos, matrices de texto, ToUnicode, vectores, imágenes, formularios y enlaces; Las páginas normales se convierten en SVG de diseño fijo con texto seleccionable. Las fuentes TrueType y OpenType se verifican a través de OS/2.fsType y solo se incluyen las fuentes permitidas; Las fuentes de licencia restringida y de mapa de bits nunca se copian. El HTML único contiene solo CSS, SVG, imágenes y fuentes que necesitan las páginas, sin cargas externas, controles de PDF JavaScript, zoom, informes, impresión o visor de PDF original. Las funciones no equivalentes, como JPEG 2000, sombreado de malla, recorte de texto y formularios complejos, permanecen en el informe por página del espacio de trabajo para comparar el origen antes de guardarlo. El resultado se abre sin conexión y utiliza un nombre de archivo sugerido cuando se guarda.
Flujo de guardado de un sistema para exportaciones, descargas y proyectos editables
La conversión y compresión de imágenes, el recorte de IA, la salida de animación en uno y tres formatos, las imágenes de diseño en línea, los proyectos .imging abiertos, el reemplazo de fondos de video y la compresión de PDF ahora usan un solo flujo de guardado. Desktop Chrome y Edge con la API de acceso al sistema de archivos muestran un cuadro de diálogo del sistema con un nombre sugerido seguro que no se sobrescribe y permiten al usuario confirmar el destino; Los trabajos largos de diseño, proyecto, paquete de animación y video eligen ese objetivo antes de codificar. WeChat, iPhone, Safari y Firefox mantienen un respaldo de descarga compatible y dirigen claramente a los usuarios a las descargas del navegador o a la aplicación Archivos.
Rutas directas confiables y colas de PDF seguras para la memoria
Al abrir /img, /pdf o sus equivalentes en inglés ahora se inicia de manera confiable el espacio de trabajo deseado. La importación de PDF por lotes ya no lee todos los archivos con entusiasmo: cada fuente se carga solo cuando se procesa, los bytes de fuente se liberan después, los objetos de archivo originales se reutilizan cuando la compresión no puede reducirlos, se aplican límites de archivo/recuento/total según el dispositivo, y una acción Borrar cola libera explícitamente los resultados retenidos.
Compresión de PDF que vuelve a codificar cada imagen incrustada en su DPI medido
Un espacio de trabajo de compresión de PDF ahora se encuentra debajo de la entrada del editor de video. El motor de creación propia analiza tablas de referencia externa, flujos de referencia externa y flujos de objetos localmente, recorre los flujos de contenido de cada página mientras rastrea la matriz de estado de los gráficos y deriva el DPI efectivo real de cada imagen incrustada; sólo se vuelven a muestrear las imágenes por encima del ajuste preestablecido elegido, con Lanczos-3. Cada imagen se clasifica mediante el clasificador de contenido ya calibrado de ImgIng, luego JPEG, Flate de paleta indexada, Flate en escala de grises y mantiene el original compitiendo y el más pequeño gana, con cada decisión enumerada. La escritura realiza una recopilación de accesibilidad, vuelve a desinflar secuencias sin comprimir, elimina datos privados y miniaturas y vuelve a empaquetar con secuencias de objetos; Luego, el resultado se vuelve a leer y se revierte si el recuento de páginas o cualquier cuadro de página difiere. Pantalla de 72 ppp, libro electrónico de 150 ppp, impresión de 300 ppp y ajustes preestablecidos de estructura sin pérdidas están disponibles junto con un tamaño de archivo de destino. Los archivos PDF y sus imágenes nunca salen del dispositivo y no se descarga ningún tiempo de ejecución adicional. Las fuentes no son subconjuntos, por lo que los PDF de solo texto ganan poco y los PDF cifrados, JPEG 2000, JBIG2 y JPEG de impresión CMYK no se modifican.
Capas de marcas de agua profesionales a través de conversión y compresión
Ingrese texto de marca en chino, inglés o agregue un logotipo PNG/WebP transparente. Colóquelo directamente sobre un lienzo compacto, cambie su tamaño y gírelo con manijas, luego ajuste el color, la opacidad, la ubicación y un tratamiento 2.5D plano o suave. La capa se vuelve a dibujar localmente en la resolución final, mientras que las marcas de agua deshabilitadas dejan sin cambios el comportamiento de codificación, almacenamiento en caché y preservación de fuente.
Tipografía de inicio más clara y legibilidad móvil
Títulos de tareas aumentados, descripciones de formato, insignias NUEVAS/BETA, promesas de confianza, orientación ampliable y texto de contacto de marca, junto con la altura y el espaciado de las tarjetas. El diseño móvil de dos columnas ahora permite que los títulos de tareas largos se ajusten a dos líneas sin recortes, aglomeraciones o desalineaciones.
Valores predeterminados más pequeños según el tipo de contenido
Recomendaciones reajustadas para fotografías, texturas, gráficos y alfa suave regulares y fluidos en torno a las líneas base oficiales de Squoosh y códec. El JPEG del navegador nativo conserva un margen adicional, WebP alfa se mantiene sin pérdidas en 100, las imágenes AVIF comunes del tamaño de un teléfono utilizan un nivel de esfuerzo más eficiente y la compresión del mismo formato aún mantiene la fuente siempre que la recodificación no sea más pequeña.
Limpia el héroe local y lanzadores de tareas directos.
Mantuvo la estructura existente de dos columnas y el convertidor completo mientras cambiaba el orden de la información a la tarea primero y la explicación después. Seis lanzadores abren conversión, compresión, recorte de IA, estudio de animación, diseño en línea y fondo de video directamente. Las promesas de procesamiento local, sin registro y sin marca de agua siguen siendo visibles, con detalles técnicos disponibles a pedido en inglés, chino y diseños móviles.
Procesamiento WebP local y correcciones de diseño móvil para iPhone WeChat
Las comprobaciones de capacidad de WebP ahora validan el tipo MIME real para que WebKit no pueda devolver PNG de forma silenciosa. Cuando la codificación Canvas WebP no está disponible, un codificador WASM libwebp autohospedado se carga bajo demanda mediante conversión, compresión del mismo formato, eliminación de fondo, diseño en línea y exportación de animaciones sin cargar píxeles. La escala de texto móvil, los controles de encabezado, los íconos de modo y los lanzadores flotantes ahora tienen tamaño, líneas de base y espaciado de área segura estables.
Selección del color de fondo del vídeo y corrección de vista previa instantánea
Se corrigieron los cambios de fondo que ocultaban un marco ya mate y revelaban el video fuente en blanco. Los cambios de color, imagen, desenfoque y modo de fondo ahora reutilizan el mate almacenado en caché para una recomposición instantánea sin volver a ejecutar la IA, mientras que el control muestra una muestra real y su valor hexadecimal.
Filtros profesionales, belleza sensible a la piel y proyectos abiertos.
Se agregaron alcances por capa de imagen y lienzo completo con 12 ajustes preestablecidos y 18 controles de luz, color, belleza y detalles sensibles a la piel. El suavizado que preserva los bordes nunca expande los contornos transparentes, el alfa se retiene píxel por píxel, las imágenes grandes utilizan bandas superpuestas seguras para la memoria y .imging almacena todos los parámetros, los recursos originales y una vista previa filtrada.
Correcciones de cabello, aspecto e introducción en blanco del primer fotograma del vídeo
Se corrigió un error en la carga útil de la máscara alternativa y la pérdida de cabello de bajo contraste en el nivel experimental. RVM ResNet50 ahora calibra el primer cuadro antes de la memoria temporal MatAnyone2; Las brechas estrechas se cierran en el tiempo lineal sin reemplazar el alfa suave original. Los videos horizontales, cuadrados, verticales y ultraanchos mantienen su relación de aspecto, mientras que las introducciones en blanco muestran el fondo elegido y continúan buscando un tema posterior.
Barras de desplazamiento y temas del editor claro/oscuro unificados
El diseño en línea, el editor de video y el refinamiento profesional ahora comparten los tokens de diseño del sitio en barras de herramientas, paneles, controles, lienzos, tarjetas y confirmación de salida. Cada espacio de trabajo también tiene un control de tema en el editor y barras de desplazamiento correspondientes.
Solución definitiva de superposición del estado del modelo de vídeo
Las tarjetas de modelo de vídeo ahora utilizan un título adaptable de dos columnas y un diseño de estado. El título largo de MatAnyone2 y el estado En caché para relación ya no se superponen, mientras que la descripción conserva el ancho completo de la fila.
Corrección de superposición del iniciador de inicio en inglés
Los lanzadores de Diseño en línea y Editor de video ahora comparten un contenedor de flujo automático en lugar de coordenadas verticales fijas separadas, preservando un espacio estable para textos envueltos en inglés y diseños responsivos.
Rutas de acceso directo bilingües a imágenes y vídeos
Se agregaron lanzadores directos /img, /video, /en/img y /en/video. Los usuarios de chino e inglés pueden abrir el espacio de trabajo correcto directamente desde la página de inicio o de una tarea y luego mantener el idioma activo al cerrarlo o navegar hacia atrás.
Corrección del tamaño de exportación de vídeo y de la tasa de bits
Se corrigió la salida de MP4 y WebM de gran tamaño después del reemplazo de fondo. La tasa de bits de vídeo ahora se adapta a la fuente, la resolución, la velocidad de fotogramas y el canal alfa; El audio compatible se copia directamente y solo la transcodificación necesaria utiliza una tasa de bits de audio adaptable.
Editor de vídeo en línea Beta
Se abrió el reemplazo de fondo de video local con dos modelos RVM y variantes de aspecto horizontal, cuadrado y vertical de MatAnyone2 que se adaptan al aspecto. Los modelos utilizan ModelScope CDN primero con respaldo del sitio; Se conservan la relación de aspecto y el audio originales, con exportación MP4 o WebM transparente.
Corrección de imágenes fantasma de WebP animadas y control de optimización de fotogramas
Precio fijo y texto fantasma causado por la combinación de fotogramas delta animados WebP con pérdida. Se restauró el control de cuadros Delta/cuadros completos y se enrutaron WebP, APNG, GIF y AVIF a través de sus rutas de codificación coincidentes.
Escalado de fotogramas y rotación de imágenes en ángulos arbitrarios.
Controladores de escala y rotación de ocho direcciones estilo Keynote incluidos, ángulos de inspección precisos y atajos de ±90°. La vista previa, deshacer/rehacer, ida y vuelta del proyecto .imging y exportación de la imagen final conservan la rotación.
Diseño online y un espacio de trabajo independiente multicapa
Se envió un espacio de trabajo de diseño local con hasta 24 capas: importación, movimiento, escala y orden de múltiples imágenes, fondos transparentes o sólidos, ajustes preestablecidos de lienzo, deshacer/rehacer y exportación local de formato PNG, WebP o JPG en tamaño completo.
Composición local de múltiples fondos después del recorte de IA
El refinamiento profesional admite transparencia, un color sólido o hasta 12 capas de fondo locales. El sujeto y cada capa de fondo se pueden mover, escalar, posicionar y reordenar de forma independiente, con composición local de resolución completa al exportar.
Interfaz completa en inglés y estados del modelo localizados
Se envió la herramienta completa en inglés y ocho guías de tareas en inglés, con botones consistentes en inglés, indicaciones de operación, copia de ayuda, nombres de modelos de IA, progreso de descarga y estados de tiempo de ejecución.
Recorte profesional de IA, exportación real y rendimiento de imágenes grandes
Alfa unificado de resolución completa en vista previa, refinamiento y descarga. Se agregó un pincel real de 1 px, deshacer/rehacer de varios pasos, espacio para desplazarse, inspección de bordes en blanco y negro y una comparación estilo Squoosh con divisor fijo.
Tres niveles de IA locales y rápida eliminación de color
Se agregaron los modelos ISNet INT8, BEN2 FP16 y BiRefNet HR-Matting FP16 bajo demanda. La ruta rápida elimina solo el color similar conectado al borde de la imagen, preservando el color coincidente dentro del sujeto.
Animación de un extremo a otro y espacios de trabajo aislados
Compresión, creación y edición de fotogramas completadas para GIF, APNG, WebP animado y AVIF animado, incluida una temporización de 100 ms a 3 s, bucles, dirección de reproducción, orden de arrastre y estado del espacio de trabajo aislado.
Límites de capacidad y comparación de herramientas
Detección documentada de capacidad del navegador en vivo, límites de dispositivo/servidor y una metodología de comparación transparente para ImgIng, Squoosh, TinyPNG y convertidores de nube.
Siguiente paso: edición avanzada de imágenes en el navegador
Las herramientas de precisión más utilizadas ampliarán el espacio de trabajo por capas. La coincidencia entre vista previa y exportación seguirá siendo un requisito de publicación.
Lienzo y geometría
Recorte, volteo, transformación libre y ayudas adicionales de composición.
Edición local
Pincel, borrador, ajustes locales y selecciones conectadas con máscaras de IA.
Texto y formas
Texto, formas básicas, color, trazo, opacidad y orden de capas.
Historial profesional
Historial no destructivo, deshacer y rehacer en varios pasos y comparación original/resultado.
Exportación local
Seguir verificando los archivos Blob reales y guardar localmente los formatos habituales.
Este alcance es un objetivo público, no una función disponible actualmente. Cada apartado debe superar las pruebas de calidad de imagen, memoria, compatibilidad y rendimiento con imágenes grandes; lo incompleto se aplazará en lugar de publicarse antes de tiempo.
Principios de la hoja de ruta
Cada nueva función debe cumplir cuatro reglas de producto.
Local primero
Cuando el navegador pueda procesar con fiabilidad, los datos de imagen permanecerán en el dispositivo.
Resultados fiables
La vista previa, la comparación y la descarga utilizarán la misma cadena real de píxeles.
Imágenes grandes sin bloqueos
El zoom, el desplazamiento y la edición deben responder también con alta resolución.
Límites claros
Las funciones planificadas, locales, WASM bajo demanda y de servidor se identificarán por separado.
Investigación posterior
Los temas sin fecha comprometida se mantienen separados de la próxima versión.
Procesamiento por lotes y ajustes reutilizables
Aplicar tamaño, calidad, nombre y reglas de exportación a varios archivos.
Máscaras y selecciones precisas
Añadir selecciones, máscaras y control local a la composición multicapa.
Gestión de color y metadatos
Validar ICC, EXIF, HDR y la coherencia de color entre navegadores.
Más modelos locales
Añadirlos solo cuando tamaño de descarga, licencia, velocidad y calidad sean adecuados.
Preguntas sobre versiones y hoja de ruta
Respuestas claras e idénticas para usuarios y sistemas de búsqueda.
¿Las funciones futuras de esta página ya se pueden utilizar?
No. Solo la sección «Ya disponible» describe la versión actual. El recorte, el texto, las formas, las selecciones y la edición local están planificados.
¿El editor local sube mis imágenes?
El diseño online y los filtros mantienen los recursos en el dispositivo. Si una función futura necesita servidor, se indicará claramente antes de comenzar.
¿Por qué se utilizan fechas objetivo en lugar de números de versión inventados?
ImgIng se publica actualmente de forma continua; las fechas permiten comprobar los cambios con mayor claridad.
¿Puede cambiar la hoja de ruta?
Sí. La compatibilidad, la memoria, el rendimiento con imágenes grandes y la fidelidad de exportación pueden cambiar el alcance; cualquier modificación se documentará aquí.
Revisado por el equipo de producto e ingeniería de DataDance ·