Nunca más etiquetes fotos a mano.
VisionTagger usa IA en el dispositivo para generar títulos, descripciones, palabras clave y más para tus imágenes — en lote, sin subidas y sin coste por imagen.
Requiere un Mac Apple Silicon con macOS 26


¿Para quién es VisionTagger?
Diseñadores que buscan entre recursos de proyectos—etiquetan imágenes por estado de ánimo, estilo, tema y uso para hacer su biblioteca de recursos instantáneamente buscable.
Investigadores y archivistas que preservan colecciones—crean metadatos estructurados y consistentes para conjuntos de datos, registros y preservación digital a largo plazo.
Mejores resultados con el contexto que ya tienes
Dile a la IA qué está viendo y los resultados mejoran drásticamente. Añade un Context Hint como “fotos de producto para una tienda de muebles vintage”, activa GPS Location para incluir nombres de lugares a partir de coordenadas incrustadas, o pasa metadatos de cámara y editoriales que ya están en tus archivos. Cada fuente es opcional y se incorpora directamente al prompt — para que la IA no tenga que adivinar.

Genera exactamente los metadatos que necesitas
Empieza con los campos que más se necesitan — Título, Descripción y Palabras clave — y luego ve más allá con Contenido y estilo, Seguridad y cumplimiento, o añade secciones completamente personalizadas con tus propios campos y prompts. ¿Necesitas la salida en otro idioma? VisionTagger puede traducir automáticamente los metadatos generados usando la traducción integrada de macOS. El resultado son metadatos estructurados y consistentes en miles de fotos.

Encaja perfecto en tu flujo de trabajo
Para sidecars XMP y metadatos incrustados, VisionTagger se integra con ExifTool — una utilidad estándar del sector y ampliamente confiable. Tus metadatos aparecerán en apps como Adobe Lightroom, Bridge, Capture One, Photo Mechanic y cualquier otro software que lea XMP. Escribe de vuelta en tu Fototeca, exporta JSON, CSV o TXT por imagen, o genera un único archivo para toda una ejecución. Añade etiquetas de Finder para organizarte rápido en macOS. Selecciona varias salidas a la vez y configúralas juntas — para que una sola pasada de generación alimente todos los destinos que uses.

Automatízalo y olvídate
Dos acciones de Atajos — una para archivos en Finder, otra para tu Fototeca — te permiten ejecutar el proceso completo en segundo plano sin abrir la app. Configura una automatización de carpeta, una acción rápida del Finder, o ejecútalo desde la línea de comandos. Usa los ajustes actuales de la app o proporciona un preset guardado para resultados reproducibles en todo momento.

Cómo funciona
Ver demo en YouTube
Elige dónde están guardadas tus imágenes — carpetas en tu Mac o tu Fototeca.

Elige exactamente qué quieres procesar. Revisa tu selección en vista de cuadrícula o tabla, añade más imágenes con el botón de añadir, o arrastra y suelta archivos en la app para crear un lote.

Elige un modelo de IA (descarga uno en la app con un clic) y selecciona qué metadatos generar: títulos, descripciones, palabras clave, etiquetas de estilo, clasificaciones de seguridad o tus propios campos personalizados.

Mira cómo aparecen los resultados en tiempo real. VisionTagger procesa imágenes en local y transmite los metadatos generados a una lista con desplazamiento en cuanto cada elemento está listo, para que puedas revisar y editar salidas mientras el lote continúa.

Elige adónde van los metadatos: sidecars XMP para tu catálogo de fotos, JSON o CSV para tu flujo web, etiquetas de Finder, o escribe de vuelta en Fotos. Selecciona varias salidas a la vez.

Confirma antes de que se escriba nada. Revisa un resumen claro de todas las acciones que se ejecutarán, incluyendo avisos cuando archivos o metadatos existentes puedan sobrescribirse — y luego publica para aplicar tus salidas seleccionadas con confianza.
Compra única
IVA incluido (excepto US & CA)
Pago seguro a través de FastSpring
Preguntas frecuentes de VisionTagger
Primeros pasos
¿Cómo funciona la prueba gratuita?
¿Cómo funciona la prueba gratuita?
La prueba gratuita te permite procesar hasta 100 imágenes sin coste, sin límite de tiempo. Puedes explorar el flujo completo—selección de modelo, secciones integradas, campos personalizados y opciones de exportación—antes de comprar.
Imágenes y metadatos
¿Qué formatos y fuentes de imagen son compatibles?
¿Qué formatos y fuentes de imagen son compatibles?
VisionTagger admite formatos de imagen comunes como JPEG, PNG, TIFF, HEIC y WebP, así como diversos formatos RAW incluido DNG. Puedes seleccionar imágenes desde carpetas de tu Mac o directamente desde tu Fototeca.
¿Puedo ajustar el nivel de detalle de la descripción?
¿Puedo ajustar el nivel de detalle de la descripción?
Sí. Puedes elegir entre tres niveles: Breve para una sola frase concisa adecuada para texto alternativo, Estándar para dos frases con contexto ideal para pies de foto, o Detallado para una descripción completa.
¿Puedo controlar qué palabras clave se generan?
¿Puedo controlar qué palabras clave se generan?
Sí. Puedes establecer un número máximo de palabras clave, de modo que el modelo genere hasta esa cantidad por imagen. También puedes definir palabras clave que se incluyan siempre al principio o al final de la lista, y especificar palabras clave a excluir. Después de la generación, puedes reordenar, editar, añadir o eliminar manualmente las palabras clave de cada imagen antes de exportar.
¿Puedo definir campos de metadatos personalizados?
¿Puedo definir campos de metadatos personalizados?
Sí. Además de las secciones integradas (Título, Descripción, Palabras clave, Contenido y estilo, Seguridad y cumplimiento), puedes crear secciones personalizadas y añadir tus propios campos. Cada campo admite un tipo de dato (Booleano, Texto o Lista de textos) y su propio prompt, para que puedas ajustar exactamente lo que extrae el modelo.
Exportación e integraciones
¿Puede VisionTagger escribir de vuelta en mi Fototeca?
¿Puede VisionTagger escribir de vuelta en mi Fototeca?
Sí. VisionTagger puede escribir metadatos de vuelta en tu Fototeca cuando eliges esa opción de salida. Siempre verás un resumen de publicación antes de que se escriba nada.
¿Qué salidas puede crear VisionTagger?
¿Qué salidas puede crear VisionTagger?
VisionTagger puede exportar JSON, CSV o TXT por imagen, o un único archivo JSON/CSV/TXT para un lote completo. También puede aplicar etiquetas de Finder. Para sidecars XMP e incrustar metadatos en archivos de imagen, VisionTagger se integra con ExifTool (se instala por separado).
¿Puede VisionTagger generar metadatos en idiomas distintos al inglés?
¿Puede VisionTagger generar metadatos en idiomas distintos al inglés?
Sí. VisionTagger siempre genera los metadatos en inglés para una calidad óptima del modelo de IA. Cuando seleccionas otro idioma de salida en Ajustes, los metadatos generados se traducen automáticamente usando la traducción integrada de macOS. Los idiomas compatibles incluyen árabe, chino, neerlandés, francés, alemán, hindi, indonesio, italiano, japonés, coreano, polaco, portugués, ruso, español, tailandés, turco, ucraniano y vietnamita. Los paquetes de idiomas deben descargarse en Ajustes del Sistema antes de que la traducción esté disponible.
¿Necesito instalar ExifTool?
¿Necesito instalar ExifTool?
ExifTool solo es necesario para sidecars XMP e incrustar metadatos en archivos de imagen. Si solo exportas JSON/CSV/TXT o aplicas etiquetas de Finder, no necesitas ExifTool.
¿VisionTagger sobrescribirá archivos o metadatos existentes?
¿VisionTagger sobrescribirá archivos o metadatos existentes?
VisionTagger muestra un resumen de publicación antes de escribir cualquier salida y te avisa si podrían sobrescribirse archivos existentes. Puedes revisar las acciones y confirmar antes de que se guarde nada.
Requisitos
¿Necesito configurar algo técnico?
¿Necesito configurar algo técnico?
No. Descarga un modelo con un clic y empieza a procesar. VisionTagger viene con valores predeterminados razonables. Si quieres más control, puedes ajustar parámetros como la longitud de salida en Ajustes — pero la mayoría de usuarios nunca lo necesitan.
¿VisionTagger requiere una conexión a internet?
¿VisionTagger requiere una conexión a internet?
VisionTagger funciona en local y no sube tus imágenes ni los metadatos generados. Solo se necesita internet para descargar modelos dentro de la app y para comprobar y descargar actualizaciones.
¿Qué tan rápido es y qué Mac necesito?
¿Qué tan rápido es y qué Mac necesito?
VisionTagger requiere Apple Silicon (M1 o posterior) y funciona en macOS Tahoe 26.0 o posterior. 16 GB de RAM es el mínimo; para modelos más grandes, se recomiendan 32 GB o más. La velocidad depende de tu Mac, el modelo seleccionado, la resolución de la imagen y los campos de metadatos que elijas. Los modelos más pequeños suelen ser más rápidos; los más grandes pueden producir resultados de mayor calidad.
¿Cuánto espacio en disco usan los modelos?
¿Cuánto espacio en disco usan los modelos?
Las descargas de modelos se almacenan en local. Cuenta con aproximadamente 4–8 GB por modelo (varía según el modelo).
Automatización
¿Puedo automatizar VisionTagger?
¿Puedo automatizar VisionTagger?
Sí. VisionTagger se integra con Apple Atajos a través de dos acciones: Generate Image Metadata (para archivos en Finder) y Generate Photo Metadata (para tu Fototeca). Ambas ejecutan el proceso completo en segundo plano y exportan los resultados a tus destinos configurados. Puedes usarlas en la app Atajos, acciones rápidas del Finder, automatizaciones de carpetas, la línea de comandos y AppleScript. Opcionalmente puedes proporcionar un preset de ajustes exportado desde la app para una automatización reproducible.
Modelos de IA
¿Puede VisionTagger reconocer personas o caras concretas?
¿Puede VisionTagger reconocer personas o caras concretas?
No. VisionTagger usa modelos de visión preentrenados de uso general, así que puede describir que hay una persona y anotar atributos visibles, pero no puede identificar ni etiquetar a individuos concretos por su nombre. Los modelos no están entrenados para el reconocimiento facial, y no hay forma de enseñarles a reconocer a personas concretas.
¿Qué modelos de visión están incluidos?
¿Qué modelos de visión están incluidos?
VisionTagger incluye siete modelos de visión preconfigurados: Qwen3-VL 8B Instruct, Qwen3-VL 30B-A3B Instruct, Qwen3-VL 32B Instruct, Qwen2.5-VL 7B Instruct, Gemma 3 4B IT, InternVL3 8B Instruct y Pixtral 12B. Los modelos más pequeños suelen ir más rápido, mientras que los más grandes pueden producir resultados con más detalle, pero requieren más memoria, según tu Mac y la configuración elegida. Usa la prueba para comparar modelos y ajustar parámetros hasta que los resultados encajen con tu flujo de trabajo y tu nivel de detalle preferido.
¿Puedo usar mis propios modelos?
¿Puedo usar mis propios modelos?
Sí. Si tienes un modelo de visión compatible con GGUF y su archivo de proyector correspondiente (también GGUF), puedes vincularlos en VisionTagger y usarlos como las opciones integradas. Tú eres responsable de asegurar que tu uso de modelos de terceros cumpla con sus licencias y términos.
¿Puedo ajustar los parámetros del modelo?
¿Puedo ajustar los parámetros del modelo?
Sí. En Ajustes puedes modificar parámetros de generación como temperatura, tokens máximos, longitud de contexto, top-P y top-K con deslizadores. Esto te ayuda a equilibrar creatividad frente a consistencia y a controlar la longitud y el nivel de detalle de la salida.
Privacidad
¿Cómo se compara VisionTagger con los servicios de etiquetado en la nube?
¿Cómo se compara VisionTagger con los servicios de etiquetado en la nube?
La mayoría de los servicios de etiquetado en la nube cobran por imagen y requieren subir tus fotos a sus servidores. VisionTagger es una compra única sin coste por imagen — procesa tantas imágenes como quieras. Tus fotos nunca salen de tu Mac, y los metadatos se escriben directamente en sidecars XMP y en tus archivos en lugar de una exportación CSV que tengas que importar manualmente.
¿La función GPS Location envía mis datos a algún sitio?
¿La función GPS Location envía mis datos a algún sitio?
Las coordenadas GPS incrustadas en tus imágenes se envían de forma anónima a Apple Maps para buscar nombres de lugares. Solo se envían las coordenadas — Apple no recopila datos personales asociados a tu uso de Mapas. La función GPS Location está desactivada de forma predeterminada.
¿La función de traducción envía datos a Apple?
¿La función de traducción envía datos a Apple?
De forma predeterminada, macOS puede usar los servicios de traducción en línea de Apple para mejorar la precisión. Para asegurarte de que toda la traducción se realice completamente en tu Mac sin que los datos salgan del dispositivo, activa el “Modo en el dispositivo” en Ajustes del Sistema > Traducción.
¿VisionTagger recopila datos de uso o analíticas?
¿VisionTagger recopila datos de uso o analíticas?
No. VisionTagger no incluye analíticas ni telemetría, y no sube tus datos. La activación de la licencia y las comprobaciones de actualización implican solicitudes de red cuando se necesitan para esas funciones.











