Resumir emails largos
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Extracción de baja complejidad y volumen alto: coste por token casi nulo con 1M de contexto y cache.
Alternativa abierta: Gemma 4 12B
guía de modelos abiertos · julio 2026
80 casos de uso empresariales y el modelo open-weight que resuelve cada uno. Sin APIs cerradas: todo lo que hay aquí se puede descargar, auditar y ejecutar bajo tu control.
selector rápido
Elige el tipo de tarea y tu restricción principal. La recomendación se actualiza al momento; abajo tienes los 80 casos en detalle.
¿Qué tipo de tarea?
¿Cuál es tu restricción principal?
Qwen3.8-27BAPACHE 2.0
Lo más nuevo de la generación Qwen y el mejor escritor abierto que cabe en una máquina: 52 en el índice de Artificial Analysis, Apache 2.0 y multilingüe nativo con buen español.
los 80 casos
Filtra por área o complejidad. Cada ficha da la recomendación principal, la alternativa y por qué. El punto verde marca los modelos servidos en Helmcode a tarifa plana.
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Extracción de baja complejidad y volumen alto: coste por token casi nulo con 1M de contexto y cache.
Alternativa abierta: Gemma 4 12B
Modelo abierto recomendado
Qwen 3.6 35B
disponible en Helmcode
Multilingüe nativo con buen registro en español, y 3B de parámetros activos sobre 35B, que es lo que lo hace asequible a volumen de email. Para emails firmados por personas, la escritura importa.
Alternativa abierta: Qwen3.8-27B para los que más importan
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
1M de contexto se traga un informe, un expediente o un libro de una pasada, sin chunking. Hay ventanas mayores en modelos peores, y la ventana solo dice qué cabe, no qué ha entendido el modelo.
Alternativa abierta: Kimi K3, el mejor abierto en razonamiento sobre contexto largo
Modelo abierto recomendado
Voxtral Small
Un solo modelo transcribe y resume: Voxtral entiende el audio, no solo las palabras, así que una reunión de 30 minutos vuelve convertida en acta sin un segundo modelo en la cadena. El español es uno de sus ocho idiomas.
Alternativa abierta: Whisper large-v3 + V4 Flash, para reuniones de más de 30 minutos
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
El contexto ya viene recuperado: extracción + redacción con citado preciso. Para docs confidenciales, self-host es la única opción válida.
Alternativa abierta: Qwen 3.6 35B
Modelo abierto recomendado
Gemma 4 12B
Clasificación con criterios claros en milisegundos. Cabe en una GPU modesta procesando cada email entrante.
Alternativa abierta: DeepSeek V4 Flash
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Extracción de entidades (qué, quién, cuándo) con JSON fiable. El volumen hace del coste el criterio decisivo.
Alternativa abierta: Gemma 4 12B
Modelo abierto recomendado
Qwen3.8-27B
Los seguimientos deben sonar humanos, no automáticos. La misma huella densa de 27B que la generación 3.6 a la que sustituye, catorce puntos más en el índice.
Alternativa abierta: Qwen 3.6 35B, el MoE que servimos en tarifa plana
Modelo abierto recomendado
Qwen 3.6 35B
disponible en Helmcode
Respeta la voz del autor sin reescribir, que es el diferencial en edición. Multilingüe por diseño y lo bastante barato para pasarlo por todo lo que escribe el equipo.
Alternativa abierta: Qwen3.8-27B, o GLM-5.2
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Calidad casi de frontera al menor coste del mercado. Para adaptación cultural fina, sube a Qwen 3.6 35B.
Alternativa abierta: Qwen 3.6 35B (ES/EN/FR/DE/PT)
Modelo abierto recomendado
qwen3-embedding + rerank
disponible en Helmcode
El 50% olvidado de todo RAG: embeddings + reranking de calidad deciden más que el modelo generador.
Alternativa abierta: DeepSeek V4 Flash (síntesis)
Modelo abierto recomendado
qwen3-embedding + rerank
disponible en Helmcode
Reordenar los top-k recuperados multiplica la precisión del RAG con un coste marginal mínimo.
Alternativa abierta: Gemma 4 12B como cross-encoder
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Comprensión + reformulación en lenguaje de usuario. Ideal para manuales y políticas que no pueden salir a APIs externas.
Alternativa abierta: Qwen3.8-27B
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
Síntesis de datos + narrativa: el mejor razonamiento abierto siguiendo plantillas estructuradas complejas.
Alternativa abierta: Qwen 3.6 35B
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
Una conclusión por slide, título = mensaje. Integrado con python-pptx o reveal.js: pipeline completo datos → deck.
Alternativa abierta: Qwen 3.6 35B
Modelo abierto recomendado
Qwen 3.6 35B
disponible en Helmcode
Lenguaje preciso y consistencia terminológica en documentos largos. Contenido interno que no debería salir de casa.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Una reunión de 1-3h son 50-150K tokens, así que en 1M de contexto cabe una semana entera de reuniones. Voxtral Small transcribe y V4 Flash redacta agenda y acta, las dos en self-hosting.
Alternativa abierta: GLM-5.2 para reuniones que acaban en una decisión
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
RSS/scraping → resumen y clasificación en batch → dashboard. Coste por artículo prácticamente cero.
Alternativa abierta: Gemma 4 26B
Modelo abierto recomendado
Gemma 4 12B
Una de las tareas más simples del listado: latencia de milisegundos on-premise en hardware modesto.
Alternativa abierta: DeepSeek V4 Flash
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Estado de tareas, alertas y resúmenes. Los hitos y responsables de proyectos de cliente no salen de la red interna.
Alternativa abierta: Qwen3.8-27B
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
El mejor razonamiento abierto para sintetizar fuentes ya recopiladas. Combínalo con scraping propio para la captura.
Alternativa abierta: DeepSeek V4 Pro 0813
Modelo abierto recomendado
DeepSeek V4 Pro 0813
Sigue siendo el mejor abierto en generación acotada, con un margen que casi ha desaparecido: 53 en el índice de Artificial Analysis frente a los 52 de Flash 0731, a 2,3 veces el precio. DeepSeek publica un 80.6% en SWE-bench Verified, cifra propia.
Alternativa abierta: Kimi K3, o K2.7 Code con menos hardware
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
El líder abierto en coding agéntico: Z.ai publica un 62.1% en SWE-bench Pro y un 81.0 en Terminal-Bench 2.1, por delante de DeepSeek en trabajo multi-paso sobre repos reales. GLM-5.3 puntúa más alto y sus pesos no han salido, así que este es el GLM más nuevo que puedes ejecutar.
Alternativa abierta: Kimi K3, o K2.7 Code con menos hardware
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Detecta bugs, deuda y problemas de seguridad razonando sobre el diff completo. Cuando pasa por aquí cada pull request, deciden el precio y la velocidad: $0.11 por tarea frente a los $0.25 de V4 Pro, y 1,7 veces más tokens por segundo. El código nunca sale de tu infra.
Alternativa abierta: DeepSeek V4 Pro 0813 para los diffs más difíciles
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Cobertura de casos límite y mocks coherentes, al menor precio por tarea del campo abierto. DeepSeek publica que Flash 0731 gana al preview de V4 Pro en los nueve benchmarks de agente, cifras propias y con su propio harness.
Alternativa abierta: Kimi K2.7 Code
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
Refactors multi-archivo de horas: el dominio donde GLM-5.2 saca más ventaja (FrontierSWE, DeepSWE) con los 500K de contexto que servimos. K3 es hoy el techo abierto si tienes el cluster para servirlo, unas 64 GPUs.
Alternativa abierta: Kimi K3, o K2.7 Code con menos hardware
Modelo abierto recomendado
Qwen3.8-27B
Text-to-SQL sobre tu esquema con few-shot. Esto es código, así que la generación importa: Alibaba publica un 90.3 en LiveCodeBench v6 para este modelo. El esquema de la base de datos es información sensible: mejor en casa.
Alternativa abierta: Qwen 3.6 35B, o V4 Flash
Modelo abierto recomendado
Kimi K2.7 Code
Lee el código, escribe la doc. K2.7 mantiene coherencia entre módulos en codebases grandes.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Resuelve el 80% de consultas L1 cargando toda la KB en contexto. Datos de empleados y sistemas: dentro de la red.
Alternativa abierta: Gemma 4 26B
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
Razonamiento multi-paso conectando eventos no relacionados, con metodología (5 Porqués, Ishikawa). Logs confidenciales: self-host.
Alternativa abierta: DeepSeek V4 Pro 0813
Modelo abierto recomendado
Qwen3.8-27B
Lee el mockup y escribe el componente, con visión nativa y coding de generación actual en los mismos 27B de pesos. Este caso pedía un cluster de 64 GPUs hasta agosto; ahora pide una máquina, y con licencia Apache 2.0.
Alternativa abierta: Kimi K3 si ya tienes el cluster montado
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Datasets de entrenamiento y prueba a coste marginal cero. La licencia MIT no restringe el uso de las salidas.
Alternativa abierta: Qwen 3.6 35B
Modelo abierto recomendado
Gemma 4 12B
Fine-tuneado con tus categorías de datos personales, corre en el borde del pipeline antes de que nada salga.
Alternativa abierta: DeepSeek V4 Flash
Modelo abierto recomendado
Voxtral Small
La transcripción de pesos abiertos más precisa medida por Artificial Analysis: 2,8% de error por palabra frente al 4,1% de la mejor fila de Whisper large-v3. Las llamadas de clientes nunca deberían pasar por una API opaca.
Alternativa abierta: Whisper large-v3 para más idiomas con menos hardware
Modelo abierto recomendado
Chatterbox Multilingual
23 idiomas, el español entre ellos, clonado de voz con unos segundos de referencia, licencia MIT y 500M de parámetros. Un voicebot abierto completo: Voxtral → LLM → Chatterbox. Kokoro es más ligero y más barato y solo habla inglés, lo que lo descarta para un despliegue en español.
Alternativa abierta: Kokoro, solo para inglés y con la huella más pequeña
Modelo abierto recomendado
Qwen3.8-27B
Procesa la imagen del documento directamente, sin OCR separado, y devuelve los campos como JSON estructurado. Un dígito mal en un DNI o una factura cuesta más que la inferencia, así que aquí es donde el modelo de visión más fuerte se paga solo. Facturas y DNIs exigen pipeline 100% interno.
Alternativa abierta: Gemma 4 26B, servido en tarifa plana
Modelo abierto recomendado
Qwen3.8-27B
QA visual, etiquetado de catálogo y verificación de assets, sobre vídeo además de imágenes fijas, y fine-tuneable con tus propios criterios de aceptación bajo Apache 2.0.
Alternativa abierta: Gemma 4 26B, o MiniMax M3 para lotes más pesados
Modelo abierto recomendado
Gemma 4 26B
disponible en Helmcode
Texto e imagen en la misma llamada, fine-tuneable con los criterios de tu plataforma para más consistencia que el zero-shot.
Alternativa abierta: MiniMax M3
Modelo abierto recomendado
Qwen3.8-27B
Escritura persuasiva con frameworks (SPIN, Challenger) y narrativa centrada en cliente, y cabeza suficiente para sostener el argumento en una propuesta larga.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
Gemma 4 12B
Fine-tuneado con tu histórico de conversiones supera con mucho al zero-shot: la ventaja estructural del open source.
Alternativa abierta: DeepSeek V4 Flash
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Briefings desde la actividad del CRM. Importes y clientes en negociación: inteligencia comercial que no debe salir.
Alternativa abierta: Qwen3.8-27B
Modelo abierto recomendado
Qwen 3.6 35B
disponible en Helmcode
Manejo de objeciones y personalización por perfil. El argumentario es estrategia confidencial: self-host.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
El razonamiento estratégico abierto más sólido que puedes desplegar de verdad. K3 puntúa más alto, pero 1,6 TB de pesos lo dejan fuera de alcance salvo que ya tengas un cluster.
Alternativa abierta: Kimi K3
Modelo abierto recomendado
Qwen 3.6 35B
disponible en Helmcode
Creatividad, copywriting y adaptación al tono de marca. Para alto volumen, el ahorro frente a API cerrada es sustancial.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
Qwen3.8-27B
Decenas de variaciones por campaña a coste marginal cero, y lee la pieza igual que el brief: la visión nativa sobre imagen y vídeo viene en los mismos pesos.
Alternativa abierta: Qwen 3.6 35B, o V4 Flash en los volúmenes más altos
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Generación estructurada en batch sobre todo el catálogo o el blog. Volumen alto, criterios claros: coste manda.
Alternativa abierta: Qwen3.8-27B
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Miles de opiniones en batch con análisis por aspecto. Fine-tuning con el vocabulario de tu sector afina el resultado.
Alternativa abierta: Gemma 4 12B (fine-tune)
Modelo abierto recomendado
Gemma 4 12B
Criterios propios de la plataforma fine-tuneados, con coste por mensaje prácticamente nulo.
Alternativa abierta: Gemma 4 26B (multimodal)
Modelo abierto recomendado
Gemma 4 12B
Multi-label en tiempo real, fine-tuneable con tu histórico de tickets para precisión específica del negocio.
Alternativa abierta: DeepSeek V4 Flash
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Chatbot de atención con datos de cliente bajo RGPD: el self-hosting no es opcional en sectores regulados.
Alternativa abierta: Qwen3.8-27B
Modelo abierto recomendado
Qwen 3.6 35B
disponible en Helmcode
Empatía + firmeza + solución concreta. Las reclamaciones contienen datos personales: procesamiento en casa.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Clasificación temática y sentimiento sobre miles de respuestas abiertas, sin que los datos personales salgan de infraestructura UE.
Alternativa abierta: Gemma 4 12B
Modelo abierto recomendado
Qwen3.8-27B
Cierre automático de cada ticket con resumen para el CRM. Alto volumen, redacción correcta, una máquina.
Alternativa abierta: Qwen 3.6 35B, o V4 Flash en los volúmenes más altos
Modelo abierto recomendado
Qwen3.8-27B
Distinguir evidencias de declaraciones genéricas, sin sesgos. Datos de candidatos = RGPD: despliegue local.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Toda la documentación de onboarding cabe en 1M de contexto, sin RAG y sin que las políticas internas salgan fuera.
Alternativa abierta: Gemma 4 26B
Modelo abierto recomendado
Qwen3.8-27B
Feedback constructivo con matices. Estos datos pueden acabar en procedimientos laborales: self-host + cifrado.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Los datos de RRHH son los más sensibles de la empresa: las conversaciones no salen de la infraestructura corporativa.
Alternativa abierta: Qwen3.8-27B
Modelo abierto recomendado
Qwen3.8-27B
Redacción persuasiva con estructura definida, en español nativo, incluso para perfiles confidenciales.
Alternativa abierta: Qwen 3.6 35B
Modelo abierto recomendado
Qwen 3.6 35B
disponible en Helmcode
Diseño instruccional con adaptación al nivel del alumno. En e-learning de volumen, el coste por módulo tiende a cero.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
Qwen3.8-27B
Buen tono y estructura en una sola máquina. Las comunicaciones internas, fuera de APIs de terceros.
Alternativa abierta: Gemma 4 26B, o Qwen 3.6 35B
Modelo abierto recomendado
Gemma 4 26B
disponible en Helmcode
Procesa la imagen de la factura directamente y devuelve JSON estructurado. Pipeline financiero 100% interno.
Alternativa abierta: MiniMax M3 en self-hosting
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Un punto de índice por detrás de V4 Pro a menos de la mitad de coste, con los mismos 1M de contexto para unas cuentas completas y su memoria. Para cotizadas o M&A, el self-host es prácticamente obligatorio.
Alternativa abierta: DeepSeek V4 Pro 0813, o GLM-5.2
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
Patrones complejos sobre el historial completo de transacciones (1M ctx). En banca, los datos no salen: única opción viable.
Alternativa abierta: DeepSeek V4 Pro 0813
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Mucho volumen de comparaciones cortas: apuntes del extracto contra los del libro mayor, marcando los casi-cuadres para que los vea una persona. Aquí decide el coste por token.
Alternativa abierta: Gemma 4 26B
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Lee las cuentas y redacta el razonamiento detrás de un límite, ratio a ratio, a $0.11 por expediente. Eso es un juicio de solvencia sobre una empresa con nombre: se queda en casa, y lo firma una persona.
Alternativa abierta: GLM-5.2 para los expedientes que van a comité
Modelo abierto recomendado
Qwen 3.6 35B
disponible en Helmcode
El mismo mensaje tiene que escalar del recordatorio al requerimiento formal sin perder al cliente. Pesa más el registro que el razonamiento y ahí Qwen lidera en español.
Alternativa abierta: Gemma 4 26B
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
No es extracción, es criterio: esta cena pasa del límite, este taxi no lleva asistentes. La política va en el prompt y cambia sin reentrenar nada.
Alternativa abierta: Gemma 4 12B
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
El máximo nivel abierto de comprensión de matices, con licencia MIT y model card publicados: auditable de punta a punta.
Alternativa abierta: DeepSeek V4 Pro 0813
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
Con el AI Act aplicándose con carácter general desde el 2 de agosto de 2026, un stack abierto y trazable en infraestructura UE aporta la evidencia que necesita tu evaluación.
Alternativa abierta: Qwen 3.6 35B
Modelo abierto recomendado
Qwen 3.6 35B
disponible en Helmcode
Etiquetado y triaje de expedientes por materia, jurisdicción y urgencia sin que un solo folio salga del despacho.
Alternativa abierta: Gemma 4 26B
Modelo abierto recomendado
Kimi K3
Miles de documentos que solo significan algo leídos juntos, así que lo que cuenta es razonar entre ellos y no el tamaño de la ventana: K3 lidera entre los abiertos en AA-LCR, el eval de razonamiento sobre contexto largo, con un 82.7%. Servirlo pide un cluster, unas 64 GPUs.
Alternativa abierta: DeepSeek V4 Flash, 1M de contexto en hardware que ya tienes
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
Razonamiento que tiene que sostener una cadena de citas sin inventarse ninguna. Anclado con RAG a tu base de sentencias, nunca a la memoria del modelo.
Alternativa abierta: DeepSeek V4 Pro 0813
Modelo abierto recomendado
Qwen 3.6 35B
disponible en Helmcode
Generar en vez de analizar: montar un primer borrador con cláusulas que legal ya ha aprobado, para que el equipo edite y no parta de cero.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
Vigilar qué ha cambiado en una norma y a qué políticas internas afecta. Es otro trabajo que comprobar el compliance: este corre antes de que nadie incumpla.
Alternativa abierta: DeepSeek V4 Flash
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Comparativa de condiciones y alertas de vencimiento. Precios pactados = información comercial confidencial.
Alternativa abierta: GLM-5.2 (todos los contratos a la vez)
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
Razonamiento estructurado sobre fuentes ya recopiladas. Para captura web, combina con scraping propio.
Alternativa abierta: DeepSeek V4 Flash
Modelo abierto recomendado
Qwen3.8-27B
Cientos de requisitos contestados uno a uno, cada uno trazable a un documento que ya tienes. La oferta es confidencial hasta que se abre el sobre.
Alternativa abierta: GLM-5.2
Modelo abierto recomendado
GLM-5.2
disponible en Helmcode
Las mismas doscientas preguntas llegan de cada cliente con la redacción cambiada. Se contestan desde tu base de evidencias y una persona firma.
Alternativa abierta: DeepSeek V4 Flash
Modelo abierto recomendado
DeepSeek V4 Flash 0731
disponible en Helmcode
Miles de eventos cortos al día, cada uno con su destino: retraso, daño, dirección errónea o nada. El volumen elige el modelo.
Alternativa abierta: Gemma 4 26B
Modelo abierto recomendado
Qwen3.8-27B
Lee la foto de la línea, o el vídeo, y redacta el informe de defecto contra tus propios criterios. Las imágenes de producción rara vez tienen permiso para salir de la planta.
Alternativa abierta: Gemma 4 26B, servido en tarifa plana
*Esta licencia no es una licencia libre (restricciones de uso y condiciones específicas): revísala antes de construir sobre ella.
En producción el 99,5% de nuestros tokens pasa por modelos abiertos, y no en las tareas fáciles: clasificar, extraer, resumir, redactar, responder y razonar sobre documentos que nadie más ha leído. Lo que queda es un puñado de problemas de frontera de verdad, y a esos se los enruta al modelo grande en vez de pagar precio de frontera por el otro 99,5%.
en profundidad
Los 80 casos de arriba se agrupan en doce casos de uso canónicos. Cada uno tiene su página con arquitectura, FAQ y despliegue en detalle.
empezar
Coge un caso de la lista, apunta el mismo código a nuestro endpoint y lee las dos salidas una al lado de la otra.
La API que ya llamas. Una tarde. Nada que migrar.
Un proceso con volumen y criterio estable puede convertirse en un modelo pequeño y especializado, con los pesos a tu nombre y corriendo en mucho menos hardware. especialización_de_modelos →
// cookies
Solo usamos cookies estrictamente necesarias para que el sitio funcione. Nada de analítica ni publicidad, nunca — consulta la Política de cookies.
// preferencias