FutturaOLLM / Catálogo de modelos

Catálogo de modelos (38)

Modelos abiertos y gratuitos orquestados por Futtura. Seleccioná uno, entrenalo con tus fuentes de conocimiento y desplegalo sin servidor, en VPS dedicado o dentro de la infraestructura del cliente.

Gemini (Pro / Flash)

Por Google DeepMind

API pública

Modelo multimodal de contexto largo: texto, imagen, audio y video en la misma llamada.

Para qué sirve

  • ·Análisis de documentos y videos largos (1M de contexto)
  • ·Copilotos multimodales y extracción de datos
  • ·Alto volumen con costo bajo en la variante Flash
Licencia
Comercial — Google AI / Vertex (API Key propia)
Parámetros
No divulgado (frontera, arquitectura MoE)
Contexto
1M tokens

Los datos salen de tu infraestructura hacia Google. No apto para cargas reguladas sin acuerdo previo.

Ver documentación y modelos del proveedor
API pública del proveedor

OpenAI GPT (serie 5)

Por OpenAI

API pública

Modelo de frontera para razonamiento complejo, código y agentes con function calling.

Para qué sirve

  • ·Desarrollo de software y generación de código
  • ·Agentes con herramientas y salida estructurada (JSON schema)
  • ·Razonamiento analítico y planificación de tareas
Licencia
Comercial — OpenAI Platform (API Key propia)
Parámetros
No divulgado (frontera)
Contexto
400K tokens

Procesamiento en la nube de OpenAI. Usar solo con datos no sensibles o anonimizados.

Ver documentación y modelos del proveedor
API pública del proveedor

Claude (Opus / Sonnet)

Por Anthropic

API pública

Referencia en programación agéntica, seguimiento de instrucciones largas y escritura técnica.

Para qué sirve

  • ·Refactor y revisión de repositorios completos
  • ·Redacción legal, técnica y de políticas internas
  • ·Agentes de larga duración con uso de herramientas
Licencia
Comercial — Anthropic API (API Key propia)
Parámetros
No divulgado (frontera)
Contexto
200K – 1M tokens

Datos procesados por Anthropic. Revisar el DPA antes de cargas con información de clientes.

Ver documentación y modelos del proveedor
API pública del proveedor

Grok

Por xAI

API pública

Modelo con acceso a información en tiempo real y fuerte desempeño en matemática y código.

Para qué sirve

  • ·Investigación y monitoreo con datos actualizados
  • ·Análisis cuantitativo y resolución matemática
  • ·Asistentes conversacionales de tono directo
Licencia
Comercial — xAI API (API Key propia)
Parámetros
No divulgado (frontera, ~314B en la versión abierta Grok-1)
Contexto
256K tokens

Los pesos abiertos solo cubren Grok-1; las versiones actuales son exclusivamente por API.

Ver documentación y modelos del proveedor
API pública del proveedor

Kimi K3

Por Moonshot AI

API pública

Mezcla de expertos orientada a agentes y código, con costo por token muy competitivo.

Para qué sirve

  • ·Agentes de desarrollo y automatización a gran escala
  • ·Procesamiento masivo de texto con presupuesto acotado
  • ·Alternativa autohospedable si se descargan los pesos
Licencia
Modified MIT (pesos) + API comercial Moonshot
Parámetros
~1T MoE (≈32B activos por token)
Contexto
256K tokens

Parámetros según la familia K2/K3 MoE de Moonshot; confirmar la variante exacta al contratar.

Ver documentación y modelos del proveedor
API pública del proveedor
Dedicado / VPS

Llama 3.3 70B Instruct

Por Meta

Destacado

Modelo generalista de alto rendimiento para agentes, chat corporativo y RAG.

Para qué sirve

  • ·Agentes de IA de texto y voz con herramientas
  • ·Chat corporativo multilingüe
  • ·RAG empresarial con bases de conocimiento grandes
Licencia
Llama Community
Parámetros
70B
Contexto
128K
Sin servidor
Dedicado / VPS
On-premise cliente

Qwen2.5 14B Instruct

Por Alibaba / Qwen

Equilibrio costo/calidad ideal para fine-tuning por vertical de negocio.

Para qué sirve

  • ·Fine-tuning económico por industria
  • ·Asistentes internos y soporte
  • ·Clasificación y extracción de datos
Licencia
Apache 2.0
Parámetros
14B
Contexto
128K
Sin servidor
Dedicado / VPS
On-premise cliente

DeepSeek V3

Por DeepSeek

Destacado

Razonamiento y código de frontera abierta para agentes complejos.

Para qué sirve

  • ·Desarrollo de software y agentes de código
  • ·Razonamiento multi-paso y planificación
  • ·Análisis técnico y científico avanzado
Licencia
MIT
Parámetros
671B MoE
Contexto
128K
Sin servidor
Dedicado / VPS

Mistral Small 3

Por Mistral AI

Baja latencia para copilotos internos y clasificación masiva.

Para qué sirve

  • ·Copilotos internos de baja latencia
  • ·Clasificación masiva de documentos
  • ·Automatización de back-office
Licencia
Apache 2.0
Parámetros
24B
Contexto
32K
Sin servidor
Dedicado / VPS
On-premise cliente

Gemma 3 27B

Por Google

Multimodal ligero, excelente para despliegues on-premise regulados.

Para qué sirve

  • ·Banca, hospitales y seguros on-premise
  • ·Análisis de imagen + texto regulado
  • ·Asistentes en infraestructura propia
Licencia
Gemma Terms
Parámetros
27B
Contexto
128K
Dedicado / VPS
On-premise cliente

Phi-4

Por Microsoft

Modelo compacto con razonamiento fuerte para edge y VPS pequeños.

Para qué sirve

  • ·Servidores VPS pequeños y edge
  • ·Razonamiento matemático y lógico
  • ·Chatbots de bajo consumo
Licencia
MIT
Parámetros
14B
Contexto
16K
Sin servidor
On-premise cliente

Llama3-Med42-v2 70B

Por M42 Health (Abu Dhabi)

Destacado

LLM clínico instruct y preference-tuned sobre Llama 3 con ~1B de tokens médicos de acceso abierto: guías, flashcards, preguntas de examen (USMLE/MedQA/MedMCQA) y diálogos clínicos. Referencia de resultados: 79,1 MedQA y 83,8 USMLE.

Para qué sirve

  • ·Resolución de preguntas tipo USMLE/MedQA
  • ·Asistencia a la decisión clínica
  • ·Educación médica y flashcards
Licencia
Llama 3 Community (uso comercial permitido)
Parámetros
70B
Contexto
8K

Asistencia a la decisión clínica; no reemplaza el criterio médico ni constituye un dispositivo médico certificado.

Ver licencia y procedencia del entrenamiento
Dedicado / VPS
On-premise cliente

MedGemma 27B (multimodal)

Por Google — Health AI Developer Foundations

Modelo médico texto+imagen entrenado con corpus clínicos desidentificados y públicos (radiografías, dermatología, patología y literatura biomédica) publicado por Google Health AI.

Para qué sirve

  • ·Interpretación de radiografías y dermatología
  • ·Preguntas biomédicas multimodales
  • ·Triaje y soporte diagnóstico asistido
Licencia
Gemma Terms of Use (uso comercial con política de uso permitido)
Parámetros
27B
Contexto
128K

Requiere aceptar los Gemma Terms y la política de uso prohibido de Google antes del despliegue.

Ver licencia y procedencia del entrenamiento
Dedicado / VPS
On-premise cliente

OpenBioLLM 70B

Por Saama AI Research

Ajuste biomédico de Llama 3 con datos curados por clínicos (DPO + fine-tuning). Fuerte en resúmenes de historia clínica, codificación y preguntas biomédicas (90,4 MMLU médico).

Para qué sirve

  • ·Resúmenes de historia clínica
  • ·Codificación médica (CIE/CPT)
  • ·Preguntas y respuestas biomédicas
Licencia
Llama 3 Community (uso comercial permitido)
Parámetros
70B
Contexto
8K
Ver licencia y procedencia del entrenamiento
Dedicado / VPS
On-premise cliente

Meditron-3 8B

Por EPFL LiGHT + Yale

Entrenado sobre Llama 3.1 con guías de práctica clínica internacionales, publicaciones revisadas por pares y diagnósticos diferenciales sintéticos, con foco en contextos humanitarios y de bajos recursos.

Para qué sirve

  • ·Pilotos de IA clínica en contextos de bajos recursos
  • ·Evaluación de diagnósticos diferenciales
  • ·Investigación y validación académica
Licencia
Llama 3.1 Community — uso declarado solo investigación
Parámetros
8B
Contexto
128K

Los autores lo declaran research-only y no validado para uso médico: en Futtura se habilita para pilotos y evaluación, no para producción asistencial.

Ver licencia y procedencia del entrenamiento
Dedicado / VPS
On-premise cliente

Pipecat Voice Agents

Por Daily (OSS)

Destacado

Framework de agentes de voz en tiempo real con barge-in y SIP.

Para qué sirve

  • ·Agentes telefónicos con interrupción natural
  • ·Bots de voz con SIP/PSTN
  • ·IVR inteligente con LLM en tiempo real
Licencia
BSD-2
Parámetros
Framework (no aplica)
Dedicado / VPS
On-premise cliente

LiveKit Agents

Por LiveKit

Orquestación WebRTC/SIP para call centers con IA y transferencia a humano.

Para qué sirve

  • ·Call centers híbridos IA + humanos
  • ·Recepción y transferencia de llamadas
  • ·WebRTC de alta concurrencia
Licencia
Apache 2.0
Parámetros
Framework (no aplica)
Dedicado / VPS
On-premise cliente

Vocode

Por Vocode OSS

Agentes telefónicos salientes y entrantes con integración a CRM.

Para qué sirve

  • ·Campañas de llamadas salientes
  • ·Recepción y agenda automática
  • ·Sincronización con CRM
Licencia
MIT
Parámetros
Framework (no aplica)
Sin servidor
Dedicado / VPS

Ultravox 0.5

Por Fixie

Speech-to-speech de baja latencia, sin transcripción intermedia.

Para qué sirve

  • ·Voz a voz en tiempo real
  • ·Agentes sin pipeline STT→LLM→TTS
  • ·Conversaciones de latencia ultra baja
Licencia
MIT
Parámetros
8B
Dedicado / VPS

Whisper Large v3

Por OpenAI (OSS)

Destacado

Transcripción multilingüe robusta con diarización opcional.

Para qué sirve

  • ·Transcripción de llamadas y reuniones
  • ·STT multilingüe (90+ idiomas)
  • ·Análisis de conversaciones
Licencia
MIT
Parámetros
1.5B
Sin servidor
Dedicado / VPS
On-premise cliente

XTTS v2

Por Coqui

Clonación de voz multilingüe a partir de 6 segundos de audio.

Para qué sirve

  • ·Clonación de voz de marca
  • ·TTS multilingüe con emoción
  • ·Voces personalizadas para agentes
Licencia
CPML
Parámetros
~400M
Dedicado / VPS
On-premise cliente

Kokoro 82M

Por Kokoro OSS

TTS ultraligero y natural, ideal para IVR de alto volumen.

Para qué sirve

  • ·IVR y respuestas de voz masivas
  • ·TTS en CPU de bajo costo
  • ·Lectura de textos en tiempo real
Licencia
Apache 2.0
Parámetros
82M
Sin servidor
On-premise cliente

Piper TTS

Por Rhasspy

Síntesis local en CPU para entornos aislados sin internet.

Para qué sirve

  • ·TTS offline en entornos aislados
  • ·Voz en dispositivos edge/CPU
  • ·Entornos sin conectividad (hospitales, banca)
Licencia
MIT
Parámetros
~20M
On-premise cliente

LivePortrait

Por Kuaishou

Destacado

Animación facial expresiva desde una sola foto.

Para qué sirve

  • ·Avatares a partir de una foto
  • ·Animación facial en tiempo real
  • ·Presentadores virtuales
Licencia
MIT
Parámetros
~130M
Dedicado / VPS
On-premise cliente

SadTalker

Por Tencent ARC

Video-avatar hablante sincronizado con audio.

Para qué sirve

  • ·Videos de avatar parlante
  • ·Formación corporativa con avatar
  • ·Contenido audiovisual automatizado
Licencia
Apache 2.0
Parámetros
~150M
Dedicado / VPS

Wav2Lip HD

Por IIIT-H

Lipsync de alta precisión sobre video existente.

Para qué sirve

  • ·Doblaje y localización de videos
  • ·Sincronización labial HD
  • ·Reutilización de video corporativo
Licencia
MIT
Parámetros
~50M
Dedicado / VPS
On-premise cliente

MusicGen Large

Por Meta

Generación musical condicionada por texto o melodía.

Para qué sirve

  • ·Música para videos y anuncios
  • ·Jingles y branding sonoro
  • ·Composición asistida por texto
Licencia
CC-BY-NC
Parámetros
3.3B
Sin servidor
Dedicado / VPS

Stable Audio Open

Por Stability AI

Pistas y efectos de sonido para branding y espera telefónica.

Para qué sirve

  • ·Música de espera telefónica
  • ·Efectos de sonido personalizados
  • ·Audio de marca (sound branding)
Licencia
Stability Community
Parámetros
1.2B
Dedicado / VPS

AudioGen

Por Meta

Efectos y ambientes sonoros generativos.

Para qué sirve

  • ·Efectos de sonido para video
  • ·Ambientes sonoros para apps
  • ·Audio generativo para juegos
Licencia
CC-BY-NC
Parámetros
1.2B
Sin servidor

FLUX.1 schnell

Por Black Forest Labs

Generación de imagen rápida para catálogos y marketing.

Para qué sirve

  • ·Imágenes de producto y marketing
  • ·Generación rápida a alto volumen
  • ·Piezas para redes sociales
Licencia
Apache 2.0
Parámetros
12B
Sin servidor
Dedicado / VPS

Stable Diffusion XL

Por Stability AI

Generación de imagen configurable con LoRA de marca.

Para qué sirve

  • ·Imágenes con identidad de marca (LoRA)
  • ·Catálogos y e-commerce
  • ·Generación controlada de estilo
Licencia
OpenRAIL++
Parámetros
3.5B
Dedicado / VPS
On-premise cliente

Qwen2.5-VL 7B

Por Qwen

Lectura de documentos, facturas y formularios escaneados.

Para qué sirve

  • ·Extracción de datos de facturas
  • ·Lectura de formularios escaneados
  • ·Visión computacional sobre documentos
Licencia
Apache 2.0
Parámetros
7B
Dedicado / VPS
On-premise cliente

Docling

Por IBM

Destacado

Conversión de PDF, DOCX y XLSX a estructuras listas para RAG.

Para qué sirve

  • ·Conversión de PDF a Markdown/JSON
  • ·Ingesta documental para RAG
  • ·Extracción de tablas y layout
Licencia
MIT
Parámetros
Pipeline (no aplica)
Sin servidor
On-premise cliente

Unstructured.io

Por Unstructured

Pipeline de ingesta y limpieza de documentos empresariales.

Para qué sirve

  • ·ETL documental masivo
  • ·Limpieza y partición de documentos
  • ·Preparación de datos para embeddings
Licencia
Apache 2.0
Parámetros
Pipeline (no aplica)
Sin servidor
Dedicado / VPS

Surya OCR

Por VikParuchuri

OCR y detección de layout en 90+ idiomas.

Para qué sirve

  • ·OCR multilingüe de alta precisión
  • ·Detección de tablas y estructura
  • ·Digitalización de archivos históricos
Licencia
GPL/Comercial
Parámetros
~1B
Dedicado / VPS
On-premise cliente

BGE-M3

Por BAAI

Embeddings multilingües densos y dispersos para búsqueda híbrida.

Para qué sirve

  • ·Búsqueda semántica multilingüe
  • ·Búsqueda híbrida (densa + dispersa)
  • ·Vectorización para RAG
Licencia
MIT
Parámetros
568M
Sin servidor
Dedicado / VPS
On-premise cliente

Nomic Embed v1.5

Por Nomic AI

Embeddings de contexto largo para bases vectoriales.

Para qué sirve

  • ·Embeddings de documentos largos
  • ·Bases vectoriales económicas
  • ·Clustering y deduplicación
Licencia
Apache 2.0
Parámetros
137M
Sin servidor
On-premise cliente

Jina Reranker v2

Por Jina AI

Reordenamiento de resultados para elevar precisión del RAG.

Para qué sirve

  • ·Re-ranking de resultados RAG
  • ·Mejora de precisión en búsqueda
  • ·Filtrado de contexto irrelevante
Licencia
Apache 2.0
Parámetros
~300M
Sin servidor
Dedicado / VPS