Cómo funciona el híbrido
StaffGPT ejecuta tus empleados de IA donde deben vivir tus datos. Mantén el trabajo sensible en máquinas que controlas, lleva el resto a la nube y gestiona todo desde un solo lugar.
Un equipo, dos entornos
Cada empleado de IA puede ejecutarse en la nube o en tu propio hardware. Tú eliges por cada empleado — sin reconstruir, sin herramientas aparte.
Nube por defecto
Los nuevos empleados empiezan en nuestra nube gestionada, así obtienes valor en minutos sin instalar nada.
Local para lo sensible
Cambia un empleado a local y sus tareas se ejecutan totalmente en una máquina tuya. Los datos nunca salen de tu red.
Enrutamiento híbrido
Mantén las tareas reguladas en tus instalaciones y deja que el resto escale a la nube — automáticamente, por política.
Cómo se enruta una tarea
- 1
Un empleado recibe una tarea desde un estudio, una programación o un compañero.
- 2
StaffGPT consulta el modo de despliegue de ese empleado: nube, local o híbrido.
- 3
Las tareas locales e híbridas sensibles se envían a una máquina vinculada y activa en tu red.
- 4
El resto se ejecuta en la nube gestionada. Los resultados vuelven al mismo lugar sin importar dónde se ejecutaron.
Cuatro formas de obtener una máquina de IA local
No necesitas conseguir hardware ni configurar nada por tu cuenta. Podemos instalarla en tu ubicación, arrendarte una máquina lista para usar, construirla para ti, o emparejar el hardware que ya tienes. La instalación y el software están incluidos en todas las opciones excepto en la de traer tu propia máquina.
La instalamos en tu ubicación
Instalación presencial
Desde $1,200
pago único, por sitio
Un ingeniero de StaffGPT va a tu oficina, instala la máquina en tu red, carga los modelos y la entrega funcionando.
- Instalación presencial y configuración de red
- Modelos instalados y probados
- Máquina emparejada y verificada contigo
- Capacitación al equipo antes de irnos
Arrendamiento de Máquinas de IA Local
Hardware por suscripción
Desde $249
al mes, por máquina
Arrienda una máquina de IA local configurada con instalación, software y soporte incluidos. Sin compra de capital ni ciclo de adquisición.
- Máquina, instalación y software incluidos
- Renovación de hardware al final del plazo
- Soporte continuo y actualizaciones de modelos
- Cancela o escala máquinas por plazo
La construimos para ti
Construcción a medida, enviada
Desde $3,400
pago único, hardware incluido
Especificamos y ensamblamos la máquina, instalamos los modelos, la probamos y la enviamos lista para emparejar — el hardware es totalmente tuyo.
- Conseguimos y ensamblamos las piezas
- Modelos preinstalados y probados
- Enviada lista para emparejar
- La máquina es totalmente tuya
Trae tu propia máquina
Usa hardware que ya tienes
Incluido
sin costo adicional
¿Ya tienes una estación de trabajo o equipo con GPU? Empárejala tú mismo en minutos con el Agente de Escritorio — sin necesidad de comprar nada.
- Funciona con hardware que ya tienes
- Emparejamiento autogestionado en minutos
- Descarga gratuita del Agente de Escritorio
- Cumple los requisitos de abajo
Los precios son puntos de partida ilustrativos para ayudarte a presupuestar — no son una cotización. El precio final depende de las especificaciones elegidas, la cantidad de máquinas, la ubicación del sitio y la duración del plazo. Contáctanos para una cotización exacta.
Elige los modelos que ejecutan tus máquinas
Todos los modelos aquí son de pesos abiertos y funcionan totalmente sin conexión una vez instalados. Elige los que coincidan con el trabajo que hacen tus departamentos — puedes ejecutar varios en una misma máquina si tiene memoria suficiente, y agregar más después sin reconstruir nada.
Nivel recomendado — una GPU de 24 GB
Qwen3 Coder 30B
Nuestro modelo predeterminado para construir
- Código
- Sitios web
- Paneles
- Tablas
- Descarga
- 18.6 GB
- VRAM
- 17 GB
Qwen3 32B
Razonamiento general y planificación
- Razonamiento
- Kanban
- Redacción
- Tablas
- Descarga
- 20.3 GB
- VRAM
- 18 GB
Qwen2.5 Coder 32B
Autocompletado de código y scripts
- Código
- Tablas
- Automatización
- Descarga
- 19.9 GB
- VRAM
- 18 GB
Devstral 24B
Trabaja en todo un repositorio
- Código
- Automatización
- Razonamiento
- Descarga
- 14.3 GB
- VRAM
- 14 GB
Gemma 3 27B
Marketing y redacción extensa
- Redacción
- Resúmenes
- Lee imágenes
- Descarga
- 17.4 GB
- VRAM
- 16 GB
Mistral Small 24B
Equilibrado para todo uso
- Redacción
- Razonamiento
- Automatización
- Descarga
- 14.3 GB
- VRAM
- 14 GB
DeepSeek R1 32B
Muestra su razonamiento paso a paso
- Razonamiento
- Análisis
- Finanzas
- Descarga
- 19.9 GB
- VRAM
- 18 GB
Muse Glimmer 30B
Modelo propio de StaffGPT
- Código
- Sitios web
- Razonamiento
- Redacción
- Descarga
- 17 GB
- VRAM
- 17 GB
Qwen 3.8 27B
Alternativa propia más ligera
- Código
- Razonamiento
- Redacción
- Descarga
- 16 GB
- VRAM
- 16 GB
Funciona en hardware modesto
Gemma 3 12B
Redacción diaria rápida
- Redacción
- Razonamiento
- Lee imágenes
- Descarga
- 8.1 GB
- VRAM
- 9 GB
Nomic Embed Text
Búsqueda en tus propios documentos
- Búsqueda
- Recuperación
- Descarga
- 0.3 GB
- VRAM
- 1 GB
Nivel estación de trabajo — GPU de 32 GB+
Qwen2.5 VL 32B
Lee capturas, escaneos y facturas
- Lee imágenes
- Documentos
- Tablas
- Descarga
- 21.7 GB
- VRAM
- 20 GB
Llama 3.3 70B
Máxima calidad, máquina más grande
- Razonamiento
- Redacción
- Código
- Tablas
- Descarga
- 42.5 GB
- VRAM
- 44 GB
Los tamaños son la descarga real de la versión de 4 bits de cada modelo; la cifra de VRAM es la que recomendamos tener libre para ejecutarlo con comodidad. El instalador de un clic sugiere un conjunto inicial pequeño en lugar de todo — el catálogo completo supera con holgura los 100 GB. Los modelos propios marcados «Por solicitud» los instala StaffGPT para ti.
Qué modelo para qué trabajo
Casi todo el resultado de negocio — sitios web, tableros de proyecto, hojas de cálculo, lógica de juegos, informes — se genera como texto o código, así que un buen modelo cubre mucho terreno. Aquí está por dónde empezar para cada tipo de trabajo.
- Aplicaciones, sitios web y landing pages
- Qwen3 Coder 30B
- Refactorización en muchos archivos
- Devstral 24B
- Tableros kanban, planes y hojas de ruta
- Qwen3 32B
- Hojas de cálculo, tablas e informes
- Qwen3 Coder 30B o DeepSeek R1 32B
- Lógica de juegos y simulaciones
- Qwen3 Coder 30B
- Textos de marketing y documentos largos
- Gemma 3 27B
- Análisis financiero y auditorías
- DeepSeek R1 32B
- Leer escaneos, facturas y capturas
- Qwen2.5 VL 32B
- Buscar en tus propios documentos
- Nomic Embed Text
Generar imágenes y video requiere un segundo entorno
La instalación local de arriba ejecuta modelos de lenguaje y código. La generación de imágenes, gráficos y video usa un tipo de modelo completamente distinto que el entorno estándar no sirve — por eso es un complemento aparte y no forma parte del instalador de un clic. Consúltanos si lo necesitas y dimensionamos la máquina para ello.
SDXL
ImágenesFotos de producto, imágenes de marketing, gráficos generales
~10-12 GB
FLUX.1 dev
ImágenesImágenes de mayor fidelidad, incluido texto dentro de la imagen
~16-24 GB
Wan 2.2
VideoClips de video cortos en resoluciones más bajas
~16-24 GB
Las cifras de memoria son aproximadas — los modelos de imagen y video varían enormemente según la resolución, la precisión y las optimizaciones, así que tómalas como estimaciones de planificación y no como requisitos firmes. Ten en cuenta que un modelo que lee imágenes, como Qwen2.5 VL arriba, no puede dibujarlas.
Qué necesitas para ejecutar en local
Cada máquina ejecuta el Agente de Escritorio de StaffGPT más los modelos que elijas del catálogo de arriba. La cuantización GGUF permite que los mismos pesos se ajusten a distinto hardware — mayor cuantización requiere menos memoria de GPU, mayor precisión requiere más.
Mínimo
Solo CPU, con paciencia
- SO
- macOS 13+, Windows 11 o Ubuntu 22.04+
- CPU
- 8 núcleos
- Memoria
- 16 GB RAM
- GPU
- Opcional (inferencia por CPU)
- Modelo
- Modelos iniciales como Gemma 3 12B (Q4, ~8 GB)
- Almacenamiento
- 50 GB libres en SSD
- Red
- Banda ancha, HTTPS saliente
Ejecuta los modelos más pequeños en CPU/RAM a menor velocidad — bien para redacción y revisión. Ideal combinado con la nube para trabajo pesado.
Recomendado
Empleados locales fluidos
- SO
- macOS 14+, Windows 11 o Ubuntu 22.04+
- CPU
- 12+ núcleos
- Memoria
- 32 GB RAM
- GPU
- NVIDIA 24 GB VRAM (RTX 4090) o Apple serie M 32 GB
- Modelo
- Modelos del nivel recomendado (Q4_K_M, ~14-20 GB VRAM)
- Almacenamiento
- 100 GB libres en SSD
- Red
- Banda ancha, HTTPS saliente
Ejecuta cualquier modelo del nivel recomendado en cuantización de 4 bits totalmente en la GPU con baja latencia — el punto ideal para la mayoría de departamentos.
Estación de trabajo
Precisión completa en local
- SO
- Windows 11 o Ubuntu 22.04+
- CPU
- 16+ núcleos
- Memoria
- 64 GB RAM
- GPU
- NVIDIA 32 GB+ VRAM (A6000 / doble RTX 4090)
- Modelo
- Modelos grandes, o varios a la vez (~20-44 GB VRAM)
- Almacenamiento
- 200 GB+ NVMe SSD
- Red
- Banda ancha; compatible con air-gap
Ejecuta los modelos más grandes, o varios más pequeños a la vez, totalmente en casa — incluidos despliegues air-gapped.
Todos los modelos del catálogo son de pesos abiertos — gratis de descargar y totalmente sin conexión una vez instalados. Solo se requiere HTTPS saliente — sin puertos entrantes. El agente se autentica con su propia clave y nunca expone tu máquina a internet.
Conecta una computadora en cuatro pasos
La vinculación une una máquina a tu cuenta con su propia identidad criptográfica. Toma alrededor de un minuto.
Agrega la computadora
En tu página de Máquinas, haz clic en Agregar computadora para generar un código de vinculación de un solo uso, válido por cinco minutos.
Instala el agente de escritorio
Descarga y abre el Agente de Escritorio de StaffGPT en la máquina que quieras usar. Genera una clave privada que nunca sale del dispositivo.
Ingresa el código
Pega el código de vinculación en el agente. Registra la máquina y une su clave pública a tu cuenta.
Queda activa
La máquina empieza a enviar latidos y aparece como Activa — En línea. Puedes revocarla en cualquier momento, de forma instantánea y permanente.
Descarga un archivo. Haz doble clic. Listo.
Todos los scripts y el software que tu máquina necesita vienen en un solo instalador. Descárgalo desde tu página de Máquinas, haz doble clic y la máquina aparecerá en línea en tu espacio de trabajo — sin terminal, sin comandos, sin configuración.
Windows
StaffGPT-Setup.cmdHaz doble clic en el archivo
macOS
StaffGPT-Setup-macos.zipDescomprime y haz doble clic
Linux
StaffGPT-Setup-linux.zipDescomprime y haz doble clic o ejecuta
Lo que el instalador hace por ti
- Verifica tu CPU, memoria, disco y GPU según los niveles de abajo
- Instala el entorno de Node.js correcto si aún no está presente
- Descarga el Agente de Escritorio de StaffGPT y verifica que funcione
- Empareja la máquina con tu espacio de trabajo automáticamente
- Ofrece instalar el entorno de modelos y descargar el modelo que elijas
- Registra un servicio en segundo plano para que el agente reinicie con la computadora
- Confirma que la primera señal llegó a tu espacio de trabajo antes de terminar
El instalador es por usuario: nunca pide contraseña de administrador y no instala nada a nivel del sistema. Todo queda en tu carpeta personal y puede eliminarse por completo con un solo comando de desinstalación. Tu código de emparejamiento ya viene incluido, así que no hay nada que escribir ni copiar.
Instalación y puesta en marcha, paso a paso
Un procedimiento estándar y repetible para convertir una máquina tuya en un entorno local funcional. La mayoría quedan operativas en menos de 15 minutos.
¿Prefieres hacerlo manualmente?
Los scripts individuales siguen disponibles para sitios sin conexión, imágenes de flota y administradores que quieran inspeccionar o automatizar cada paso. El procedimiento de abajo documenta esa ruta completa — el instalador de un clic ejecuta exactamente estos mismos pasos por ti.
- 1
Pre-califica la máquina
Ejecuta el script de precalificación para confirmar que CPU, memoria, disco y GPU alcanzan un nivel. Solo lee especificaciones y no envía nada.
- 2
Instala los requisitos previos
Instala Node.js 18+ y un entorno de modelos local. No se requieren agentes con privilegios ni puertos entrantes — solo HTTPS saliente.
- 3
Descarga y abre el Agente de Escritorio
Obtén el agente desde tu página de Máquinas y ejecútalo en la máquina objetivo. Genera una clave privada que nunca sale del dispositivo.
- 4
Vincula con un código de un solo uso
Haz clic en Agregar computadora, copia el código de cinco minutos y pégalo en el agente para unir la máquina a tu cuenta.
- 5
Valida
Confirma que la máquina aparece como Activa — En línea, asigna un empleado de prueba en modo local y ejecuta una tarea de principio a fin.
- 6
Endurece y mantén en línea
Instala el agente como servicio para que se reinicie al arrancar y siga en línea. Revoca al instante desde la web si pierdes una máquina.
Cuánto cuesta lo local
- Instalación y onboarding guiadosContactar ventas
Configuraci��n white-glove opcional, endurecimiento y validación del primer empleado por sede.
- Vinculación de máquinasGratis
Máquinas vinculadas ilimitadas en todos los planes — sin cargo por dispositivo.
- Entorno localContactar ventas
Precio por debajo del cómputo en la nube; el trabajo local compensa tu uso de nube.
- Cómputo en la nubePor uso
Se cobra solo por las tareas que realmente se ejecutan en la nube gestionada.
Las cifras se cierran con ventas según la escala y las necesidades de soporte. La vinculación autoservicio y el Agente de Escritorio son siempre gratis.
Pre-califica y luego verifica la conectividad
Dos scripts reales que descargas desde tu página de Máquinas: uno revisa el hardware y el otro comprueba que la máquina puede vincularse y mantenerse en línea.
Primero ejecuta la precalificación para confirmar que la máquina alcanza un nivel. Luego vincula el Agente de Escritorio con un código de un solo uso y déjalo corriendo — se registra, envía latidos firmados y la máquina queda Activa — En línea.
# 1. Precalifica: lee CPU / RAM / disco / GPU, no envía nada
node prequalify.mjs
# → muestra el nivel para el que califica la máquina
# 2. En tu página de Máquinas: Agregar computadora → copia el código, luego:
node staffgpt-agent.mjs pair --url https://tu-staffgpt-url --code XXXX-XXXX
# → "Paired. Machine id: ..."
# 3. Mantenla en línea y observa cómo queda Activa — En línea
node staffgpt-agent.mjs run
# → "heartbeat ok" repetidoUna máquina sana pasa todo esto
- La precalificación reporta al menos el nivel Mínimo.
- La vinculación tiene éxito y devuelve un ID de máquina.
- El desafío de latido se firma y se acepta.
- La máquina aparece como Activa — En línea en tu página de Máquinas.
- Revocar la máquina bloquea de inmediato más latidos.
El híbrido reduce tu factura de nube
Todos los planes pueden ejecutarse en híbrido. El trabajo que corre en tus máquinas no consume cómputo en la nube — así que aportar hardware reduce tu uso.
Nube
Empleados gestionados en nuestra infraestructura. Empieza aquí y agrega máquinas cuando quieras.
- Sin hardware
- Escala elástica
- Cómputo por uso
Trae tu propia máquina
Vincula máquinas que ya tienes y saca de la nube el trabajo apto para local.
- Menos uso de nube
- Datos en tus instalaciones
- Máquinas ilimitadas
Enterprise / on-prem
Despliegues totalmente locales o air-gapped con soporte y controles dedicados.
- Listo para air-gap
- SSO y auditoría
- Soporte dedicado
Vincular máquinas es gratis en todos los planes. Consulta la comparación completa para ver el cómputo incluido y los límites.
Pon a trabajar tu propio hardware
Vincula una máquina en un minuto, o habla con nosotros sobre un despliegue totalmente on-premise.