Arquitectura híbrida

Cómo funciona el híbrido

StaffGPT ejecuta tus empleados de IA donde deben vivir tus datos. Mantén el trabajo sensible en máquinas que controlas, lleva el resto a la nube y gestiona todo desde un solo lugar.

Combina ambos

Un equipo, dos entornos

Cada empleado de IA puede ejecutarse en la nube o en tu propio hardware. Tú eliges por cada empleado — sin reconstruir, sin herramientas aparte.

Nube por defecto

Los nuevos empleados empiezan en nuestra nube gestionada, así obtienes valor en minutos sin instalar nada.

Local para lo sensible

Cambia un empleado a local y sus tareas se ejecutan totalmente en una máquina tuya. Los datos nunca salen de tu red.

Enrutamiento híbrido

Mantén las tareas reguladas en tus instalaciones y deja que el resto escale a la nube — automáticamente, por política.

Cómo se enruta una tarea

  1. 1

    Un empleado recibe una tarea desde un estudio, una programación o un compañero.

  2. 2

    StaffGPT consulta el modo de despliegue de ese empleado: nube, local o híbrido.

  3. 3

    Las tareas locales e híbridas sensibles se envían a una máquina vinculada y activa en tu red.

  4. 4

    El resto se ejecuta en la nube gestionada. Los resultados vuelven al mismo lugar sin importar dónde se ejecutaron.

Obtén tu máquina

Cuatro formas de obtener una máquina de IA local

No necesitas conseguir hardware ni configurar nada por tu cuenta. Podemos instalarla en tu ubicación, arrendarte una máquina lista para usar, construirla para ti, o emparejar el hardware que ya tienes. La instalación y el software están incluidos en todas las opciones excepto en la de traer tu propia máquina.

La instalamos en tu ubicación

Instalación presencial

Desde $1,200

pago único, por sitio

Un ingeniero de StaffGPT va a tu oficina, instala la máquina en tu red, carga los modelos y la entrega funcionando.

  • Instalación presencial y configuración de red
  • Modelos instalados y probados
  • Máquina emparejada y verificada contigo
  • Capacitación al equipo antes de irnos

Arrendamiento de Máquinas de IA Local

Hardware por suscripción

Desde $249

al mes, por máquina

Arrienda una máquina de IA local configurada con instalación, software y soporte incluidos. Sin compra de capital ni ciclo de adquisición.

  • Máquina, instalación y software incluidos
  • Renovación de hardware al final del plazo
  • Soporte continuo y actualizaciones de modelos
  • Cancela o escala máquinas por plazo

La construimos para ti

Construcción a medida, enviada

Desde $3,400

pago único, hardware incluido

Especificamos y ensamblamos la máquina, instalamos los modelos, la probamos y la enviamos lista para emparejar — el hardware es totalmente tuyo.

  • Conseguimos y ensamblamos las piezas
  • Modelos preinstalados y probados
  • Enviada lista para emparejar
  • La máquina es totalmente tuya

Trae tu propia máquina

Usa hardware que ya tienes

Incluido

sin costo adicional

¿Ya tienes una estación de trabajo o equipo con GPU? Empárejala tú mismo en minutos con el Agente de Escritorio — sin necesidad de comprar nada.

  • Funciona con hardware que ya tienes
  • Emparejamiento autogestionado en minutos
  • Descarga gratuita del Agente de Escritorio
  • Cumple los requisitos de abajo
Habla con nosotros sobre una máquina

Los precios son puntos de partida ilustrativos para ayudarte a presupuestar — no son una cotización. El precio final depende de las especificaciones elegidas, la cantidad de máquinas, la ubicación del sitio y la duración del plazo. Contáctanos para una cotización exacta.

Catálogo de modelos

Elige los modelos que ejecutan tus máquinas

Todos los modelos aquí son de pesos abiertos y funcionan totalmente sin conexión una vez instalados. Elige los que coincidan con el trabajo que hacen tus departamentos — puedes ejecutar varios en una misma máquina si tiene memoria suficiente, y agregar más después sin reconstruir nada.

Nivel recomendado — una GPU de 24 GB

Qwen3 Coder 30B

Predeterminado

Nuestro modelo predeterminado para construir

  • Código
  • Sitios web
  • Paneles
  • Tablas
Descarga
18.6 GB
VRAM
17 GB

Qwen3 32B

Razonamiento general y planificación

  • Razonamiento
  • Kanban
  • Redacción
  • Tablas
Descarga
20.3 GB
VRAM
18 GB

Qwen2.5 Coder 32B

Autocompletado de código y scripts

  • Código
  • Tablas
  • Automatización
Descarga
19.9 GB
VRAM
18 GB

Devstral 24B

Trabaja en todo un repositorio

  • Código
  • Automatización
  • Razonamiento
Descarga
14.3 GB
VRAM
14 GB

Gemma 3 27B

Marketing y redacción extensa

  • Redacción
  • Resúmenes
  • Lee imágenes
Descarga
17.4 GB
VRAM
16 GB

Mistral Small 24B

Equilibrado para todo uso

  • Redacción
  • Razonamiento
  • Automatización
Descarga
14.3 GB
VRAM
14 GB

DeepSeek R1 32B

Muestra su razonamiento paso a paso

  • Razonamiento
  • Análisis
  • Finanzas
Descarga
19.9 GB
VRAM
18 GB

Muse Glimmer 30B

Por solicitud

Modelo propio de StaffGPT

  • Código
  • Sitios web
  • Razonamiento
  • Redacción
Descarga
17 GB
VRAM
17 GB

Qwen 3.8 27B

Por solicitud

Alternativa propia más ligera

  • Código
  • Razonamiento
  • Redacción
Descarga
16 GB
VRAM
16 GB

Funciona en hardware modesto

Gemma 3 12B

Redacción diaria rápida

  • Redacción
  • Razonamiento
  • Lee imágenes
Descarga
8.1 GB
VRAM
9 GB

Nomic Embed Text

Búsqueda en tus propios documentos

  • Búsqueda
  • Recuperación
Descarga
0.3 GB
VRAM
1 GB

Nivel estación de trabajo — GPU de 32 GB+

Qwen2.5 VL 32B

Lee capturas, escaneos y facturas

  • Lee imágenes
  • Documentos
  • Tablas
Descarga
21.7 GB
VRAM
20 GB

Llama 3.3 70B

Máxima calidad, máquina más grande

  • Razonamiento
  • Redacción
  • Código
  • Tablas
Descarga
42.5 GB
VRAM
44 GB

Los tamaños son la descarga real de la versión de 4 bits de cada modelo; la cifra de VRAM es la que recomendamos tener libre para ejecutarlo con comodidad. El instalador de un clic sugiere un conjunto inicial pequeño en lugar de todo — el catálogo completo supera con holgura los 100 GB. Los modelos propios marcados «Por solicitud» los instala StaffGPT para ti.

Qué modelo para qué trabajo

Casi todo el resultado de negocio — sitios web, tableros de proyecto, hojas de cálculo, lógica de juegos, informes — se genera como texto o código, así que un buen modelo cubre mucho terreno. Aquí está por dónde empezar para cada tipo de trabajo.

Aplicaciones, sitios web y landing pages
Qwen3 Coder 30B
Refactorización en muchos archivos
Devstral 24B
Tableros kanban, planes y hojas de ruta
Qwen3 32B
Hojas de cálculo, tablas e informes
Qwen3 Coder 30B o DeepSeek R1 32B
Lógica de juegos y simulaciones
Qwen3 Coder 30B
Textos de marketing y documentos largos
Gemma 3 27B
Análisis financiero y auditorías
DeepSeek R1 32B
Leer escaneos, facturas y capturas
Qwen2.5 VL 32B
Buscar en tus propios documentos
Nomic Embed Text
Imágenes y video

Generar imágenes y video requiere un segundo entorno

La instalación local de arriba ejecuta modelos de lenguaje y código. La generación de imágenes, gráficos y video usa un tipo de modelo completamente distinto que el entorno estándar no sirve — por eso es un complemento aparte y no forma parte del instalador de un clic. Consúltanos si lo necesitas y dimensionamos la máquina para ello.

Requiere un entorno aparte

SDXL

Imágenes

Fotos de producto, imágenes de marketing, gráficos generales

~10-12 GB

FLUX.1 dev

Imágenes

Imágenes de mayor fidelidad, incluido texto dentro de la imagen

~16-24 GB

Wan 2.2

Video

Clips de video cortos en resoluciones más bajas

~16-24 GB

Las cifras de memoria son aproximadas — los modelos de imagen y video varían enormemente según la resolución, la precisión y las optimizaciones, así que tómalas como estimaciones de planificación y no como requisitos firmes. Ten en cuenta que un modelo que lee imágenes, como Qwen2.5 VL arriba, no puede dibujarlas.

Requisitos de equipo

Qué necesitas para ejecutar en local

Cada máquina ejecuta el Agente de Escritorio de StaffGPT más los modelos que elijas del catálogo de arriba. La cuantización GGUF permite que los mismos pesos se ajusten a distinto hardware — mayor cuantización requiere menos memoria de GPU, mayor precisión requiere más.

Mínimo

Solo CPU, con paciencia

SO
macOS 13+, Windows 11 o Ubuntu 22.04+
CPU
8 núcleos
Memoria
16 GB RAM
GPU
Opcional (inferencia por CPU)
Modelo
Modelos iniciales como Gemma 3 12B (Q4, ~8 GB)
Almacenamiento
50 GB libres en SSD
Red
Banda ancha, HTTPS saliente

Ejecuta los modelos más pequeños en CPU/RAM a menor velocidad — bien para redacción y revisión. Ideal combinado con la nube para trabajo pesado.

Recomendado

Empleados locales fluidos

SO
macOS 14+, Windows 11 o Ubuntu 22.04+
CPU
12+ núcleos
Memoria
32 GB RAM
GPU
NVIDIA 24 GB VRAM (RTX 4090) o Apple serie M 32 GB
Modelo
Modelos del nivel recomendado (Q4_K_M, ~14-20 GB VRAM)
Almacenamiento
100 GB libres en SSD
Red
Banda ancha, HTTPS saliente

Ejecuta cualquier modelo del nivel recomendado en cuantización de 4 bits totalmente en la GPU con baja latencia — el punto ideal para la mayoría de departamentos.

Estación de trabajo

Precisión completa en local

SO
Windows 11 o Ubuntu 22.04+
CPU
16+ núcleos
Memoria
64 GB RAM
GPU
NVIDIA 32 GB+ VRAM (A6000 / doble RTX 4090)
Modelo
Modelos grandes, o varios a la vez (~20-44 GB VRAM)
Almacenamiento
200 GB+ NVMe SSD
Red
Banda ancha; compatible con air-gap

Ejecuta los modelos más grandes, o varios más pequeños a la vez, totalmente en casa — incluidos despliegues air-gapped.

Todos los modelos del catálogo son de pesos abiertos — gratis de descargar y totalmente sin conexión una vez instalados. Solo se requiere HTTPS saliente — sin puertos entrantes. El agente se autentica con su propia clave y nunca expone tu máquina a internet.

Vincula una máquina

Conecta una computadora en cuatro pasos

La vinculación une una máquina a tu cuenta con su propia identidad criptográfica. Toma alrededor de un minuto.

01

Agrega la computadora

En tu página de Máquinas, haz clic en Agregar computadora para generar un código de vinculación de un solo uso, válido por cinco minutos.

02

Instala el agente de escritorio

Descarga y abre el Agente de Escritorio de StaffGPT en la máquina que quieras usar. Genera una clave privada que nunca sale del dispositivo.

03

Ingresa el código

Pega el código de vinculación en el agente. Registra la máquina y une su clave pública a tu cuenta.

04

Queda activa

La máquina empieza a enviar latidos y aparece como Activa — En línea. Puedes revocarla en cualquier momento, de forma instantánea y permanente.

Instalación con un clic

Descarga un archivo. Haz doble clic. Listo.

Todos los scripts y el software que tu máquina necesita vienen en un solo instalador. Descárgalo desde tu página de Máquinas, haz doble clic y la máquina aparecerá en línea en tu espacio de trabajo — sin terminal, sin comandos, sin configuración.

Windows

StaffGPT-Setup.cmd

Haz doble clic en el archivo

macOS

StaffGPT-Setup-macos.zip

Descomprime y haz doble clic

Linux

StaffGPT-Setup-linux.zip

Descomprime y haz doble clic o ejecuta

Lo que el instalador hace por ti

  • Verifica tu CPU, memoria, disco y GPU según los niveles de abajo
  • Instala el entorno de Node.js correcto si aún no está presente
  • Descarga el Agente de Escritorio de StaffGPT y verifica que funcione
  • Empareja la máquina con tu espacio de trabajo automáticamente
  • Ofrece instalar el entorno de modelos y descargar el modelo que elijas
  • Registra un servicio en segundo plano para que el agente reinicie con la computadora
  • Confirma que la primera señal llegó a tu espacio de trabajo antes de terminar

El instalador es por usuario: nunca pide contraseña de administrador y no instala nada a nivel del sistema. Todo queda en tu carpeta personal y puede eliminarse por completo con un solo comando de desinstalación. Tu código de emparejamiento ya viene incluido, así que no hay nada que escribir ni copiar.

Instalación local

Instalación y puesta en marcha, paso a paso

Un procedimiento estándar y repetible para convertir una máquina tuya en un entorno local funcional. La mayoría quedan operativas en menos de 15 minutos.

¿Prefieres hacerlo manualmente?

Los scripts individuales siguen disponibles para sitios sin conexión, imágenes de flota y administradores que quieran inspeccionar o automatizar cada paso. El procedimiento de abajo documenta esa ruta completa — el instalador de un clic ejecuta exactamente estos mismos pasos por ti.

  1. 1

    Pre-califica la máquina

    Ejecuta el script de precalificación para confirmar que CPU, memoria, disco y GPU alcanzan un nivel. Solo lee especificaciones y no envía nada.

  2. 2

    Instala los requisitos previos

    Instala Node.js 18+ y un entorno de modelos local. No se requieren agentes con privilegios ni puertos entrantes — solo HTTPS saliente.

  3. 3

    Descarga y abre el Agente de Escritorio

    Obtén el agente desde tu página de Máquinas y ejecútalo en la máquina objetivo. Genera una clave privada que nunca sale del dispositivo.

  4. 4

    Vincula con un código de un solo uso

    Haz clic en Agregar computadora, copia el código de cinco minutos y pégalo en el agente para unir la máquina a tu cuenta.

  5. 5

    Valida

    Confirma que la máquina aparece como Activa — En línea, asigna un empleado de prueba en modo local y ejecuta una tarea de principio a fin.

  6. 6

    Endurece y mantén en línea

    Instala el agente como servicio para que se reinicie al arrancar y siga en línea. Revoca al instante desde la web si pierdes una máquina.

Cuánto cuesta lo local

  • Instalación y onboarding guiadosContactar ventas

    Configuraci��n white-glove opcional, endurecimiento y validación del primer empleado por sede.

  • Vinculación de máquinasGratis

    Máquinas vinculadas ilimitadas en todos los planes — sin cargo por dispositivo.

  • Entorno localContactar ventas

    Precio por debajo del cómputo en la nube; el trabajo local compensa tu uso de nube.

  • Cómputo en la nubePor uso

    Se cobra solo por las tareas que realmente se ejecutan en la nube gestionada.

Las cifras se cierran con ventas según la escala y las necesidades de soporte. La vinculación autoservicio y el Agente de Escritorio son siempre gratis.

Prueba tu máquina

Pre-califica y luego verifica la conectividad

Dos scripts reales que descargas desde tu página de Máquinas: uno revisa el hardware y el otro comprueba que la máquina puede vincularse y mantenerse en línea.

Primero ejecuta la precalificación para confirmar que la máquina alcanza un nivel. Luego vincula el Agente de Escritorio con un código de un solo uso y déjalo corriendo — se registra, envía latidos firmados y la máquina queda Activa — En línea.

prequalify.mjs + staffgpt-agent.mjs — descarga ambos desde tu página de Máquinas
# 1. Precalifica: lee CPU / RAM / disco / GPU, no envía nada
node prequalify.mjs
# → muestra el nivel para el que califica la máquina

# 2. En tu página de Máquinas: Agregar computadora → copia el código, luego:
node staffgpt-agent.mjs pair --url https://tu-staffgpt-url --code XXXX-XXXX
# → "Paired. Machine id: ..."

# 3. Mantenla en línea y observa cómo queda Activa — En línea
node staffgpt-agent.mjs run
# → "heartbeat ok" repetido

Una máquina sana pasa todo esto

  • La precalificación reporta al menos el nivel Mínimo.
  • La vinculación tiene éxito y devuelve un ID de máquina.
  • El desafío de latido se firma y se acepta.
  • La máquina aparece como Activa — En línea en tu página de Máquinas.
  • Revocar la máquina bloquea de inmediato más latidos.
Precios

El híbrido reduce tu factura de nube

Todos los planes pueden ejecutarse en híbrido. El trabajo que corre en tus máquinas no consume cómputo en la nube — así que aportar hardware reduce tu uso.

Nube

Incluido

Empleados gestionados en nuestra infraestructura. Empieza aquí y agrega máquinas cuando quieras.

  • Sin hardware
  • Escala elástica
  • Cómputo por uso

Trae tu propia máquina

Tu hardware

Vincula máquinas que ya tienes y saca de la nube el trabajo apto para local.

  • Menos uso de nube
  • Datos en tus instalaciones
  • Máquinas ilimitadas

Enterprise / on-prem

A medida

Despliegues totalmente locales o air-gapped con soporte y controles dedicados.

  • Listo para air-gap
  • SSO y auditoría
  • Soporte dedicado
Comparar todos los planes

Vincular máquinas es gratis en todos los planes. Consulta la comparación completa para ver el cómputo incluido y los límites.

Pon a trabajar tu propio hardware

Vincula una máquina en un minuto, o habla con nosotros sobre un despliegue totalmente on-premise.