Sectores / Pipelines VPU

Infraestructura de video · VPU

Sustitución controlada
de la ruta de procesamiento media

Sustitución controlada de la ruta media — decode, scale, encode en VPU. Ingest, orquestación, packaging y delivery se quedan. Specs Quadra publicadas por el vendor; construimos el software de operador alrededor. Envía el brief. Presupuesto en 24 h.

Arquitectura

Qué es una VPU — y qué no es

Una video processing unit quita la ruta densa decode / scale / encode de la CPU de propósito general. Los motores GPU (NVENC, Quick Sync, AMF) siguen siendo pares para gráficos e IA. Heterogéneo: CPU = control plane; GPU = IA/gráficos cuando hace falta; VPU = video denso.

Encode CPU

Flexible y familiar — y caro en densidad. Bien para lógica de control, packaging y orquestación; mal valor por defecto para cientos de encodes live simultáneos.

Motores GPU

NVENC, Intel Quick Sync y AMD AMF son pares de encode hardware probados. Úsenlos donde ya viven gráficos/IA; no inventen stream counts no publicados.

Ruta VPU

El procesamiento media en ASIC sustituye decode → filter/scale → encode. El ingest upstream y el packaging downstream se quedan. El rollback es aburrido cuando el límite de frames es claro.

No es un claim de partnership con NETINT — una guía de ingeniería para software de operador e infraestructura de video del estudio alrededor de hardware publicado.

Extremo a extremo

Dónde se sitúa la VPU en el pipeline

Ingest y demux siguen en el host. El tramo VPU cubre decode hasta encode. Mux, packaging, origin y CDN se quedan en su stack.

Pipeline decorativo: VPU resaltada en decode → filter/scale → encode.

Sustitución

Antes / después: mismos bordes, distinto medio

Inserte la VPU en el medio del procesamiento media. Conserve contratos upstream y packaging downstream para que cut-over y rollback sigan siendo operativamente aburridos.

Bloque encode CPU-pesado versus slot VPU decode–encode; packaging sin cambios.

Frames

Zero-copy / hardware frames

Las rutas YUV de host copian frames por PCIe. Con decoder out=hw, los frames se quedan en el device; los filtros hardware requieren HW frames. Selección de device vía -dec / -enc.

YUV de host versus ruta on-device out=hw hacia la VPU.

Factores de forma

Matriz NETINT Quadra (specs de vendor)

Las cifras abajo son specs de producto publicadas en netint.com — no nuestras mediciones de laboratorio. Úsenlas para capacity planning y luego midan en sus escaleras.

T1M

M.2 · 1× ASIC

  • 8–10W/chip · potencia publicada de placa/chip
  • Encode hasta 20×1080p30 / 5×4Kp30 (vendor)
  • Edge / hosts con poco espacio

T1U

U.2 · 1× ASIC

  • 17W · potencia publicada de placa/chip
  • Encode hasta 32×1080p30 / 8×4Kp30 (vendor)
  • Densidad scale-out en DC

T1A

AIC PCIe add-in · 1× ASIC

  • 20W · potencia publicada de placa/chip
  • Encode hasta 32×1080p30 / 8×4Kp30 (vendor)
  • Margen térmico / tarjetas precision

T2A

AIC dual-chip · tarjeta 40W

  • 40W · potencia publicada de placa/chip
  • Encode hasta 64×1080p30 / 16×4Kp30 (vendor)
  • Densidad / cost-per-stream

Encode (vendor): H.264, HEVC, AV1, JPEG (8/10-bit). Decode: H.264, HEVC, VP9, JPEG. Integración: FFmpeg, GStreamer, libxcoder, Bitstreams control plane. PCIe 4.0 x4 en la ruta de migración.

Encode (vendor)
H.264HEVCAV1JPEG
Decode (vendor)
H.264HEVCVP9JPEG
I/O de host
PCIe 4.0 x48/10-bit
Software

Cambio de nombre de encoder visible

Los operadores deben ver el swap de encoder en configs y métricas — no un binario silencioso. FFmpeg: libx265 → h265_ni_quadra_enc; HW frames en device para filtros hardware.

FFmpeg

Sustituyan encoders software por nombres Quadra (p. ej. h265_ni_quadra_enc). Decoder out=hw mantiene frames en device; -dec / -enc seleccionan devices.

GStreamer

Los elementos de pipeline cablean el mismo límite decode → filter → encode. Prefieran memoria HW si los filtros son hardware.

libxcoder

Control de bajo nivel para sesiones y recursos cuando los wrappers FFmpeg no bastan para su orquestación.

Bitstreams™ control plane

Control plane del vendor para configuración de flota. Trátenlo como superficie de integración publicada — verifiquen versiones en el alcance.

Migración

Sustitución controlada — siete pasos cortos

Condensado de la práctica de migración VPU: medir primero, límite de frames claro, feature parity (no bit-identity), escalar solo con evidencia.

1 · Baseline

Capturen calidad de escalera, densidad, carga CPU/GPU y modos de fallo antes de tocar devices.

2 · Fit de host / software

Confirmen generación PCIe, envolvente térmica, builds de driver/FFmpeg y form-factor (M.2 / U.2 / AIC).

3 · Límite de frames claro

Decidan dónde terminan los frames de host y dónde empiezan los HW frames para que filtros y encoders compartan un contrato de memoria.

4 · Feature parity ≠ bit-identity

Alineen features requeridas y objetivos perceptuales. No exijan salida bit-exact frente a la ruta software.

5 · Rollback en paralelo

Ejecuten rutas VPU y legacy en paralelo con cut-over del operador y un switch de rollback aburrido.

6 · Monitoreo de device

Conecten ni_rsrc_mon (load, sessions, memoria) junto a señales de salud de stream antes de subir concurrency.

7 · Escalar con evidencia

Suban densidad solo cuando telemetría y salud de stream se mantengan dentro de presupuestos acordados.

Operación

Telemetría de device encuentra salud de stream

Capacidad sin correlación es adivinanza. Emparejen carga ASIC con playback y salud de escalera para que el operador vea la causa, no solo síntomas.

ni_rsrc_mon

Load de decoder/encoder, sessions y memoria — el pulso del device junto a la profundidad de cola.

Salud de stream

Frescura de segmentos, errores de encode, cadencia de keyframes y salud de origin CDN siguen first-class.

Correlacionar

Cuando baja la salud de stream, revisen saturación de device antes de culpar packaging o CDN.

FAQ

Preguntas que los operadores hacen primero

Sin claim de partnership. Construimos software de operador e infraestructura de video alrededor de hardware publicado — incluidos VPU NETINT Quadra — y citamos specs de vendor como specs de vendor.
T1M (M.2, edge), T1U (U.2, scale-out), T1A (AIC single), T2A (AIC dual-chip). Vatios y stream counts arriba son del vendor; validen en sus escaleras.
Cambian los nombres de encoder (p. ej. libx265 → h265_ni_quadra_enc). Prefieran decoder out=hw; filtros hardware necesitan HW frames; devices vía -dec / -enc.
Ingest, orquestación, packaging, origin y delivery CDN. La VPU sustituye el medio media para que el rollback siga aburrido.

¿Necesitan una ruta de operador lista para VPU?

Envíen el brief — escaleras, objetivos de densidad, restricciones de host. Presupuesto en 24 horas.