Branże / Pipeline’y VPU

Infrastruktura wideo · VPU

Kontrolowana substytucja
ścieżki przetwarzania mediów

Kontrolowana substytucja ścieżki mediów — decode, scale, encode na VPU. Ingest, orkiestracja, pakowanie i dostawa zostają. Specyfikacje Quadra od vendora; wokół nich budujemy oprogramowanie operatorskie. Wyślij brief. Wycena w 24 h.

Architektura

Czym jest VPU — a czym nie jest

Video processing unit zdejmuje gęstą ścieżkę decode / scale / encode z uniwersalnego CPU. Silniki GPU (NVENC, Quick Sync, AMF) pozostają peerami grafiki i AI. Heterogenicznie: CPU = control plane; GPU = AI/grafika gdy trzeba; VPU = gęste wideo.

CPU encode

Elastyczny i znajomy — i drogi przy gęstości. Dobry do logiki sterowania, pakowania i orkiestracji; zły domyślny wybór dla setek równoległych live encode.

Silniki GPU

NVENC, Intel Quick Sync i AMD AMF to sprawdzone peery sprzętowego encode. Używajcie ich tam, gdzie już żyje grafika/AI; nie wymyślajcie nieopublikowanych stream counts.

Ścieżka VPU

Przetwarzanie mediów na ASIC zastępuje decode → filter/scale → encode. Upstream ingest i downstream pakowanie zostają. Rollback jest nudny, gdy granica klatek jest jasna.

To nie jest deklaracja partnerstwa z NETINT — przewodnik inżynierski po oprogramowaniu operatorskim i infrastrukturze wideo studia wokół opublikowanego sprzętu.

End-to-end

Gdzie VPU siedzi w pipeline

Ingest i demux zostają po stronie hosta. Zakres VPU obejmuje decode do encode. Mux, pakowanie, origin i CDN zostają w Waszym stosie.

Dekoracyjny pipeline: VPU wyróżnione na decode → filter/scale → encode.

Substytucja

Przed / po: te same krawędzie, inny środek

Wstawcie VPU w środek przetwarzania mediów. Zachowajcie kontrakty upstream i pakowanie downstream — cut-over i rollback pozostają operacyjnie nudne.

Blok CPU-heavy encode versus slot VPU decode–encode; pakowanie bez zmian.

Ramki

Zero-copy / hardware frames

Host YUV kopiuje ramki przez PCIe. Przy decoder out=hw ramki zostają na urządzeniu; filtry sprzętowe wymagają HW frames. Wybór urządzenia przez -dec / -enc.

Host YUV versus ścieżka on-device out=hw do VPU.

Form factors

Macierz NETINT Quadra (specyfikacje vendora)

Poniższe liczby to opublikowane specyfikacje produktów z netint.com — nie nasze pomiary laboratoryjne. Używajcie do capacity planning, potem mierzcie na swoich drabinkach.

T1M

M.2 · 1× ASIC

  • 8–10W/chip · opublikowana moc płyty/układu
  • Encode do 20×1080p30 / 5×4Kp30 (vendor)
  • Edge / hosty ograniczone miejscem

T1U

U.2 · 1× ASIC

  • 17W · opublikowana moc płyty/układu
  • Encode do 32×1080p30 / 8×4Kp30 (vendor)
  • Gęstość scale-out w DC

T1A

AIC PCIe add-in · 1× ASIC

  • 20W · opublikowana moc płyty/układu
  • Encode do 32×1080p30 / 8×4Kp30 (vendor)
  • Zapas termiczny / karty precision

T2A

AIC dual-chip · karta 40W

  • 40W · opublikowana moc płyty/układu
  • Encode do 64×1080p30 / 16×4Kp30 (vendor)
  • Gęstość / cost-per-stream

Encode (vendor): H.264, HEVC, AV1, JPEG (8/10-bit). Decode: H.264, HEVC, VP9, JPEG. Integracja: FFmpeg, GStreamer, libxcoder, Bitstreams control plane. PCIe 4.0 x4 na ścieżce migracji.

Encode (vendor)
H.264HEVCAV1JPEG
Decode (vendor)
H.264HEVCVP9JPEG
Host I/O
PCIe 4.0 x48/10-bit
Oprogramowanie

Widoczna zmiana nazwy enkodera

Operator powinien widzieć podmianę enkodera w konfiguracjach i metrykach — nie cichy binarium. FFmpeg: libx265 → h265_ni_quadra_enc; HW frames na urządzeniu dla filtrów sprzętowych.

FFmpeg

Zamieńcie enkodery software na nazwy Quadra (np. h265_ni_quadra_enc). Decoder out=hw trzyma ramki na urządzeniu; -dec / -enc wybierają urządzenia.

GStreamer

Elementy pipeline łączą tę samą granicę decode → filter → encode. Preferujcie HW memory, gdy filtry są sprzętowe.

libxcoder

Niższy poziom kontroli sesji i zasobów, gdy wrappery FFmpeg nie wystarczają do Waszej orkiestracji.

Bitstreams™ control plane

Vendor control plane do konfiguracji floty. Traktujcie jako opublikowaną powierzchnię integracji — wersje potwierdźcie na scopingu.

Migracja

Kontrolowana substytucja — siedem krótkich kroków

Skrót praktyki migracji na VPU: najpierw pomiar, jasna granica klatek, feature parity (nie bit-identity), skalowanie tylko na dowodach.

1 · Baseline

Uchwyćcie jakość drabinki, gęstość, obciążenie CPU/GPU i tryby awarii zanim dotkniecie urządzeń.

2 · Host / software fit

Potwierdźcie generację PCIe, kopertę termiczną, buildy sterownika/FFmpeg i form factor (M.2 / U.2 / AIC).

3 · Jasna granica klatek

Ustalcie, gdzie kończą się host frames, a zaczynają HW frames, by filtry i enkodery dzieliły jeden memory contract.

4 · Feature parity ≠ bit-identity

Dopasujcie wymagane funkcje i cele percepcyjne. Nie wymagajcie bit-exact względem ścieżki software.

5 · Równoległy rollback

Prowadźcie ścieżki VPU i legacy równolegle z cut-over po stronie operatora i nudnym przełącznikiem rollbacku.

6 · Monitoring urządzenia

Podłączcie ni_rsrc_mon (load, sessions, memory) obok sygnałów zdrowia streamu przed podniesieniem concurrency.

7 · Skaluj według evidence

Zwiększajcie gęstość tylko gdy telemetria i zdrowie streamu mieszczą się w uzgodnionych budżetach.

Operacje

Telemetria urządzenia spotyka zdrowie streamu

Pojemność bez korelacji to zgadywanie. Połączcie obciążenie ASIC z playback i zdrowiem drabinki, by operator widział przyczynę, nie tylko objawy.

ni_rsrc_mon

Load dekodera/enkodera, sesje i pamięć — puls urządzenia obok głębokości kolejki.

Zdrowie streamu

Świeżość segmentów, błędy encode, kadencja klatek kluczowych i zdrowie origin CDN pozostają first-class.

Koreluj

Gdy zdrowie streamu spada, sprawdźcie nasycenie urządzenia zanim obwicie pakowanie lub CDN.

FAQ

Pytania, które operatorzy zadają najpierw

Bez deklaracji partnerstwa. Budujemy oprogramowanie operatorskie i infrastrukturę wideo wokół opublikowanego sprzętu — w tym NETINT Quadra VPU — i cytujemy specyfikacje vendora jako specyfikacje vendora.
T1M (M.2, edge), T1U (U.2, scale-out), T1A (AIC single), T2A (AIC dual-chip). Waty i stream counts powyżej są od vendora; walidujcie na swoich drabinkach.
Zmieniają się nazwy enkoderów (np. libx265 → h265_ni_quadra_enc). Preferujcie decoder out=hw; filtry sprzętowe potrzebują HW frames; urządzenia przez -dec / -enc.
Ingest, orkiestracja, pakowanie, origin i dostawa CDN. VPU zastępuje środek mediów, by rollback pozostał nudny.

Potrzebujecie ścieżki operatorskiej gotowej na VPU?

Wyślij brief — drabinki, cele gęstości, ograniczenia hosta. Wycena w 24 godziny.