CUDA-Armee
Nvidia, CUDA, AI, SaaS, Unternehmen, Optimierung, Algorithmus, Datenstrukturen, Compiler, Inferenz, Training, Pipeleines, Sharding, parallel, GPU, NPU, XPU, TPU, AMD, Intel, Pytorch, Jax, Cu

Beschreibung
Wir optimieren Ihr neuronales Netzwerktraining und Ihre Inferenzpipelines für Ihre Zielhardware.
Wir sind auf Nvidia-GPUs und -Bibliotheken spezialisiert: CUDA, CuBLAS, CuTLASS, CuDNN, CuTe, NCCL, NVSHMEM.Auf Wunsch arbeiten wir aber auch auf anderen Plattformen und DSLs.
Wir sind ein erfahrenes Team in den Bereichen Quantisierung, Pruning, Destillation, verteilte Systeme, Parallelisierung, Sharding, Compiler und benutzerdefinierte Kernel wie Flash-Attention-Varianten.
Wir trainieren auch benutzerdefinierte Modelle mithilfe Ihrer proprietären Daten und wahren dabei Datenschutz und Sicherheit.Wir haben Projekte zu folgenden Aufgaben durchgeführt:
•Computer Vision und Bildverarbeitung
•SLAM und Robotiksysteme
•Verstärkendes Lernen
•Große Sprachmodelle und Feinabstimmung
•3D-Grafik und Rendering