СтранаРоссия
ОтрасльИТ, интернет, телеком
СпециализацияМашинное обучение и ИИ
Формат работыУдалённо
Опубликовано 14 августа 2026 г.
Требования: Сильного инженера на стыке AI и hardware, который понимает, как устроен LLM inference на математическом и архитектурном уровне. LLM inference, attention, KV-cache, prefill/decode. Compute pipelines, memory hierarchy и data movement. Оптимизация kernels: tiling, fusion, buffering, scheduling. Большим плюсом будет опыт с FPGA / GPU / CUDA / Triton / TVM / MLIR / XLA и другими accelerator architectures. Локация:📍Удалённо из любой точки мира.
ITSenior
⚠️ Будьте внимательны: вакансия размещена из открытых источников и может быть недостоверна.
Зарплата
Не указано