и посмотреть медиа

CompilerJobs - вакансии компиляторов
и посмотреть медиа
Канал с вакансиями в сфере компиляторов и связанных технических направлений.
Канал с вакансиями в сфере компиляторов и связанных технических направлений.
Сборник вакансий для специалистов по компиляторам и смежным областям. Регулярные обновления о рабочих местах в этой нише.


#вакансия #GPU #CUDA #Triton #kernels #compilers #MLIR #XLA #performance #cpp #Rust #inference #MLSys #hardware #founding #Paris #relocation 🔸 Software Engineer — Computation Kernels & Performance 🔸 Компания: Arago 🔸 Локация: Париж (Франция); помогаем с релокацией 🔸 Занятость: full-time 🔸 Формат: on-site / гибрид (Париж) 🔸 Уровень: founding-инженер, от €100k + значимый equity Arago — французский deep-tech стартап. Строим AI-inference серверы на прорыве в co-packaged optics: архитектура уже taped out и снижает стоимость $/M токенов в 10–30×. Работаем в stealth, есть контракты с AI-лабами, подняли $100M+ от Tier-1 VC и полупроводниковых ветеранов. Ищем founding-инженера на роль Computation Kernels & Performance. Суть роли: заставить ML-модели быстро исполняться на нашем железе. Ты работаешь между моделью и кремнием — строишь слой кернелы / компилятор / рантайм, а не создаёшь модели. 🔸 Задачи: — Писать и оптимизировать GPU/accelerator-кернелы (CUDA C++, Triton) — Разрабатывать и дорабатывать DL-компиляторы (torch.compile / TorchInductor / Dynamo, MLIR/LLVM, XLA/OpenXLA) — Профилировать и ускорять инференс-нагрузки: latency, throughput, энергоэффективность — Оптимизировать исполнение моделей под кастомный AI-акселератор — Строить пайплайны генерации/оптимизации кернелов (в т.ч. agentic) — Искать bottlenecks на уровне kernel / compiler / runtime / hardware — Доводить систему от прототипа до production-ready 🔸 Задачи: — GPU-кернелы (CUDA C++, Triton) — DL-компиляторы (torch.compile/TorchInductor, MLIR/LLVM, XLA) — Профилирование и оптимизация инференса (latency/throughput) — Оптимизация под кастомный AI-акселератор 🔸 Требования: — Сильный C/C++ (Rust — плюс) — Опыт хотя бы в одном: GPU-кернелы / DL-компиляторы / inference-рантаймы (vLLM, SGLang, TensorRT, Dynamo) — Профилирование и hardware-aware оптимизация — Разговорный английский Плюсом: кастомные акселераторы (Tenstorrent, Trainium, Ascend, Graphcore, TPU), контрибьюции в vLLM/MLIR/OpenXLA. 🔸 Контакт: TG @AnnPaMi (Анна) · [email protected]
Открыть канал и посмотреть медиаSolo los usuarios registrados pueden compartir su opinión.
¡Sé el primero en compartir tu experiencia con este recurso!
El canal con las mejores vacantes para trabajar en China.
Trabajos en el sector de blockchain y cripto, trabajo a distancia.