и посмотреть медиа

CompilerJobs - вакансии компиляторов
и посмотреть медиа
Канал с вакансиями в сфере компиляторов и связанных технических направлений.
Канал с вакансиями в сфере компиляторов и связанных технических направлений.
Сборник вакансий для специалистов по компиляторам и смежным областям. Регулярные обновления о рабочих местах в этой нише.


#вакансия #GPU #CUDA #Triton #kernels #compilers #MLIR #XLA #performance #cpp #Rust #inference #MLSys #hardware #founding #Paris #relocation 🔸 Software Engineer — Computation Kernels & Performance 🔸 Компания: Arago 🔸 Локация: Париж (Франция); помогаем с релокацией 🔸 Занятость: full-time 🔸 Формат: on-site / гибрид (Париж) 🔸 Уровень: founding-инженер, от €100k + значимый equity Arago — французский deep-tech стартап. Строим AI-inference серверы на прорыве в co-packaged optics: архитектура уже taped out и снижает стоимость $/M токенов в 10–30×. Работаем в stealth, есть контракты с AI-лабами, подняли $100M+ от Tier-1 VC и полупроводниковых ветеранов. Ищем founding-инженера на роль Computation Kernels & Performance. Суть роли: заставить ML-модели быстро исполняться на нашем железе. Ты работаешь между моделью и кремнием — строишь слой кернелы / компилятор / рантайм, а не создаёшь модели. 🔸 Задачи: — Писать и оптимизировать GPU/accelerator-кернелы (CUDA C++, Triton) — Разрабатывать и дорабатывать DL-компиляторы (torch.compile / TorchInductor / Dynamo, MLIR/LLVM, XLA/OpenXLA) — Профилировать и ускорять инференс-нагрузки: latency, throughput, энергоэффективность — Оптимизировать исполнение моделей под кастомный AI-акселератор — Строить пайплайны генерации/оптимизации кернелов (в т.ч. agentic) — Искать bottlenecks на уровне kernel / compiler / runtime / hardware — Доводить систему от прототипа до production-ready 🔸 Задачи: — GPU-кернелы (CUDA C++, Triton) — DL-компиляторы (torch.compile/TorchInductor, MLIR/LLVM, XLA) — Профилирование и оптимизация инференса (latency/throughput) — Оптимизация под кастомный AI-акселератор 🔸 Требования: — Сильный C/C++ (Rust — плюс) — Опыт хотя бы в одном: GPU-кернелы / DL-компиляторы / inference-рантаймы (vLLM, SGLang, TensorRT, Dynamo) — Профилирование и hardware-aware оптимизация — Разговорный английский Плюсом: кастомные акселераторы (Tenstorrent, Trainium, Ascend, Graphcore, TPU), контрибьюции в vLLM/MLIR/OpenXLA. 🔸 Контакт: TG @AnnPaMi (Анна) · [email protected]
Открыть канал и посмотреть медиаOnly registered users can share their opinion.
Be the first to share your impression of this resource!
The channel is about facilitation, interaction with people and cases of Agile transformations. Useful thoughts and tools for teams.
A range of remote job positions for everyone.
Channel with current airdrops and updates. Information about new projects and opportunities in crypto.