donator JOBS

More on Temu

İT və proqramlaşdırma

Uzaqdan vəzifə: Machine Learning Engineer - Inference Optimization

Featherless AI

Hər yerdənUzaqdan
Müraciət et

Link ilkin elana aparır. Donator müraciət qəbul etmir.

Telegram-da yeni vakansiyalar

Hər yeni uzaqdan iş elanı, dərc olunan kimi.

@donator_jobs_az

Kanalı aç
Dərc olunub: (dünən)Aktiv: 23 noyabr 2026 tarixinədək

Qısaca: Machine Learning Engineer - Inference Optimization, İT və proqramlaşdırma kateqoriyasında uzaqdan

Bu elanı Featherless AI dərc edib, axtarılan vəzifə: Machine Learning Engineer - Inference Optimization. Vəzifə İT və proqramlaşdırma kateqoriyasındadır və tam uzaqdandır. Şirkət namizədin yaşadığı yerə heç bir məhdudiyyət qoymur, ona görə də yaşadığınız yerdən müraciət edə bilərsiniz.

Elan xüsusilə bunu önə çıxarır: Machine Learning. Məhz bu alətlə qazanılmış təcrübə həlledici olacaq.

Şirkət heç bir rəqəm dərc etməyib, bu məsələ müsahibədə dəqiqləşir. Elan iş saatlarına heç bir şərt qoymur.

Bu elan avtomatik yoxlamadan keçib: xarici iş icazəsi, viza sponsorluğu, konkret vətəndaşlıq və ya adı çəkilən ölkədə yaşayış tələb edən elanlar siyahıya düşmür.

Qısa məlumat

Şirkət
Featherless AI
Kateqoriya
İT və proqramlaşdırma
Kim müraciət edə bilər
Dünyanın istənilən ölkəsindən
İş forması
Tam uzaqdan
Alətlər
Machine Learning
İş növü
Tam ştat
Dərc olunub
24 sentyabr 2026 (dünən)
Aktiv
23 noyabr 2026 tarixinədək
Mənbə
Himalayas

Yeni elanlar e-poçtla: İT və proqramlaşdırma

Lövhə gündə bir neçə dəfə yenilənir. Yalnız yeni və yoxlamadan keçmiş elan çıxanda yazırıq. Spam yoxdur, hesab açmağa da ehtiyac yoxdur.

Artıq abunəsiniz? Parametrləri idarə edin

Şirkətin təsviri

About the Role We’re looking for a Machine Learning Engineer to own and push the limits of model inference performance at scale . You’ll work at the intersection of research and production-turning cutting-edge models into fast, reliable, and cost-efficient systems that serve real users. This role is ideal for someone who enjoys deep technical work, profiling systems down to the kernel/GPU level, and translating research ideas into production-grade performance gains. What You’ll Do

* Optimize inference latency, throughput, and cost for large-scale ML models in production

* Profile and bottleneck GPU/CPU inference pipelines (memory, kernels, batching, IO)

* Implement and tune techniques such as:

* Quantization (fp16, bf16, int8, fp8)

* KV-cache optimization & reuse

* Speculative decoding, batching, and streaming

* Model pruning or architectural simplifications for inference

* Collaborate with research engineers to productionize new model architectures

* Build and maintain inference-serving systems (e.g. Triton, custom runtimes, or bespoke stacks)

* Benchmark performance across hardware (NVIDIA / AMD GPUs, CPUs) and cloud setups

* Improve system reliability, observability, and cost efficiency under real workloads

What We’re Looking For

* Strong experience in ML inference optimization or high-performance ML systems

* Solid understanding of deep learning internals (attention, memory layout, compute graphs)

* Hands-on experience with PyTorch (or similar) and model deployment

* Familiarity with GPU performance tuning (CUDA, ROCm, Triton, or kernel-level optimizations)

* Experience scaling inference for real users (not just research benchmarks)

* Comfortable working in fast-moving startup environments with ownership and ambiguity

Nice to Have

* Experience with LLM or long-context model inference

* Knowledge of inference frameworks (TensorRT, ONNX Runtime, vLLM, Triton)

* Experience optimizing across different hardware vendors

* Open-source contributions in ML systems or inference tooling

* Background in distributed systems or low-latency services

Why Join Us

* Real ownership over performance-critical systems

* Direct impact on product reliability and unit economics

* Close collaboration with research, infra, and product

* Competitive compensation + meaningful equity at Series A

* A team that cares about engineering quality, not hype

Originally posted on Himalayas

Elanın mətni şirkətin öz dilində saxlanılıb, çünki müraciətinizi də həmin dildə edəcəksiniz.

Bu elan Himalayas saytında dərc olunub. İlkin elan (Himalayas)

Bu elan haqqında tez-tez verilən suallar

Yaşadığım yerdən Machine Learning Engineer - Inference Optimization vəzifəsinə müraciət edə bilərəmmi?

Bəli. Bu elan üçün Featherless AI şirkəti dünyanın istənilən ölkəsindən namizəd qəbul edir, buna görə də başqa ölkə üçün iş icazəsi lazım deyil. Elan avtomatik yoxlamadan keçib: şirkət iş icazəsi, viza sponsorluğu və ya konkret ölkədə yaşayış tələb etsəydi, bu lövhədə yer almazdı.

Əmək haqqı olaraq nə göstərilib?

Bu elan üçün Featherless AI şirkəti heç bir məbləğ açıqlamayıb. Uzaqdan elanların əksəriyyəti rəqəm göstərmir, bu məsələ müsahibədə dəqiqləşir.

Necə müraciət edim?

Müraciətinizi, Himalayas platformasında dərc olunmuş ilkin elan vasitəsilə, birbaşa şirkətə edirsiniz. Donator müraciət qəbul etmir, komissiya götürmür və CV saxlamır.

Bu necə elandır?

Bu, İT və proqramlaşdırma kateqoriyasında tam uzaqdan yerinə yetirilən vəzifədir. Hibrid elanlar və ofisdə olmağı tələb edən hər şey bu lövhədə dərc edilmir.

Bu elan üçün pulsuz sertifikatlar

Bu elanın axtardığı alətlər: Machine Learning. Aşağıda məhz bu siyahını əhatə edən pulsuz sənədlər var.

Bütün pulsuz sertifikatlar: IT and cloud

Oxşar elanlar

Picked on Temu

Uzaqdan iş elanı: Machine Learning Engineer - I… | Donator