donator JOBS

More on Temu

Bilişim ve yazılım

Uzaktan pozisyon: Machine Learning Engineer - Inference Optimization

Featherless AI

Her yerdenUzaktan
Başvur

Bağlantı özgün ilana götürür. Donator başvuru almaz.

Yayımlandı: (bugün)Aktif: 23 Kasım 2026 tarihine kadar

Özetle: Machine Learning Engineer - Inference Optimization, Bilişim ve yazılım kategorisinde uzaktan

Bu ilanı Featherless AI yayımladı, aranan pozisyon: Machine Learning Engineer - Inference Optimization. Pozisyon, Bilişim ve yazılım kategorisinde ve tümüyle uzaktan. Şirket adayın yaşadığı yere hiçbir kısıt koymuyor, dolayısıyla yaşadığınız yerden başvurabilirsiniz.

İlan özellikle şunu öne çıkarıyor: Machine Learning. Tam da bu araçla edinilmiş deneyim belirleyici olacak.

Şirket herhangi bir rakam yayımlamadı, bu konu görüşmede netleşir. İlan, çalışma saatleri konusunda hiçbir koşul koymuyor.

Bu ilan otomatik bir denetimden geçti: yabancı çalışma izni, vize sponsorluğu, belirli bir vatandaşlık ya da adı geçen bir ülkede ikamet isteyen ilanlar listeye girmez.

Kısaca

Şirket
Featherless AI
Kategori
Bilişim ve yazılım
Kimler başvurabilir
Dünyanın herhangi bir ülkesinden
Çalışma biçimi
Tümüyle uzaktan
Araçlar
Machine Learning
Çalışma türü
Tam zamanlı
Yayımlandı
24 Eylül 2026 (bugün)
Aktif
23 Kasım 2026 tarihine kadar
Kaynak
Himalayas

Yeni ilanlar e-postayla: Bilişim ve yazılım

Pano günde birkaç kez güncelleniyor. Yalnızca yeni ve denetimden geçmiş bir ilan çıktığında yazıyoruz. Spam yok, hesap açmanız da gerekmiyor.

Zaten abone misiniz? Ayarları yönetin

Şirketin açıklaması

About the Role We’re looking for a Machine Learning Engineer to own and push the limits of model inference performance at scale . You’ll work at the intersection of research and production-turning cutting-edge models into fast, reliable, and cost-efficient systems that serve real users. This role is ideal for someone who enjoys deep technical work, profiling systems down to the kernel/GPU level, and translating research ideas into production-grade performance gains. What You’ll Do

* Optimize inference latency, throughput, and cost for large-scale ML models in production

* Profile and bottleneck GPU/CPU inference pipelines (memory, kernels, batching, IO)

* Implement and tune techniques such as:

* Quantization (fp16, bf16, int8, fp8)

* KV-cache optimization & reuse

* Speculative decoding, batching, and streaming

* Model pruning or architectural simplifications for inference

* Collaborate with research engineers to productionize new model architectures

* Build and maintain inference-serving systems (e.g. Triton, custom runtimes, or bespoke stacks)

* Benchmark performance across hardware (NVIDIA / AMD GPUs, CPUs) and cloud setups

* Improve system reliability, observability, and cost efficiency under real workloads

What We’re Looking For

* Strong experience in ML inference optimization or high-performance ML systems

* Solid understanding of deep learning internals (attention, memory layout, compute graphs)

* Hands-on experience with PyTorch (or similar) and model deployment

* Familiarity with GPU performance tuning (CUDA, ROCm, Triton, or kernel-level optimizations)

* Experience scaling inference for real users (not just research benchmarks)

* Comfortable working in fast-moving startup environments with ownership and ambiguity

Nice to Have

* Experience with LLM or long-context model inference

* Knowledge of inference frameworks (TensorRT, ONNX Runtime, vLLM, Triton)

* Experience optimizing across different hardware vendors

* Open-source contributions in ML systems or inference tooling

* Background in distributed systems or low-latency services

Why Join Us

* Real ownership over performance-critical systems

* Direct impact on product reliability and unit economics

* Close collaboration with research, infra, and product

* Competitive compensation + meaningful equity at Series A

* A team that cares about engineering quality, not hype

Originally posted on Himalayas

Metin, şirketin özgün dilinde bırakıldı, çünkü başvurunuzu da aynı dilde yapacaksınız.

Bu ilan Himalayas sitesinde yayınlandı. Özgün ilan (Himalayas)

Bu ilan hakkında sık sorulan sorular

Yaşadığım yerden Machine Learning Engineer - Inference Optimization pozisyonuna başvurabilir miyim?

Evet. Bu ilan için Featherless AI, dünyanın herhangi bir ülkesinden aday kabul ediyor; dolayısıyla başka bir ülke için çalışma izni gerekmiyor. İlan otomatik bir denetimden geçti: şirket çalışma izni, vize sponsorluğu ya da belirli bir ülkede ikamet isteseydi bu panoda yer almazdı.

Ücret olarak ne belirtilmiş?

Bu ilan için Featherless AI herhangi bir ücret yayımlamadı. Uzaktan ilanların çoğu rakam vermez, bu konu görüşmede netleşir.

Nasıl başvururum?

Başvurunuzu, Himalayas üzerinde yayımlanan özgün ilan aracılığıyla, doğrudan şirkete yaparsınız. Donator başvuru almaz, komisyon istemez ve özgeçmiş saklamaz.

Bu nasıl bir ilan?

Bu, Bilişim ve yazılım kategorisinde tümüyle uzaktan yürütülen bir pozisyon. Hibrit ilanlar ve ofiste bulunmayı gerektiren her şey bu panoda yayımlanmaz.

Bu ilan için ücretsiz sertifikalar

Bu ilanın aradığı araçlar: Machine Learning. Aşağıda tam olarak bu listeyi kapsayan ücretsiz belgeler var.

Tüm ücretsiz sertifikalar: IT and cloud

Benzer ilanlar

Picked on Temu

Uzaktan iş ilanı: Machine Learning Engineer - I… | Donator