Trova la tua prossima opportunità

Cerca offerte per professione, competenza e località. Controlla i requisiti prima di preparare la candidatura.

Una ricerca utile non si ferma a un titolo interessante. Confronta mansioni, requisiti e condizioni con la tua esperienza. Questa guida ti aiuta a selezionare le opportunità, preparare documenti pertinenti e verificare dove inviare ogni candidatura.

L’interfaccia è in italiano. I titoli e le descrizioni delle aziende rimangono nella lingua originale di pubblicazione, che può essere l’inglese.

Cancella filtri

Risultati: 8531

← Torna ai risultati

AI Systems Performance Specialist

Bright Vision Technologies

Lavoro da remoto

Località
Remote (United States)
Retribuzione
USD 130000-180000 per annual
Orario
Full Time
Pubblicato
8 ott 2026

Prima di candidarti, verifica sul sito dell’azienda che la posizione sia ancora aperta e leggi le condizioni complete.

Descrizione della posizione

L’interfaccia è in italiano. I titoli e le descrizioni delle aziende rimangono nella lingua originale di pubblicazione, che può essere l’inglese.

Bright Vision Technologies is a technology consulting and software development company delivering cloud, AI, data, and enterprise solutions across the United States. This is a fantastic opportunity to join an established and well-respected organization offering tremendous career growth potential. Job Title AI Systems Performance Specialist Location: 100% Remote (Continental United States) Position Type: Full-time, Direct W2 Salary Range: $130,000–$180,000 Annually Experience Required:10+ Years Sponsorship: U.S. Citizens, Green Card Holders, EAD Holders, and H-1B transfer candidates are encouraged to apply. We are unable to sponsor new H-1B visa petitions for this position. Job Summary Bright Vision Technologies is seeking a highly experienced AI Systems Performance Specialist with 10+ years of experience in AI infrastructure, machine learning systems, High-Performance Computing (HPC), and performance engineering. The ideal candidate will optimize AI training and inference workloads for maximum performance, scalability, reliability, and cost efficiency. This role requires deep expertise in GPU optimization, distributed training, Large Language Model (LLM) inference, Python, C++, CUDA, and production AI systems, along with the ability to lead performance optimization initiatives across enterprise-scale AI platforms. Key Responsibilities Optimize AI training and inference pipelines for maximum throughput, low latency, scalability, and infrastructure efficiency. Analyze and improve GPU utilization, memory management, kernel execution, and multi-GPU performance across production AI workloads. Design and implement optimization techniques including quantization, pruning, mixed precision, batching, caching, speculative decoding, and model parallelism. Profile AI applications using industry-standard performance analysis tools and identify bottlenecks across compute, memory, networking, and storage. Optimize distributed training and inference using NCCL, DeepSpeed, PyTorch Distributed, Ray, MPI, or similar distributed computing frameworks. Collaborate with AI researchers, ML engineers, platform engineers, and infrastructure teams to improve model performance and production reliability. Build automated benchmarking frameworks, performance dashboards, monitoring solutions, and regression testing pipelines. Evaluate emerging AI hardware, GPU architectures, inference frameworks, and optimization technologies to improve enterprise AI capabilities. Drive AI infrastructure cost optimization through efficient resource utilization, cloud optimization, and FinOps best practices. Mentor engineering teams and provide technical leadership on AI systems architecture, GPU optimization, and performance engineering. Required Qualifications Bachelor's or Master's degree in Computer Science, Computer Engineering, Electrical Engineering, Artificial Intelligence, or a related technical discipline. 10+ years of professional experience in performance engineering, AI infrastructure, machine learning systems, High-Performance Computing (HPC), or distributed computing. Expert-level programming skills in Python and C++. Extensive experience optimizing GPU-accelerated AI workloads using CUDA, distributed training frameworks, and modern deep learning libraries. Strong knowledge of Large Language Models (LLMs), deep learning frameworks, model serving, and production AI inference. Hands-on experience with profiling tools such as NVIDIA Nsight Systems, Nsight Compute, PyTorch Profiler, TensorBoard, or similar performance analysis tools. Experience deploying and optimizing AI workloads on AWS, Microsoft Azure, or Google Cloud Platform (GCP). Strong understanding of distributed systems, networking, storage optimization, and AI infrastructure architecture. Excellent analytical, troubleshooting, communication, and technical leadership skills. Preferred Qualifications Experience optimizing production-scale LLM inference and serving large foundation models. Hands-on experience with vLLM, TensorRT-LLM, DeepSpeed, Triton Inference Server, CUTLASS, FasterTransformer, or similar AI optimization frameworks. Knowledge of model compression, KV cache optimization, speculative decoding, and advanced inference optimization techniques. Experience implementing FinOps strategies for AI infrastructure cost optimization and resource management. Contributions to AI systems research, open-source AI infrastructure projects, patents, or technical publications. Familiarity with emerging AI accelerator technologies, including AMD ROCm, Intel oneAPI, or custom AI hardware. Interested in this opportunity? Apply today for immediate consideration! Email your updated resume: Call or Text: (908) 505-3545 Learn more: Bright Vision Technologies is an Equal Opportunity Employer. Equal Employment Opportunity (EEO) Statement Bright Vision Technologies (BV Teck) is committed to equal employment opportunity (EEO) for all employees and applicants without regard to race, color, religion, sex, sexual orientation, gender identity or expression, national origin, age, genetic information, disability, veteran status, or any other protected status as defined by applicable federal, state, or local laws. This commitment extends to all aspects of employment, including recruitment, hiring, training, compensation, promotion, transfer, leaves of absence, termination, layoffs, and recall. BV Teck expressly prohibits any form of workplace harassment or discrimination. Any improper interference with employees' ability to perform their job duties may result in disciplinary action up to and including termination of employment. Originally posted on Himalayas

Cerca, confronta e prepara la candidatura

Inizia da una professione o competenza che desideri utilizzare. Regola i filtri di località e professione e apri le offerte per confrontare le responsabilità. Se non trovi risultati, prova un termine più breve o elimina un filtro alla volta.

Distingui i requisiti indispensabili dalle preferenze. Controlla orario, retribuzione e località quando sono indicati. Un lavoro da remoto può comunque richiedere la residenza in un paese, un’autorizzazione al lavoro o orari compatibili. Conferma la disponibilità e le condizioni complete con l’azienda.

Scegli esempi reali della tua esperienza che rispondano ai requisiti della posizione. Spiega il tuo contributo e usa numeri solo quando puoi dimostrarli. Segui le istruzioni dell’azienda e controlla i contatti, il contenuto e il PDF prima di inviare la candidatura.

Prima di inviare la candidatura

Domande sulla ricerca di lavoro

Perché alcuni annunci sono in inglese?

Le aziende scrivono i propri titoli e le proprie descrizioni. Conserviamo questi testi per non alterare requisiti o condizioni. La navigazione e questa guida sono in italiano. Se una ricerca in italiano non restituisce risultati, prova anche il ruolo o la competenza nella lingua dell’annuncio, per esempio “software engineer”.

Un lavoro da remoto permette di lavorare da qualsiasi paese?

Non necessariamente. L’azienda può limitare i paesi di residenza, richiedere un’autorizzazione al lavoro o stabilire orari precisi. Controlla l’annuncio originale. Se queste informazioni mancano, chiedi conferma all’azienda prima di presumere di poter lavorare dalla tua posizione.

Cosa posso fare se non ci sono risultati?

Prova un titolo più generale o una sola competenza e rimuovi un filtro alla volta. Le aziende usano nomi diversi per ruoli simili. Se un annuncio specifico è scomparso, cerca il suo riferimento nella pagina carriere dell’azienda: ampliare la ricerca non riapre una posizione chiusa.

La candidatura viene inviata tramite ResumizeAI?

Il pulsante per candidarti apre un sito esterno. Segui le istruzioni dell’azienda o del fornitore di selezione e conferma l’invio su quel sito. Preparare un CV in ResumizeAI non equivale a inviare una candidatura. Se il collegamento apre solo il sito aziendale, cerca prima la posizione.

Come adatto CV e lettera di presentazione?

Collega i requisiti a progetti, attività e risultati che puoi spiegare. Evidenzia l’esperienza pertinente senza inventare competenze o successi. Nella lettera, spiega il tuo interesse con un esempio concreto. Rispetta la lingua e il formato richiesti e rileggi entrambi i documenti prima dell’invio.