Senior Gen-AI Engineer

  • Lieu :
    San Jose, California, US
  • Autre Emplacement
    Raleigh, NC
  • Centre d'intérêt
    Ingénieur - logiciels
  • Plage De Rémunération
    207700 USD - 264000 USD
  • Type de poste
    Expérimenté
  • Intérêt pour la technologie
    Intelligence Artificielle
  • ID de poste
    1430196

The application window is expected to close on: March 14th, 2025

Job posting may be removed earlier if the position is filled or if a sufficient number of applications are received.

Who We Are 

The Cisco IT team is changing the way we run Cisco's operations by leveraging the power of technology, the best of business processes, and utilizing outstanding data insights. We are redefining how Cisco designs and delivers the employee, partner, and customer experience based on a culture that values customer service. We strive for speed and agility in all that we do. Above all else, we are kind to each other. We aspire to be an industry-leading IT team, with a strong focus on AI and security to differentiate us and foster innovation. To achieve simplicity and the best employee and customer experience, we need excellent talent and the right abilities to succeed.

Who You'll Work With 

You will work with our amazing Data Infrastructure & Platforms team as part of the Infrastructure & Cloud Services. You will build solutions and support them across our portfolio of capabilities, primarily focusing on enabling AI/ML and Generative AI capabilities in a multi-functional team setup. You will collaborate with other engineers, architects, and organization leadership.

Who You Are

We are looking for a highly skilled Senior GenAI Engineer to lead the deployment and management of Gen AI based applications and services, with a focus on Retrieval Augmented Generation (RAG). This role requires expertise in developing and supporting large-scale GenAI and ML platforms, with a strong emphasis on document management, security, vector databases, and workflow orchestration. The successful candidate will have extensive experience in responsible AI practices, including toxicity screening and ensuring regulatory compliance across AI solutions. 

What You’ll Do


  • Design and develop Gen AI based applications and frameworks for on-prem environments, focusing on Retrieval Augmented Generation (RAG) and ensuring high-performance infrastructure.
  • Build and optimize secure, scalable AI/ML platforms that support enterprise-level document management and data security protocols.
  • Design, implement, and manage workflows to ensure seamless document processing, ingestion, classification, and retrieval within AI models.
  • Implement and manage vector databases to support efficient document search and retrieval within AI workflows.
  • Ensure compliance with organizational and regulatory data security standards, including encryption, access control, and auditing of sensitive documents used within AI models.
  • Implement and maintain responsible AI practices, including toxicity screening, bias detection, and regulatory compliance to ensure ethical and safe AI usage.
  • Collaborate with cross-functional teams to ensure data privacy and information security requirements are met when processing documents through AI models.
  • Continuously evaluate and improve infrastructure to support evolving AI/ML needs, particularly focusing on document ingestion, classification, and retrieval.
  • Develop and maintain automated pipelines for LLM deployment and secure document processing with real-time monitoring and alerts.
  • Work closely with compliance, legal, and governance teams to ensure AI models are aligned with security and regulatory frameworks.
  • Stay updated on the latest advancements in AI/ML, document security, and responsible AI practices.

Minimum Qualifications 


  • Bachelor's in Computer Science, Computer Engineering, Electrical Engineering, or a related STEM field.
  • 5+ years hands-on experience in AI/ML engineering, particularly with on-prem LLM deployments on RAG.
  • Proficiency in Python programming language or similar.
  • Hands-on experience with ML frameworks such as LangChain, LlamaIndex, Kubeflow, AI operators, with proficiency in Python for AI operations.
  • Experience with MLOps principles, including model deployment, versioning, and/or monitoring in secure environments.
  • Experience with vector databases, such as Pinecone, Weaviate, Milvus or similar.
  • Experience collaborating with cross functional team such as legal, compliance and security experts.

Preferred Qualifications


  • Master’s Degree in Computer Science, Computer Engineering, Electrical Engineering, or a related STEM field.
  • Experience with multi-instance GPUs and containerized AI/ML workflows.
  • Understanding of document lifecycle management, particularly in the context of AI model ingestion, classification, and retrieval.

Why Cisco


#WeAre Cisco, where each person is unique, but we bring our talents to work as a team and make a difference powering an inclusive future for all.
We embrace digital and help our customers implement change in their digital businesses. Some may think we're "old" (39 years strong) and only about hardware, but we're also a software company. And a security company. We even invented an intuitive network that adapts, predicts, learns, and protects. No other company can do what we do - you can't put us in a box!

But "Digital Transformation" is an empty buzz phrase without a culture that allows for innovation, creativity, and yes, even failure (if you learn from it).

Day to day, we focus on the give and take. We give our best, give our egos a break, and give of ourselves (because giving back is built into our DNA). We take accountability, bold steps, and take difference to heart. Because without diversity of thought and a dedication to equality for all, there is no moving forward.

So, you have colorful hair? Don't care. Tattoos? Show off your ink. Like polka dots? That's cool. Pop culture geek? Many of us are. Passion for technology and world changing? Be you, with us!


Message aux candidats qui postulent pour travailler aux États-Unis et au Canada :

Lorsqu’elle est disponible, la fourchette salariale affichée pour ce poste reflète l’échelle d’embauche prévue pour les salaires des nouveaux embauchés aux États-Unis et au Canada. Pour les postes non liés à la vente, les fourchettes d’embauche reflètent uniquement le salaire de base; les employés sont également admissibles à des primes annuelles. Les fourchettes d’embauche pour les postes de vente comprennent la rémunération de base et la rémunération incitative. La rémunération individuelle est déterminée par le lieu d’embauche du candidat et par d’autres facteurs, incluant, sans s’y limiter, les compétences, l’expérience et les études, certifications ou formations pertinentes. Les candidats pourraient ne pas être admissibles à la fourchette salariale complète selon leur lieu d’embauche aux États-Unis ou au Canada. Le recruteur peut fournir plus d’informations sur la rémunération du poste dans votre lieu au cours du processus de recrutement.

Les employés américains ont accès à une assurance médicale, dentaire et visuelle de qualité, à un régime 401(k) avec une contribution équivalente de Cisco, à une couverture d’invalidité à court et à long terme, à une assurance vie de base et à de nombreuses prestations de bien-être.

Les employés reçoivent jusqu’à douze jours fériés payés par année civile, ce qui comprend un jour férié flottant (pour les employés non exemptés), plus un jour de congé pour leur anniversaire. Les nouveaux employés non exemptés accumulent jusqu’à 16 jours de congés annuels, à raison de 4,92 heures par période de paie. Les nouveaux employés exemptés participent à la politique de congés annuels flexibles de Cisco qui ne fixe pas de limite précise quant au nombre de jours de congé pouvant être pris par les employés admissibles. Cependant, cette flexibilité dépend de la disponibilité et de certaines contraintes opérationnelles. Tous les nouveaux employés sont admissibles aux congés de maladie, sous réserve de la Politique relative aux congés de maladie de Cisco. Ils auront droit à quatre-vingts (80) heures de congés de maladie à leur date d’embauche et le 1er janvier de chaque année par la suite. Jusqu’à 80 heures de congés de maladie non utilisées seront reportées d’une année civile à l’autre, de sorte que le nombre maximal d’heures de congé de maladie dont un employé peut disposer est de 160 heures. Les employés de l’Illinois bénéficient d’un programme spécifique de congés spécialement conçu pour répondre aux exigences locales. Tous les employés disposent également de congés payés pour faire face à des situations critiques ou d'urgence. Nous offrons des heures supplémentaires rémunérées pour faire du bénévolat et rendre service à la communauté.

Les employés participant à des plans de vente reçoivent, en plus de leur salaire de base, une rémunération incitative fondée sur les performances, qui est répartie entre les composantes sur quota et non. Pour la rémunération incitative basée sur des quotas, Cisco paie généralement comme suit :

0,75 % de l'incitatif cible pour chaque tranche de 1 % du chiffre d’affaires atteint jusqu’à concurrence de 50 % du quota;

1,5 % de l'incitatif cible pour chaque tranche de 1 % du chiffre d'affaires atteint entre 50 % et 75 %;

1 % de l'incitatif cible pour chaque tranche de 1 % du chiffre d'affaires atteint entre 75 % et 100 %; et lorsque le rendement dépasse 100 % d’atteinte, les taux incitatifs sont égaux ou supérieurs à 1 % pour chaque tranche de 1 % du chiffre d'affaires atteint, sans limites de rémunération incitative.

Pour les éléments de performance de vente non basés sur les quotas, tels que les objectifs de vente stratégiques, Cisco peut payer jusqu’à 125 % de l’objectif. Les plans de vente de Cisco ne prévoient pas de seuil minimum de performance pour le versement de la rémunération incitative pour les ventes.

Renseignements confidentiels de Cisco

Partager