AI Jobs Map

INOCO · Paris, Île-de-France, France

AI Solution Architect

full timePosted 24 days ago
Apply on LinkedInOpens the original posting. AI Jobs Map never asks for your details.

Stack mentioned

ragagentic-aipythonlangchainmlflowazureopenaigcpawskubernetesopenshiftci/cdmicroservicesoauthidentity-and-access-managementgenerative-ai

NOCO est une ESN indépendante de 60 personnes, détenue par ses salariés. On accompagne des grands comptes (banque, assurance, énergie, industrie) et des start-ups sur leurs projets IA, du cadrage jusqu'à la mise en production.

Entre le moment où un cas d'usage est validé et celui où une équipe écrit du code, il reste les décisions qui coûtent cher à défaire. Où tourne le modèle et sous quelles conditions contractuelles. Ce qui relève du RAG, de l'agentique ou d'un traitement plus simple. Comment le tout s'accroche à un SI qui a vingt ans, avec son IAM, ses API et ses bases historiques. Combien ça coûtera par mois quand dix mille personnes s'en serviront tous les jours.

On cherche un ou une architecte pour porter ces décisions côté client, en amont et en transverse : plusieurs produits, plusieurs équipes, des comités d'architecture à convaincre.

Ce que tu feras côté mission client

-
Architecture cible et trajectoire pour aller du POC à une plateforme mutualisée, avec les étapes intermédiables assumées.

-
Choix structurants : modèles et mode d'hébergement (SaaS, cloud privé, souveraineté, on-premise), bases vectorielles, orchestration, mémoire, protocoles d'outillage.

-
Conception des architectures RAG à l'échelle et des systèmes multi-agents : découpage, routage, gestion du contexte, reprise sur erreur.

-
Intégration au SI existant : identité et propagation des droits, API, flux de données, contraintes réseau, réversibilité.

-
Observabilité et évaluation : ce qu'on trace, ce qu'on mesure, comment on détecte une régression de qualité en production.

-
FinOps de l'inférence : modélisation des coûts, leviers d'optimisation, arbitrages avec la qualité et la latence.

-
Dossiers d'architecture, passage en comité, arbitrages build ou buy, et défense des choix devant la DSI et la sécurité.

-
Cadrage technique en amont des projets, puis appui aux squads de réalisation pendant l'industrialisation.

Ce que tu feras en interne chez INOCO

-
Contribuer à structurer le pôle d'expertise IA : patterns d'architecture de référence, arbres de décision, kits de démarrage sur lesquels la communauté s'aligne.

-
Faire monter en compétences les Lead Tech et les AI Engineers sur les sujets d'architecture GenAI : sessions techniques, revues croisées, accompagnement sur leurs missions.

-
Pré-vente : appui aux ingénieurs d'affaires sur les sujets IA complexes, contribution aux réponses techniques et aux chiffrages.

-
Veille active sur l'écosystème (nouveaux modèles, MCP, A2A, frameworks d'orchestration et d'évaluation) et diffusion auprès des équipes.

-
Animation : meet-ups, conférences, INOCODAY, projets internes. Les sujets qui tiennent à cœur trouvent leur place.

La stack typique

-
Python (très bon niveau attendu, l'architecture se prouve en maquettant)

-
GenAI : LangChain, LangGraph, bases vectorielles, MCP, A2A, Langfuse, MLflow, frameworks d'évaluation, guardrails

-
Modèles : Azure OpenAI, Vertex AI, Bedrock, modèles ouverts auto-hébergés selon les contraintes du client

-
Cloud : Azure, GCP ou AWS selon le contexte client

-
Infra : Kubernetes (souvent OpenShift en grand compte), IaC, CI/CD, OTEL, Dynatrace

-
Patterns : microservices, event-driven, RAG avancé, agentique, OAuth2, propagation d'identité

Preferred experience

-
10 ans et plus en développement logiciel, dont une expérience significative en architecture de solutions.

-
Projets GenAI ou agentiques en production, à une échelle qui a imposé des compromis.

-
Habitude des environnements contraints : comités d'architecture, exigences de sécurité, legacy, processus achats.

-
Capacité à écrire un dossier d'architecture lisible par un décideur non technique, et à le défendre.

-
Autonomie dans les arbitrages, en environnement Agile exigeant.

-
Français et anglais courants à l'écrit et à l'oral (réunions client, documentation technique).

Format adapté à la séniorité, en 3 étapes :

-
Premier échange avec un ingénieur d'affaires pour comprendre ton parcours, tes envies et le contexte.

-
Entretien technique avec un consultant du pôle d'expertise IA : discussion d'architecture autour d'un cas concret tiré de tes projets passés.

-
Rencontre dans nos locaux avec un des fondateurs pour parler de toi, de nous, et de la suite.

More jobs at INOCO