Promotion in Angewandter Mathematik · seit 2018 im Betrieb

KI-Forscher und ML-Engineer

Mathematik Agenten Produktion

Ich baue agentische KI-Systeme und bringe sie zu echten Nutzerinnen und Nutzern: Multi-Agenten-Orchestrierung, RAG und MCP, auf Azure betrieben, hinter typisierten Verträgen, einer Testsuite und einem Freigabeschritt durch einen Menschen. In der Promotion in Angewandter Mathematik habe ich gelernt, vorher zu beweisen, dass ein System funktioniert.

Beratung zu Agenten-Engineering, Evaluation, RAG und Context-Engineering sowie zum Betrieb in der Produktion. Nahe München, vor Ort, hybrid oder remote.

Gabin Maxime Nguegnang, KI-Forscher und ML-Engineer

Was ich mache

Meine Schwerpunkte

Agentic AI

Multi-Agenten-Orchestrierung mit MCP-Werkzeuggrenzen und CRAG-Retrieval. Der Agent liest die Anfrage, den Rest erledigen typisierte Verträge und exakte Solver.

ML in Produktion

Pipelines, die die Übergabe überstehen: Container, CI/CD, Monitoring und ein Weg zurück. Das Deployment gehört zum Bau, genau wie der Code.

Deep-Learning-Systeme

Verteiltes Training und Modellparallelität auf HPC-Clustern. Die Lernraten kommen aus der Theorie, nicht aus einer Suche, die GPU-Stunden kostet.

Forschung und Evaluation

Eine Konvergenzanalyse, erschienen bei Springer Nature, und die Evaluationsverfahren, die Ihnen sagen, ob ein Modell wirklich besser geworden ist.

Ausgewählte Arbeiten

Ein Multi-Agenten-System im Betrieb, eine Alignment-Pipeline, ein Retrieval-Stack und ein Prognosemodell, das der Betrieb bis heute nutzt. Jede Zahl unten öffnet die Fallstudie dahinter.

Alignment von Frontier-Modellen · laufende Beratung

Agentic AI und Post-Training-Strategien

Frontier-Modelle bei schweren naturwissenschaftlichen Aufgaben besser machen, und die Bewertung so bauen, dass sich der Fortschritt messen lässt statt behaupten.

RLVR, wo die Antwort objektiv ist, RLHF, wo sie es nicht ist, und Bewertungsraster dazwischen für eine abgestufte Note. Dazu die Analyse von Agenten-Trajektorien und die Präferenzdatensätze, die SFT und DPO speisen.

  • RLHF
  • RLVR
  • SFT
  • DPO
  • Chain-of-Thought
  • Rubric evaluation

Retrieval-Forschung · laufend

Vierstufige hybride RAG-Pipeline für wissenschaftliche Fragen

QASPER-Benchmark

Die Forschung hinter diesem Chatboard: wie sich die eine passende Textstelle unter 47 810 findet, und wann das System zugibt, dass es keine gibt, statt eine Antwort zu erfinden.

SPECTER2- und BM25-Retrieval, per RRF zusammengeführt, ColBERT-v2-Reranking, ein kalibriertes CRAG-Gate und Generierung mit Llama-3.1-8B samt Zitaten im Text. Eine einzige Korrektur an der Antwortextraktion hob den ALCE-Recall von 0,057 auf 0,84.

  • SPECTER2
  • BM25
  • ColBERT v2
  • CRAG
  • HyDE
  • vLLM
  • RAGAS

Prognose · im Betrieb

Intelligentes Prognose- und Warnsystem für den Kraftstoffverbrauch

Im Betrieb

Telekomstandorte in Kamerun verloren Diesel, und niemand sah wo. Das System sagt vorher, was ein Standort verbrauchen sollte, und meldet die Standorte, die mehr verbrauchen. Der Betrieb nutzt es bis heute.

Ein Random-Forest-Regressor hinter einer Flask-Webanwendung, mit einer Abweichungsschwelle beim Mittelwert plus 2 Standardabweichungen, einem Monitoring-Dashboard und Exporten für Audits.

  • Python
  • Flask
  • Scikit-Learn
  • Pygal
  • Render.com
  • NVIDIA
  • DeepLearning.AI
  • Coursera
  • Munich Center for Machine Learning
  • Outlier AI

Zertifiziert in fortgeschrittener Agentenprogrammierung, fortgeschrittenem Prompt-Engineering, generativer KI mit großen Sprachmodellen (LLM), Modellparallelität für Bau und Betrieb großer neuronaler Netze sowie MLOps für die Produktion.

Über mich

Kurz zu meiner Person

Ich habe in Kamerun angefangen und eine App zur Kraftstoffprognose gebaut, die die Technikerinnen und Techniker an den Basisstationen selbst bedienten. Danach habe ich sechs Jahre lang bewiesen, wann der Gradientenabstieg konvergiert und warum.

Beide Hälften stecken in dem, was ich heute liefere: agentische Systeme, die Entscheidungen an exakte Solver geben, Retrieval, das seine Quellen nennt, und eine Zahl an jeder Aussage. Das Deployment ist meine Ziellinie.