# Théo CHARLET (RDTvlokip) > Portfolio de Théo CHARLET (RDTvlokip), chercheur IA/NLP et technicien TSSR basé à Lyon, France. Créateur d'AG-BPE (tokéniseur), LISP-7 (Destructive Semantic Encoding), de la famille de LLM français Cadence/Nomade/Focal et de RDTvlokip Search (moteur de recherche indépendant, 5 021 846+ pages indexées). Diplômé TSSR — Nepsod, Bel Air School. Actuellement à la recherche d'une alternance en administration système & réseaux. Contact : contact@rdtvlokip.fr ## Projets - [AG-BPE](https://zenodo.org/records/16739553): Tokéniseur qui combine BPE et attention Transformer multi-couches pondérée (v4). Compression 3,85x, décodage 0,03ms, zéro OOV dur sur du texte multilingue. Code sur [GitHub](https://github.com/RDTvlokip/AG-BPE). - [RDTextract](https://pypi.org/project/RDTextract/): Extracteur HTML→Markdown open source pour corpus d'entraînement LLM. Score 99,3/100 sur le benchmark Tranco top-1 000 .fr, zéro artefact, détection multi-langue (FR/EN/ES/DE/IT). Code sur [GitHub](https://github.com/RDTvlokip/RDTextract). - [LISP-7](https://zenodo.org/records/17638778): Destructive Semantic Encoding — nouveau paradigme de sécurité à 7 niveaux hiérarchiques, distinct de la cryptographie classique. Résistance >10^35 ans au brute-force, testé sur 40 000+ phrases françaises. - [Cadence, Nomade & Focal](https://huggingface.co/RDTvlokip/Cadence-15M-fr): Famille de trois LLM français de 15M de paramètres entraînés from scratch sur un GTX 1080 Ti, explorant les transformers en boucle (recurrent-depth) et le calcul adaptatif par token. -7% de perplexité de validation pour Cadence. Aussi sur Hugging Face : [Nomade](https://huggingface.co/RDTvlokip/Nomade-15M-fr), [Focal](https://huggingface.co/RDTvlokip/Focal-15M-fr). - [RDTvlokip Search](https://search.rdtvlokip.fr/): Moteur de recherche indépendant français axé sur la vie privée. Crawler from-scratch (RDTvlokipBot), algorithme BM25 adaptatif + PageRank (24 signaux), 5 021 846+ pages indexées, hébergé en Allemagne, zéro tracker publicitaire. - [RDTSearch CLI](https://rdtsearch.rdtvlokip.fr/): Client terminal officiel pour RDTvlokip Search. Recherche directe en <200ms, autocomplete intelligent, détection tracker/contenu adulte, analyse SEO/backlinks et TUI interactif. Python 3.8+ mono-fichier, zéro dépendance, AGPLv3. Code sur [GitHub](https://github.com/RDTvlokip/rdtsearch), disponible sur [PyPI](https://pypi.org/project/rdtsearch/). - [RDTRL](https://zenodo.org/records/21726216): Banc expérimental testant si un réseau de neurones peut apprendre à produire du langage à partir d'une simple récompense scalaire, sans pré-entraînement ni paires entrée/sortie. Test 2 atteint 99,9% de grammaticalité sans règle apprise, mais se révèle vide à l'examen ; Test 3 (jeu référentiel à deux agents) conclut que seule la paramétrisation du réseau produit de la compositionnalité. Cinq rounds de relecture externe par Dipankar Sarkar. Code sur [GitHub](https://github.com/RDTvlokip/RDTRL). - [RDTChess](https://huggingface.co/RDTvlokip/RDTChess): Réseau résiduel de 10,92M de paramètres qui joue aux échecs en une seule passe avant — sans recherche, sans MCTS, sans livre d'ouvertures. Entraîné from-scratch sur un GTX 1080 Ti par clonage de comportement sur 5,5M de parties Lichess (≥1800 Elo). 88,7% de victoires contre un minimax profondeur 1 ; exécute les tactiques plutôt qu'il ne les initie. - [WhisperWatch](https://whisperwatch.rdtvlokip.fr/): Moniteur de disponibilité pour bots Discord et sites web/APIs, avec vérification de sécurité des URLs et alertes personnalisables. ## Publications - [AG-BPE v4: Enhanced Attention-Guided Byte-Pair Encoding with Weighted Layer Aggregation](https://zenodo.org/records/16739553): Zenodo, 2025. - [The Pre-Training Pitfall: Why Contextual Guidance for BPE Must Be Trained Concurrently](https://zenodo.org/records/15874092): Zenodo, 2025 (preprint). - [LISP-7: Linguistic Irreversible Scrambling Protocol — Destructive Semantic Encoding (DSE)](https://zenodo.org/records/17638778): 2025 (preprint). - [RDTRL — Un réseau peut-il apprendre à écrire en se basant uniquement sur les récompenses ?](https://zenodo.org/records/21726216): Zenodo, 2026, v0.5.0. - [J'ai entraîné mon propre LLM français from scratch](https://huggingface.co/blog/RDTvlokip/j-ai-entrane-mon-propre-llm-francais-from-scratch): Hugging Face Blog, 2026. Série Cadence/Nomade/Focal, article 1/4. - [Ce que j'ai appris en optimisant un LLM français](https://huggingface.co/blog/RDTvlokip/ce-que-jai-appris-en-optimisant-un-llm-francais): Hugging Face Blog, 2026. Série Cadence/Nomade/Focal, article 2/4. - [Apprendre à un LLM français de 15M à penser plus profondément](https://huggingface.co/blog/RDTvlokip/apprendre-un-llm-francais-de-15m-penser-plus-profo): Hugging Face Blog, 2026. Série Cadence/Nomade/Focal, article 3/4. - [Le mur matériel derrière ma validation multi-seed](https://huggingface.co/blog/RDTvlokip/le-mur-matriel-derriere-ma-validation-multi-seed): Hugging Face Blog, 2026. Série Cadence/Nomade/Focal, article 4/4. ## Pages - [Portfolio](https://rdtvlokip.fr/): Page d'accueil — parcours, projets, publications, compétences, stack, activité GitHub, contact. - [Ma stack & outils](https://rdtvlokip.fr/uses): Environnement de développement, langages, infrastructure et outils IA utilisés au quotidien. - [Mes liens](https://rdtvlokip.fr/links): GitHub, Hugging Face, Zenodo, ResearchGate, Google Scholar, HAL, ORCID, LinkedIn. ## Optional - [Mentions légales](https://rdtvlokip.fr/mentions-legales) - [Politique de confidentialité](https://rdtvlokip.fr/confidentialite) - [Politique de cookies](https://rdtvlokip.fr/cookies)