Projets
The NMR Facility : un jeu de spectroscopie RMN encadré par Claude Fable 5.1
Un jeu dans le navigateur construit autour du véritable déroulement d'une expérience de RMN : le Dr Novák, responsable du laboratoire, remet au joueur un liquide inconnu, qui doit le faire passer par la préparation de l'échantillon, le verrouillage, le shimming, l'accord et l'acquisition, puis la correction de phase, le référencement et l'intégration d'un véritable spectre 1H/13C pour identifier le composé. Quatre tuteurs intégrés au jeu — des personnages d'IA non scriptés fonctionnant sur Claude Fable 5.1, chacun avec sa propre spécialité, de l'interprétation de base des pics à la RMN à l'état solide (rotation à l'angle magique, noyaux quadrupolaires, études de charpentes zéolithiques) — répondent à des questions ouvertes et rédigent de nouvelles questions de quiz ancrées dans la littérature scientifique actuelle plutôt que dans un script figé.
Jouer →Free Weights, Expensive Everything Else
Un essai sur ce que coûte réellement l'exécution d'un modèle à poids ouverts, pour trois profils d'acheteurs — particulier, petite entreprise, grand compte — mis en regard du record de 62 % de part de tokens en poids ouverts sur la passerelle de Vercel et de l'économie révélée derrière la tarification des modèles fermés. L'argument : les poids étant devenus une commodité, ce qui reste à disputer, c'est qui peut se payer le calcul, qui l'exploite en sécurité, et qui garde la donnée.
Lire sur Substack →ScienceLM : un petit modèle de chimie, et la discipline de ne pas croire ses propres résultats
Un modèle de langage de chimie d'environ 427 millions de paramètres, entraîné de bout en bout sur un seul GPU grand public. Le résultat d'architecture : remplacer la plupart des couches d'attention par une récurrence linéaire inspirée de la physique (un Matrix Product State, avec quelques vraies couches d'attention conservées pour les exceptions à longue portée) bat un transformer classique de 4,17× en perplexité à taille égale. Le résultat le plus intéressant est négatif : une passe de fine-tuning qui semblait presque doubler le rappel factuel (40,3 % → 79,2 %) s'est révélée être de la mémorisation du test lui-même, une fois évaluée sur des faits neufs et non touchés (30,0 %, au niveau ou en dessous de la référence). Cet écart est le vrai sujet du projet : un système de recherche documentaire construit depuis zéro pour remplacer le fine-tuning, délibérément évalué sur des faits que les données d'entraînement n'ont jamais vus, est en cours de développement.
PDF vers Markdown pour le RAG — pdf-inspector vs Docling
Une application qui convertit des PDF avec deux moteurs open source côte à côte — pdf-inspector, le nouveau moteur Rust de Firecrawl, et Docling d'IBM — pour savoir auquel confier des articles scientifiques. Spoiler : la vitesse ne fait pas tout ; les figures, si.
Lire l'article →La base des modèles d'IA — toutes les sorties depuis 2022
Une base interactive de toutes les sorties majeures de modèles d'IA depuis 2022, présentée sous forme de jeu, de frise chronologique et de base consultable. Je la maintiens parce que choisir le bon modèle pour une équipe de R&D commence par savoir ce que le domaine sait réellement faire ce trimestre.
L'explorer →