Avec le convertisseur Markdown → JSONL, la quantité de JSONL collectés à partir de la documentation officielle est passée de 1074 à 1180.
Au petit matin, j’ai travaillé avec un camarade de SSAFY et nous avons discuté de philosophie liée à l’IA, d’astronomie et de diverses hypothèses, ce qui m’a donné l’impression d’élargir considérablement mon champ de pensée.
En conversant avec le camarade de SSAFY sur le thème « L’IA ne serait‑elle pas identique à l’humain ? », nous avons comparé l’apprentissage de l’IA et celui de l’humain.
Le processus par lequel un bébé apprend le monde à travers la vue, l’ouïe, l’odorat, etc., ressemble à du SFT, et la façon dont les parents corrigent les répétitions pourrait être vue comme du DPO.
Si l’on créait une simulation d’IA, on pourrait y inclure une IA infantile, une IA entraînée, des événements de descendance/extinction/naissance, ainsi que des événements naturels comme la formation de la Terre, l’évolution, les impacts d’astéroïdes, les séismes, etc.
Si toutes les IA partageaient la même philosophie et les mêmes règles de sécurité, elles convergeraient vers la moyenne ou s’effondreraient ; il serait donc nécessaire d’avoir un écosystème d’IA avec des philosophies et des capacités différentes.
Le déclin de la mémoire ou la démence chez les personnes âgées peut être comparé aux hallucinations de l’IA, et la prise de notes, la lecture, la compréhension du contexte ressemblent à un apprentissage continu et à une correction de mémoire pour les humains.
J’ai rapidement consulté les références partagées par le camarade de SSAFY :
Docusaurus Playground : page permettant d’essayer le site de documentation Docusaurus directement dans le navigateur.
Article Meta Astryx de DesignCompass : article sur le système de design basé sur React + StyleX publié par Meta. Il était intéressant de voir qu’il s’agissait d’un système de design conçu pour être compris et utilisé facilement par les agents de codage IA.
Le README devient de plus en plus volumineux, ce qui fait que la revue de PR Qwen passe trop de temps à lire le corps du README et ne saisit pas correctement le contexte du code réel.
Dans le workflow de revue de PR Qwen, j’ai exclu le fichier README.md de l’entrée de la revue.
J’ai poursuivi l’enregistrement avec le Qwen Validation Debugger de l’entrée 23 jusqu’à l’entrée 32.