Large language models aren’t people. Let’s stop testing them as if they were. | MIT Technology Review
3 septembre 2023 à 09:02
Une synthèse intéressante sur le comportement des LLM et l'évaluation de leur "intelligence". Les tests actuels sont à interpréter d'affairement pour les humains et les LLM. La mémorisation pourrait être plus importante pour les seconds et la question de la compréhension du contexte reste incertaine
— Permalien
— Permalien