Cette mise à jour du modèle cette semaine m’a un peu engourdi. GPT-6 Sol/Luna vient juste de sortir, Opus 5.5 a suivi de près, avec 40% de réduction et 30% de rapidité en plus. Dans mon équipe, on ne regarde déjà plus les classements : on regarde combien ça coûte par million de tokens, si la latence est stable, et si l’API plante ou non.

Au contraire, la nouvelle de Qualcomm m’intrigue davantage : un nouveau processeur capable de faire tourner localement un MoE 30B sur téléphone. Si ça se concrétise vraiment, beaucoup de petits outils n’auront même plus besoin d’ajuster une API.

Et puis il y a Snorkel, valorisée multipliée par trois jusqu’à 3,5 milliards : ça veut dire quoi ? Même quand le modèle est plus puissant, les données qu’on lui fournit dépendent toujours du travail humain pour être nettoyées. La chose la moins chère ici, c’est le modèle ; la chose la plus précieuse, c’est toujours des données propres.