Qwen 3.8 flash est vraiment impressionnant, et llama.cpp s’est rapidement amélioré dans son traitement
des colonnes : invite préexistante, nouvelle invite, généré, entrées (tok/s), sorties (tok/s)
C’est sur mon ordinateur portable (strix halo). Je pense que nous sommes très proches du moment où vous pourrez simplement utiliser des modèles locaux pour une grande partie des tâches, et pour tout ce qui est plus avancé, des workflows comme « utilisez votre modèle local pour orchestrer des requêtes vers des modèles puissants afin que vos requêtes ne divulguent pas vos informations personnelles » deviennent réellement viables.
des colonnes : invite préexistante, nouvelle invite, généré, entrées (tok/s), sorties (tok/s)
C’est sur mon ordinateur portable (strix halo). Je pense que nous sommes très proches du moment où vous pourrez simplement utiliser des modèles locaux pour une grande partie des tâches, et pour tout ce qui est plus avancé, des workflows comme « utilisez votre modèle local pour orchestrer des requêtes vers des modèles puissants afin que vos requêtes ne divulguent pas vos informations personnelles » deviennent réellement viables.
