Flash Qwen 3.8 benar-benar mengesankan, dan llama.cpp terus membaik dengan cepat dalam memprosesnya
Kolomnya adalah: prompt yang sudah ada, prompt baru, hasil yang dihasilkan, input tok/detik, output tok/detik
Ini ada di laptop saya (strix halo). Saya pikir kita sudah sangat dekat dengan titik di mana Anda bisa menggunakan model lokal untuk sebagian besar tugas, dan untuk hal yang lebih canggih, alur kerja seperti "gunakan model lokal Anda untuk mengorkestrasi kueri ke model-model yang kuat sehingga kueri Anda tidak bocor informasi pribadi" benar-benar menjadi layak.
Kolomnya adalah: prompt yang sudah ada, prompt baru, hasil yang dihasilkan, input tok/detik, output tok/detik
Ini ada di laptop saya (strix halo). Saya pikir kita sudah sangat dekat dengan titik di mana Anda bisa menggunakan model lokal untuk sebagian besar tugas, dan untuk hal yang lebih canggih, alur kerja seperti "gunakan model lokal Anda untuk mengorkestrasi kueri ke model-model yang kuat sehingga kueri Anda tidak bocor informasi pribadi" benar-benar menjadi layak.
