OpenAI, Anthropic memasuki fase penurunan harga jangka panjang, biaya inferensi untuk beban kerja utama turun 40–50%.
Model menjadi lebih murah, sehingga akan mendorong perusahaan melakukan pemanggilan dalam skala besar, terutama untuk skenario konsumsi token tinggi seperti Agent. Infrastruktur seperti server inferensi, pendingin liquid (liquid cooling), dan konektivitas berkecepatan tinggi akan mendapat manfaat.
Dari sudut pandang lain, vendor model besar justru ikut terjebak dalam perang harga, sehingga margin laba kotor juga akan terkena dampak.
Penurunan harga yang signifikan adalah strategi tukar harga dengan volume, bukan berarti perangkat keras akan langsung mengalami peningkatan pengiriman. Pada akhirnya, yang menentukan adalah apakah volume panggilan token benar-benar terealisasi.#openai
Model menjadi lebih murah, sehingga akan mendorong perusahaan melakukan pemanggilan dalam skala besar, terutama untuk skenario konsumsi token tinggi seperti Agent. Infrastruktur seperti server inferensi, pendingin liquid (liquid cooling), dan konektivitas berkecepatan tinggi akan mendapat manfaat.
Dari sudut pandang lain, vendor model besar justru ikut terjebak dalam perang harga, sehingga margin laba kotor juga akan terkena dampak.
Penurunan harga yang signifikan adalah strategi tukar harga dengan volume, bukan berarti perangkat keras akan langsung mengalami peningkatan pengiriman. Pada akhirnya, yang menentukan adalah apakah volume panggilan token benar-benar terealisasi.#openai