A startup chinesa DeepSeek lançou o modelo de inferência R1, que é comparável em desempenho ao modelo o1 da OpenAI, mas com custos significativamente reduzidos. O custo por milhão de tokens de entrada é de apenas cerca de 0,14 a 0,55 dólares, muito abaixo dos 7 a 15 dólares do modelo o1. Essa discrepância chamou a atenção do mercado: com a maturação da tecnologia, os custos de uso da IA continuarão a cair?
O custo de uso da IA está diminuindo cerca de 10 vezes a cada ano
Hoje, o CEO da OpenAI, Sam Altman, publicou um artigo compartilhando três observações sobre a economia da IA, uma das quais se concentra na tendência acentuada de queda dos custos da IA.
Altman apontou que o custo de usar qualquer nível específico de IA está diminuindo cerca de 10 vezes a cada ano, e preços mais baixos resultarão em maior uso. Ele citou os exemplos do GPT-4 e do GPT-4o, onde, de início de 2023 até meados de 2024, o preço por token caiu cerca de 150 vezes, o que é suficiente para comprovar a veracidade dessa tendência.
Ele enfatizou ainda mais que, em comparação com a velocidade da Lei de Moore, que dobra o desempenho a cada 18 meses, a queda nos custos da IA é incrivelmente rápida.
Com a contínua queda dos custos da IA, Altman prevê:
Os preços de muitos bens acabarão caindo drasticamente, porque muitos dos custos atuais vêm das limitações de inteligência e energia.
Por outro lado, o preço de bens de luxo e recursos essencialmente escassos (como terra) pode aumentar de forma mais acentuada.
A "Lei Altman" da indústria de IA?
Ao rever a história da indústria de semicondutores, a Lei de Moore previu com sucesso a trajetória de duplicação de desempenho dos chips a cada 18 meses, tornando-se o padrão áureo que impulsiona o progresso da indústria. Muitas grandes empresas de tecnologia também seguiram esse exemplo e apresentaram previsões de crescimento para seus respectivos campos.
Hoje, a afirmação de Sam Altman de que "os custos da IA diminuem 10 vezes a cada ano" tem potencial para se tornar a "Lei Altman" da indústria de IA?
Se essa observação continuar verdadeira, ela se tornará a lei áurea da evolução dos custos no modelo da indústria de IA e estabelecerá novos marcos para o desenvolvimento tecnológico futuro.
As outras duas observações
Além disso, as outras duas observações feitas por Sam Altman são:
1) O nível de inteligência dos modelos de IA é aproximadamente igual ao logaritmo dos recursos utilizados para treiná-los e operá-los
Esses recursos incluem principalmente poder de computação para treinamento, dados e poder de computação para inferência. Altman observou que, desde que se invista dinheiro suficiente, é possível obter melhorias de desempenho contínuas e previsíveis, e esse fenômeno se alinha com a lei de escalonamento que atravessa múltiplas ordens de magnitude.
2) O aumento linear da inteligência da IA tem um valor socioeconômico superexponencial
Isso significa que Altman observou que, mesmo que a inteligência da IA apresente um crescimento linear, o valor socioeconômico que ela traz pode explodir de forma superexponencial. Ele afirmou ainda que, portanto, não temos razões para acreditar que esse frenesi de investimento em nível exponencial vai parar no curto prazo.
Altman afirmou que, se essas três observações continuarem válidas, o impacto da IA na sociedade será enorme. Em um nível econômico, pode se tornar uma grande quebra de paradigma científica que pode ser amplamente aplicada e profundamente integrada em todos os setores, assim como os transistores. Ele declarou:
Assim como não prestamos atenção especial aos transistores ou às empresas relacionadas, mas seu valor está em toda parte, permeando todos os aspectos da vida. Da mesma forma, no futuro, talvez não falemos mais especificamente sobre a IA, mas esperemos naturalmente que produtos como computadores, televisores, automóveis e brinquedos tenham funções inteligentes impressionantes.
A redução extrema de custos ajuda na democratização da IA
Por outro lado, com o avanço contínuo da tecnologia de IA, Altman acredita que o risco de desequilíbrio de poder entre empregadores e empregados pode surgir mais rapidamente do que o esperado, portanto, é necessário "intervir antecipadamente", e não esperar que os problemas se agravem para tentar resolvê-los.
Altman apresentou uma ideia que soa um tanto "estranha", como: fornecer a cada pessoa na Terra um certo "orçamento de recursos computacionais" (compute budget), permitindo que todos usem uma quantidade justa de recursos de IA.
Ao mesmo tempo, ele observou que a contínua redução dos custos da IA pode, por si só, alcançar efeitos semelhantes. Se os custos se aproximarem de zero, os recursos de IA poderão se tornar tão acessíveis quanto ar ou água corrente, sem a necessidade de intervenção política adicional, beneficiando a todos.
Por fim, Altman articulou seus objetivos:
Até 2035, qualquer pessoa deve ser capaz de utilizar um nível equivalente à inteligência coletiva da humanidade em 2025, e todos devem ser capazes de usar um gênio ilimitado e guiá-lo de acordo com sua própria imaginação.
Atualmente, há uma grande quantidade de talentos que não conseguem demonstrar plenamente seu potencial devido à falta de recursos; se pudermos mudar essa situação, os resultados criativos gerados globalmente trarão enormes benefícios para todos nós.
