Líderes de pensamento
O que o DeepSeek pode nos ensinar sobre o custo e a eficiência da IA
Com seu logotipo de baleia fofa, o lançamento recente do DeepSeek poderia ter se resumido a mais uma cópia do ChatGPT. O que o tornou noticiável – e o que fez com que as ações de seus concorrentes entrassem em colapso – foi o pouco que custou para criá-lo. Isso efetivamente jogou um macaco na máquina da noção dos EUA sobre o investimento necessário para treinar um modelo de linguagem grande (LLM) de alta funcionalidade.
O DeepSeek supostamente gastou apenas $6 milhões para treinar seu modelo de IA. Juxtaposto a isso, está o relato de que a OpenAI gastou $80-$100 milhões no Chat GPT-4 ou os $1 bilhão que eles reservaram para o GPT-5. O DeepSeek coloca esse nível de investimento em questão e deixa grandes jogadores como a Nvidia (NVDA ) – cujo valor das ações caiu $600 bilhões em um dia –, a TSMC e a Microsoft (MSFT ) preocupados com a viabilidade financeira de longo prazo da IA. Se for possível treinar modelos de IA por significativamente menos do que se supunha anteriormente, o que isso significa para os gastos com IA em geral?
Embora a perturbação do DeepSeek tenha levado a discussões importantes, alguns pontos-chave parecem estar se perdendo na confusão. No entanto, o que a notícia traz à tona é um maior foco em quanto a inovação custa e no possível impacto econômico da IA. Aqui estão três insights importantes que surgem dessa notícia:
1. O preço de $6 milhões do DeepSeek é enganoso
As empresas precisam entender o custo total de propriedade de sua infraestrutura (TCO). Embora o preço de $6 milhões do DeepSeek tenha sido muito divulgado, isso provavelmente é o custo de apenas sua execução de pré-treinamento e não de todo o investimento. O custo total – não apenas de execução, mas de construção e treinamento do DeepSeek – provavelmente é muito maior. A firma de análise de indústria SemiAnalysis revelou que a empresa por trás do DeepSeek gastou $1,6 bilhão em hardware para tornar seu LLM uma realidade. Portanto, o custo real provavelmente está em algum lugar no meio.
Seja qual for o custo real, o advento do DeepSeek criou um foco em inovação eficiente em custos que pode ser transformacional. A inovação é frequentemente impulsionada por limitações, e o sucesso do DeepSeek destaca a forma como a inovação pode ocorrer quando as equipes de engenharia otimizam seus recursos diante de restrições do mundo real.
2. A inferência é o que torna a IA valiosa, não o treinamento
É importante prestar atenção ao custo do treinamento do modelo de IA, mas o treinamento representa uma pequena parte do custo total para construir e executar um modelo de IA. A inferência — as múltiplas maneiras pelas quais a IA muda como as pessoas trabalham, interagem e vivem — é onde a IA se torna realmente valiosa.
Isso traz à tona o paradoxo de Jevons, uma teoria econômica que sugere que, à medida que os avanços tecnológicos tornam o uso de um recurso mais eficiente, o consumo geral desse recurso pode, na verdade, aumentar. Em outras palavras, à medida que os custos de treinamento diminuem, a inferência e o consumo agente aumentarão, e os gastos gerais seguirão o mesmo caminho.
A eficiência da IA pode, de fato, levar a uma onda crescente de gastos com IA, o que deve beneficiar todas as empresas, não apenas as chinesas. Supondo que elas cavalguem a onda de eficiência, empresas como a OpenAI e a Nvidia também se beneficiarão.
3. O que permanece verdadeiro é que a economia de unidade é o que mais importa
Tornar a IA mais eficiente não é apenas sobre reduzir custos; também é sobre otimizar a economia de unidade. A Motley Fool prevê que este ano será o ano da eficiência da IA. Se estiverem certos, as empresas devem prestar atenção à redução de seus custos de treinamento de IA, bem como de seus custos de consumo de IA.
As organizações que constroem ou usam IA precisam saber sua economia de unidade, em vez de se concentrar em números impressionantes, como o custo de treinamento de $6 milhões do DeepSeek. A eficiência real envolve alocar todos os custos, rastrear a demanda impulsionada pela IA e manter um controle constante sobre o custo-valor.
A economia de unidade de nuvem (CUE) tem a ver com medir e maximizar o lucro impulsionado pela nuvem. A CUE compara seus custos de nuvem com métricas de receita e demanda, revelando quão eficiente é seu gasto em nuvem, como isso mudou ao longo do tempo e (se você tiver a plataforma certa) as melhores maneiras de aumentar essa eficiência.
Entender a CUE tem uma utilidade ainda maior em um contexto de IA, dado que é inerentemente mais caro consumir do que os serviços de nuvem tradicionais vendidos pelos hyperscalers. As empresas que constroem aplicações agentes poderiam calcular seu custo por transação (por exemplo, custo por fatura, custo por entrega, custo por negociação, etc.) e usá-lo para avaliar o retorno sobre o investimento de serviços, produtos e recursos específicos impulsionados pela IA. À medida que os gastos com IA aumentam, as empresas serão forçadas a fazer isso; nenhuma empresa pode jogar dólares infinitos em inovação experimental para sempre. Eventualmente, tem que fazer sentido para os negócios.
Rumo à maior eficiência
Seja qual for a importância do número de $6 milhões, o DeepSeek pode ter proporcionado um momento decisivo que desperta a indústria de tecnologia para a importância inevitável da eficiência. Vamos torcer para que isso abra as portas para treinamento, inferência e aplicações agentes eficientes em termos de custo que desbloqueiem o verdadeiro potencial e o ROI da IA.












