Passei os últimos meses ouvindo empresários perguntarem qual é o melhor modelo. É a pergunta errada.
Por Olsen Rodrigo*
Em setembro, as maiores empresas de inteligência artificial do mundo anunciaram que diminuirão o ritmo. As ações de chips caíram. Uma delas recusou o acordo e lançou o produto na mesma semana. Se você ficou em dúvida se isso muda algo na sua empresa, a resposta curta é: quase nada. A conta que muda o seu negócio está em outro lugar, e é bem mais barata do que parece.
Primeiro, quem são os donos dessa corrida
A imprensa fala em “laboratórios de IA” e quase ninguém sabe quem são. São quatro empresas que constroem os motores da inteligência artificial: a OpenAI, do ChatGPT; a Anthropic, do Claude; o Google, do Gemini; e a Meta, dona do Instagram e do WhatsApp. Elas fabricam o que o mercado chama de modelo. Todo o resto roda em cima de um desses motores, inclusive o assistente que atende no site da sua empresa.
Quando essa turma fala em “fronteira”, é disso que se trata: o modelo mais potente que existe naquele mês. É a Fórmula 1 da categoria. Custa bilhões para construir, e quem constrói vende o acesso para o mundo inteiro.
Pois foi esse grupo que, em 12 de setembro, sugeriu que talvez seja hora de ir mais devagar. Dario Amodei, CEO da Anthropic, publicou um ensaio chamado “We Must Pace the Frontier”, algo como “precisamos dosar o ritmo da fronteira”. A tese: os fabricantes precisam desacelerar de propósito a velocidade com que deixam a IA mais poderosa, para dar tempo de entender o que ela já consegue fazer.
Em poucas horas, Elon Musk respondeu em público que “Dario está certo”. Sam Altman, da OpenAI, concordou. Demis Hassabis, do Google, também. Na segunda-feira, as ações da Nvidia e da AMD, que fabricam os chips dessa festa toda, caíram na bolsa.
Parece o fim da corrida. Não é.
O freio que fica no velocímetro
Nos anos 1990, as montadoras alemãs firmaram um acordo de cavalheiros: nenhum carro de rua sairia de fábrica passando de 250 km/h. O acordo vale até hoje. De lá para cá, os motores mais que dobraram de potência. O limitador é eletrônico, mora no velocímetro. Embaixo do capô, ninguém freou coisa alguma.
É basicamente o que aconteceu em setembro. Os analistas do banco Bernstein avisaram os investidores que o ensaio “não é um chamado por redução de capex ou por parar o treinamento de modelos”. Traduzindo do economês: ninguém prometeu gastar menos. Quatro dias antes, a Microsoft tinha anunciado que pretende mais que triplicar seus data centers até 2032. Esse plano continua de pé.
O que foi de fato prometido é bem mais estreito: deixar avaliadores independentes entrarem nas empresas para examinar os modelos antes do lançamento. Isso importa, e fica para uma próxima coluna.
Aí veio o Zuckerberg e entregou o jogo
Nem todo mundo aplaudiu. Mark Zuckerberg discordou em público, e o argumento dele é melhor do que a briga sugere: cada empresa já tem motivo de sobra para andar com cuidado, porque é ela quem responde na justiça se o modelo causar dano. Para mostrar que não era discurso, lembrou que a Meta segurou o Muse, o agente de IA da casa, por meses, por segurança, sem pedir para nenhum concorrente fazer o mesmo.
Agora repare na data. O Muse foi lançado nos Estados Unidos no dia 10 de setembro. Dois dias antes do ensaio que pediu para todo mundo desacelerar.
Esse é o retrato honesto da semana. Um pediu freio, dois concordaram por escrito, um recusou e colocou o produto na rua. Nenhum contrato foi assinado, nenhuma data foi marcada, nenhum investimento foi cortado. Combinaram de parecer prudentes.
Como a conta da IA realmente funciona
A boa notícia é que nada disso muda muita coisa para você, porque a sua empresa nunca esteve nessa corrida. Mas tem um detalhe que quase ninguém explica e é ele que decide se o seu projeto de IA dá lucro ou prejuízo.
Você não paga a IA por assinatura fixa, como paga a Netflix. Você paga por token, que é, grosso modo, um pedaço de palavra. Cada pergunta respondida, cada documento lido, cada resumo gerado queima tokens. Funciona como crédito de celular pré-pago: quanto mais gente usa, maior a fatura no fim do mês.
E a Fórmula 1 cobra caro por token. Quem esquece disso toma susto – e o susto mais caro do ano tem nome e sobrenome.
O CEO que cortou o Salesforce e recebeu uma conta maior
Em julho, Fred Turner, CEO da Curative, uma operadora de planos de saúde americana, contou no podcast 20VC que cancelou o contrato da empresa com o Salesforce, o sistema onde se organiza cliente, venda e atendimento, o famoso CRM, líder mundial no ramo. O contrato custava US$ 600 mil por ano, uns US$ 50 mil por mês.
red Turner, CEO da Curative, no podcast 20VC | Crédito: Reprodução do youtube
A equipe dele construiu um sistema próprio em dois meses, com IA escrevendo o código. Animado, Turner anunciou que quer cortar 80% de tudo que a empresa paga em software assinado neste ano. O mercado celebrou, virou manchete, e as ações das empresas de software levaram um susto.
Só que, na mesma entrevista, ele soltou o outro número: “Nosso custo com a Anthropic nos últimos seis ou sete meses multiplicou por seis todo mês, de uma base de algumas dezenas de milhares de dólares para milhões de dólares por mês. Em algum momento a gente vai ter que parar esse aumento, porque vai ficar irracional. Mas não paramos de achar coisas novas para fazer com isso”.
Leia de novo, devagar: Ele cortou US$ 50 mil por mês de um contrato fixo e previsível, e assumiu uma fatura variável na casa dos milhões por mês.
Seja justo com ele: a Curative tem ganhos reais. Um agente da casa negocia contratos com prestadores por cerca de US$ 70, contra 1.500 a 2.000 quando o time humano fazia. Para o negócio dele, a troca pode valer muito a pena. A lição que interessa aqui é outra.
Custo fixo tem uma virtude que a gente só valoriza depois de perder: ele é previsível. Token não é. Token é conta de luz.
É como cancelar a mensalidade da academia e passar a pagar por aula para economizar, e então a família inteira começar a treinar todo dia. A decisão isolada estava certa. Ninguém modelou o comportamento depois da troca. Quanto mais fácil fica ligar o aparelho, mais gente liga.
O modelo pequeno que ganhou do gigante
A Shopify é a plataforma onde funcionam milhões de lojas virtuais no mundo, muita loja brasileira inclusive. Dentro dela tem um assistente, o Sidekick, que responde às perguntas do lojista sobre a própria loja, do tipo “quais produtos estão acabando no estoque”.
Esse assistente rodava inteiro em modelo de fronteira. Toda pergunta, da mais banal à mais difícil, ia para o motor mais caro do mercado. A conta chegava perto de US$ 27 milhões por ano.
A Shopify, então, treinou um modelo pequeno, barato e especializado só naquela tarefa. A conta caiu para algo em torno de US$ 1 milhão por ano. E, segundo a própria engenharia da empresa, veio o detalhe que deveria encerrar a discussão: o modelinho barato responde melhor que o gigante que ele substituiu. Melhor naquela tarefa, que era a única que importava.
Ninguém pega a Ferrari para ir à padaria
Passei os últimos meses ouvindo empresários perguntarem qual é o melhor modelo. É a pergunta errada.
Ninguém pega a Ferrari para comprar pão na esquina. Não porque a Ferrari seja ruim, mas porque o pão chega igual e quem paga a gasolina é você. Na sua operação, é a mesma coisa. Ler uma nota fiscal ou responder “vocês abrem sábado?” não exige o mesmo motor que redige uma proposta comercial. Quem usa o carro caro em tudo paga preço de tarefa difícil nas 10 mil tarefas fáceis do mês.
A pergunta certa é mais chata e bem mais lucrativa: qual é o motor mais barato que resolve isso direito, e como eu sei que está resolvendo direito? E aqui não tem atalho. Se os seus dados estão espalhados em cinco sistemas que não se conversam, trocar de modelo não resolve nada. A IA vai acelerar a bagunça do mesmo jeito, agora com uma fatura de tokens em cima.
A fronteira continuará correndo, com acordo ou sem acordo. Isso nunca foi problema seu. O seu problema é descobrir qual é a menor quantidade de inteligência artificial que resolve a sua dor, e ter como provar que resolveu.
* Olsen Rodrigo é CEO e fundador da Sintetiza AI. Com 17 anos dedicados à tecnologia em saúde, passando pela Matrix Saúde e por posições C-level (CPO/CTO) no AmorSaúde, hoje aplica inteligência artificial para automatizar e integrar a operação de empresas de diversos setores. É professor de IA aplicada a negócios, conselheiro e coautor de livros sobre liderança, produto e tecnologia. Defende uma IA que amplifica o potencial humano em vez de substituí-lo.
As big techs de IA combinaram de frear, mas a questão que importa é outra
Passei os últimos meses ouvindo empresários perguntarem qual é o melhor modelo. É a pergunta errada.
Por Olsen Rodrigo*
Em setembro, as maiores empresas de inteligência artificial do mundo anunciaram que diminuirão o ritmo. As ações de chips caíram. Uma delas recusou o acordo e lançou o produto na mesma semana. Se você ficou em dúvida se isso muda algo na sua empresa, a resposta curta é: quase nada. A conta que muda o seu negócio está em outro lugar, e é bem mais barata do que parece.
Primeiro, quem são os donos dessa corrida
A imprensa fala em “laboratórios de IA” e quase ninguém sabe quem são. São quatro empresas que constroem os motores da inteligência artificial: a OpenAI, do ChatGPT; a Anthropic, do Claude; o Google, do Gemini; e a Meta, dona do Instagram e do WhatsApp. Elas fabricam o que o mercado chama de modelo. Todo o resto roda em cima de um desses motores, inclusive o assistente que atende no site da sua empresa.
Quando essa turma fala em “fronteira”, é disso que se trata: o modelo mais potente que existe naquele mês. É a Fórmula 1 da categoria. Custa bilhões para construir, e quem constrói vende o acesso para o mundo inteiro.
Pois foi esse grupo que, em 12 de setembro, sugeriu que talvez seja hora de ir mais devagar. Dario Amodei, CEO da Anthropic, publicou um ensaio chamado “We Must Pace the Frontier”, algo como “precisamos dosar o ritmo da fronteira”. A tese: os fabricantes precisam desacelerar de propósito a velocidade com que deixam a IA mais poderosa, para dar tempo de entender o que ela já consegue fazer.
Em poucas horas, Elon Musk respondeu em público que “Dario está certo”. Sam Altman, da OpenAI, concordou. Demis Hassabis, do Google, também. Na segunda-feira, as ações da Nvidia e da AMD, que fabricam os chips dessa festa toda, caíram na bolsa.
Parece o fim da corrida. Não é.
O freio que fica no velocímetro
Nos anos 1990, as montadoras alemãs firmaram um acordo de cavalheiros: nenhum carro de rua sairia de fábrica passando de 250 km/h. O acordo vale até hoje. De lá para cá, os motores mais que dobraram de potência. O limitador é eletrônico, mora no velocímetro. Embaixo do capô, ninguém freou coisa alguma.
É basicamente o que aconteceu em setembro. Os analistas do banco Bernstein avisaram os investidores que o ensaio “não é um chamado por redução de capex ou por parar o treinamento de modelos”. Traduzindo do economês: ninguém prometeu gastar menos. Quatro dias antes, a Microsoft tinha anunciado que pretende mais que triplicar seus data centers até 2032. Esse plano continua de pé.
O que foi de fato prometido é bem mais estreito: deixar avaliadores independentes entrarem nas empresas para examinar os modelos antes do lançamento. Isso importa, e fica para uma próxima coluna.
Aí veio o Zuckerberg e entregou o jogo
Nem todo mundo aplaudiu. Mark Zuckerberg discordou em público, e o argumento dele é melhor do que a briga sugere: cada empresa já tem motivo de sobra para andar com cuidado, porque é ela quem responde na justiça se o modelo causar dano. Para mostrar que não era discurso, lembrou que a Meta segurou o Muse, o agente de IA da casa, por meses, por segurança, sem pedir para nenhum concorrente fazer o mesmo.
Agora repare na data. O Muse foi lançado nos Estados Unidos no dia 10 de setembro. Dois dias antes do ensaio que pediu para todo mundo desacelerar.
Esse é o retrato honesto da semana. Um pediu freio, dois concordaram por escrito, um recusou e colocou o produto na rua. Nenhum contrato foi assinado, nenhuma data foi marcada, nenhum investimento foi cortado. Combinaram de parecer prudentes.
Como a conta da IA realmente funciona
A boa notícia é que nada disso muda muita coisa para você, porque a sua empresa nunca esteve nessa corrida. Mas tem um detalhe que quase ninguém explica e é ele que decide se o seu projeto de IA dá lucro ou prejuízo.
Você não paga a IA por assinatura fixa, como paga a Netflix. Você paga por token, que é, grosso modo, um pedaço de palavra. Cada pergunta respondida, cada documento lido, cada resumo gerado queima tokens. Funciona como crédito de celular pré-pago: quanto mais gente usa, maior a fatura no fim do mês.
E a Fórmula 1 cobra caro por token. Quem esquece disso toma susto – e o susto mais caro do ano tem nome e sobrenome.
O CEO que cortou o Salesforce e recebeu uma conta maior
Em julho, Fred Turner, CEO da Curative, uma operadora de planos de saúde americana, contou no podcast 20VC que cancelou o contrato da empresa com o Salesforce, o sistema onde se organiza cliente, venda e atendimento, o famoso CRM, líder mundial no ramo. O contrato custava US$ 600 mil por ano, uns US$ 50 mil por mês.
A equipe dele construiu um sistema próprio em dois meses, com IA escrevendo o código. Animado, Turner anunciou que quer cortar 80% de tudo que a empresa paga em software assinado neste ano. O mercado celebrou, virou manchete, e as ações das empresas de software levaram um susto.
Só que, na mesma entrevista, ele soltou o outro número: “Nosso custo com a Anthropic nos últimos seis ou sete meses multiplicou por seis todo mês, de uma base de algumas dezenas de milhares de dólares para milhões de dólares por mês. Em algum momento a gente vai ter que parar esse aumento, porque vai ficar irracional. Mas não paramos de achar coisas novas para fazer com isso”.
Leia de novo, devagar: Ele cortou US$ 50 mil por mês de um contrato fixo e previsível, e assumiu uma fatura variável na casa dos milhões por mês.
Seja justo com ele: a Curative tem ganhos reais. Um agente da casa negocia contratos com prestadores por cerca de US$ 70, contra 1.500 a 2.000 quando o time humano fazia. Para o negócio dele, a troca pode valer muito a pena. A lição que interessa aqui é outra.
É como cancelar a mensalidade da academia e passar a pagar por aula para economizar, e então a família inteira começar a treinar todo dia. A decisão isolada estava certa. Ninguém modelou o comportamento depois da troca. Quanto mais fácil fica ligar o aparelho, mais gente liga.
O modelo pequeno que ganhou do gigante
A Shopify é a plataforma onde funcionam milhões de lojas virtuais no mundo, muita loja brasileira inclusive. Dentro dela tem um assistente, o Sidekick, que responde às perguntas do lojista sobre a própria loja, do tipo “quais produtos estão acabando no estoque”.
Esse assistente rodava inteiro em modelo de fronteira. Toda pergunta, da mais banal à mais difícil, ia para o motor mais caro do mercado. A conta chegava perto de US$ 27 milhões por ano.
A Shopify, então, treinou um modelo pequeno, barato e especializado só naquela tarefa. A conta caiu para algo em torno de US$ 1 milhão por ano. E, segundo a própria engenharia da empresa, veio o detalhe que deveria encerrar a discussão: o modelinho barato responde melhor que o gigante que ele substituiu. Melhor naquela tarefa, que era a única que importava.
Ninguém pega a Ferrari para ir à padaria
Passei os últimos meses ouvindo empresários perguntarem qual é o melhor modelo. É a pergunta errada.
Ninguém pega a Ferrari para comprar pão na esquina. Não porque a Ferrari seja ruim, mas porque o pão chega igual e quem paga a gasolina é você. Na sua operação, é a mesma coisa. Ler uma nota fiscal ou responder “vocês abrem sábado?” não exige o mesmo motor que redige uma proposta comercial. Quem usa o carro caro em tudo paga preço de tarefa difícil nas 10 mil tarefas fáceis do mês.
A pergunta certa é mais chata e bem mais lucrativa: qual é o motor mais barato que resolve isso direito, e como eu sei que está resolvendo direito? E aqui não tem atalho. Se os seus dados estão espalhados em cinco sistemas que não se conversam, trocar de modelo não resolve nada. A IA vai acelerar a bagunça do mesmo jeito, agora com uma fatura de tokens em cima.
A fronteira continuará correndo, com acordo ou sem acordo. Isso nunca foi problema seu. O seu problema é descobrir qual é a menor quantidade de inteligência artificial que resolve a sua dor, e ter como provar que resolveu.
* Olsen Rodrigo é CEO e fundador da Sintetiza AI. Com 17 anos dedicados à tecnologia em saúde, passando pela Matrix Saúde e por posições C-level (CPO/CTO) no AmorSaúde, hoje aplica inteligência artificial para automatizar e integrar a operação de empresas de diversos setores. É professor de IA aplicada a negócios, conselheiro e coautor de livros sobre liderança, produto e tecnologia. Defende uma IA que amplifica o potencial humano em vez de substituí-lo.
Leia também
Surf Center investe em geração de ondas mais eficientes e sustentáveis
Sistema industrial customizado garante economia de energia, estabilidade operacional e acompanha a …
IPhone 15 Ultra deve chegar ao mercado no segundo semestre de 2023
A opção 15 Ultra, antes chamada de Pro Max, terá tecnologia de …
O que é doomscrolling e como ele afeta a nossa construção de identidade
O excesso de exposição ao ambiente digital pode contribuir para o enfraquecimento …
iPhone dobrável? Aposta da Apple pode chegar em 2026
A ideia já é realidade para a Samsung e está cada vez …