A DeepSeek lançou seu modelo V4-Pro com preços significativamente mais altos do que sua variante Flash, com custos de token de saída atingindo cerca de US$ 3,96 por milhão de tokens durante o pico de uso, em comparação com taxas muito mais baixas para seu modelo V4-Flash.

“O custo do token tem sido o limite prático para expandir a IA além dos pilotos isolados”, disse Chandak. Com preços mais baixos, acrescentou, a execução de fluxos de trabalho baseados em agentes em escala de produção torna-se mais viável.

Ele também disse que as empresas estão colocando maior ênfase em fatores além do desempenho do modelo. “A camada do modelo básico é a comoditização”, disse Chandak, acrescentando que a diferenciação dependerá cada vez mais da preparação dos dados, da governança e das camadas de orquestração.