Estrategia de IA de Google: por qué la distribución y la economía de inferencia importan más que la competencia entre modelos
Es difícil afirmar que Google haya abandonado la competencia por el rendimiento de los modelos de IA. La diferencia de Google radica en que puede distribuir Gemini a través de Search, Workspace y Cloud, vincularlo con ingresos por publicidad, suscripciones y servicios en la nube, y reducir los costes de inferencia con sus propias TPU.
- Los benchmarks de programación y el uso en determinadas plataformas son importantes, pero no determinan por sí solos al ganador de todo el mercado de la IA.
- Google, OpenAI y Anthropic asumen costes de inferencia al generar respuestas de IA y obtienen ingresos mediante API de pago, suscripciones y otros medios.
- La fortaleza estructural de Google es su capacidad de distribución a gran escala al conectar Search, Android, Chrome, Workspace y Cloud con sus propias TPU.
- Aunque pueden mostrarse anuncios en AI Overviews, no hay pruebas de que los ingresos publicitarios aumenten automáticamente a medida que las respuestas se alargan.
- El éxito o fracaso de la estrategia debe evaluarse por la retención de usuarios, la tasa de éxito de las tareas, el coste por respuesta y los cambios en los ingresos existentes de las búsquedas, más que por la mejor puntuación en benchmarks.
En torno al negocio de IA de Google aparece con frecuencia la explicación de que «OpenAI y Anthropic incurren en costes cada vez que responden, mientras que Google gana dinero con publicidad cada vez que responde». Esta expresión ilustra bien que las tres empresas parten de posiciones diferentes, pero no debe tomarse como un hecho contable.
Las tres empresas asumen costes computacionales al ejecutar sus modelos y las tres obtienen ingresos mediante API, suscripciones, contratos empresariales y otras vías. La verdadera diferencia de Google no reside en la existencia o ausencia de costes, sino en su capacidad para conectar su red de distribución de productos existente, su negocio publicitario, Google Cloud y sus TPU propias dentro de una única estructura económica.
Hechos e interpretaciones que deben corregirse primero
Las afirmaciones proporcionadas mezclan modelos de distintos momentos, clasificaciones dinámicas e información no verificada sobre personal. Utilizarlas tal cual llevaría a interpretar la estrategia de Google de una forma más simplista de lo que realmente es.
| Afirmación | Qué debe comprobarse | Interpretación más precisa |
|---|---|---|
| En una encuesta concreta, Anthropic tenía una cuota del 42 % del gasto en programación | Hay que comprobar la muestra, la fecha de la encuesta, la definición de «gasto» y el grupo de empresas encuestadas | Una encuesta de una firma de capital riesgo puede mostrar tendencias de compra de una muestra empresarial, pero no la cuota del mercado mundial de IA para programación |
| Gemini estaba fuera de los 10 primeros puestos de OpenRouter | La clasificación de OpenRouter cambia continuamente según el periodo, el modelo, el precio, las promociones y la demanda de enrutamiento | Es una señal de uso en un momento concreto, no una clasificación de la adopción total entre desarrolladores ni de los ingresos del producto |
| El lanzamiento de Gemini 1.5 Pro se pospuso indefinidamente | Gemini 1.5 Pro se anunció el pasado mayo, pero su lanzamiento se aplazó sin una fecha prevista | Utilizar una descripción de un retraso pasado como fundamento de la estrategia actual produce una incoherencia cronológica |
| Gemini 1.5 Flash es el modelo más reciente de Google | 1.5 Flash es el nombre de un producto de una generación concreta | Comparar directamente modelos de generaciones diferentes con los modelos competitivos más recientes distorsiona la conclusión |
| Noam Shazeer dejó Google para incorporarse a OpenAI | Shazeer dejó Google y se incorporó a OpenAI | La movilidad del talento es importante, pero hay que distinguir con precisión la empresa de destino y el momento del cambio |
| Las salidas de Jeff Dean y John Jumper demuestran un cambio de estrategia | Las afirmaciones importantes sobre personal deben verificarse mediante anuncios de la empresa o registros públicos de las personas implicadas | La información no verificada sobre personal no debe utilizarse como prueba de la estrategia de una organización |
| A partir de la sexta generación de TPU se separaron los chips para entrenamiento y para inferencia | Trillium es una TPU utilizada para entrenamiento e inferencia, y posteriormente Google anunció Ironwood, una TPU centrada en la inferencia | A partir de la sexta generación de TPU, Google comenzó a diseñar de forma claramente diferenciada las TPU para entrenamiento y las TPU para inferencia |
| Gemini Spark es el agente representativo de Google | Hay que comprobar el nombre oficial exacto del producto y el estado de su lanzamiento | Deben distinguirse los productos oficiales, los proyectos de investigación y los nombres utilizados antes de un anuncio |
Por tanto, Google ha dejado de realizar un gasto excesivo para forzar el primer puesto en rendimiento y está centrándose en qué modelo asignar a cada tarea para elevar la rentabilidad del conjunto de sus servicios.
Por qué importa el rendimiento de la IA para programación y cuáles son sus límites
La programación es un ámbito adecuado para evaluar la utilidad práctica de los modelos de IA. Esto se debe a que las tareas de software requieren interpretar requisitos, generar código, ejecutar pruebas, corregir errores, invocar herramientas y gestionar contextos largos. Estas capacidades también pueden transferirse parcialmente a tareas de agentes de IA, como manejar navegadores o procesar documentos.
Sin embargo, no se sostiene la afirmación de que «el modelo que mejor programa es también el mejor en todas las tareas». Los benchmarks de programación pueden no reflejar suficientemente los siguientes factores:
- Los complejos permisos y dependencias de los repositorios empresariales reales
- Las vulnerabilidades de seguridad y los problemas de licencias
- Los errores acumulativos que surgen en tareas prolongadas
- La conexión con datos no relacionados con la programación, como correos electrónicos, documentos, búsquedas y vídeos
- La latencia de respuesta, la disponibilidad y la cobertura regional
- El precio de los tokens de entrada y salida y los descuentos por caché
- Las funciones de administración, los registros de auditoría y las políticas de conservación de datos
Al evaluar el mercado de herramientas para desarrolladores, además de las puntuaciones de los benchmarks, deben considerarse conjuntamente la tasa real de finalización de tareas, el tiempo que dedican los desarrolladores a corregir resultados, la tasa de fallos, los costes y el volumen de los contratos empresariales.
Comparación de la estructura de ingresos de Google y las empresas dedicadas a la IA
Google, OpenAI y Anthropic gastan dinero en la inferencia de modelos. La diferencia reside en el número de vías disponibles para recuperar esos costes y en su impacto sobre los negocios existentes.
| Categoría | Empresas centradas en la IA como OpenAI y Anthropic | |
|---|---|---|
| Principales canales de distribución | Search, Android, Chrome, Workspace, YouTube, Google Cloud | Aplicaciones propias, API, contratos empresariales y plataformas asociadas |
| Principales fuentes de ingresos | Publicidad en búsquedas y vídeos, tarifas de uso de Cloud, Workspace, suscripciones de IA y API | Suscripciones de consumidores y empresas, API, contratos empresariales y alianzas |
| Infraestructura | Posee TPU y centros de datos propios, al tiempo que utiliza cadenas de suministro externas | Dependencia relativamente mayor de socios de nube y semiconductores |
| Oportunidades de adoptar IA | Puede aumentar la frecuencia de uso y el valor de sus servicios existentes | Puede convertir directamente la nueva demanda de IA en ingresos |
| Riesgos principales | Las respuestas de IA pueden canibalizar los clics de búsqueda existentes y la economía publicitaria | Elevados costes de entrenamiento e inferencia, competencia de precios y dependencia de las redes de distribución |
OpenAI y Anthropic tampoco se limitan a generar costes cada vez que producen una respuesta. Las API suelen facturarse en función del uso, y las suscripciones de pago y los contratos empresariales también generan ingresos. A la inversa, Google también asume el coste de inferencia cuando ofrece respuestas de IA a usuarios gratuitos.
En definitiva, la diferencia no es «coste frente a ingresos», sino con qué servicios y fuentes de ingresos puede conectarse a un usuario una vez captado.
El principal activo de Google no son solo sus modelos
Red de distribución de productos
Google no necesita distribuir las funciones de Gemini únicamente a través de una aplicación de chatbot independiente. Puede incorporarlas en puntos de contacto que ya cuentan con usuarios, como Search, Gmail, Docs, Android, Chrome y Google Cloud. Esto reduce los costes de adquisición de clientes necesarios para que instalen una aplicación nueva y adopten nuevos hábitos.
Sin embargo, la inclusión predeterminada no implica necesariamente un uso continuado. Si los usuarios no confían en los resultados o consideran que la función es más lenta que sus flujos de trabajo anteriores, pueden desactivarla o utilizarla en paralelo con servicios de la competencia.
Infraestructura propia de IA
Google diseña directamente sus TPU y opera conjuntamente centros de datos, redes, modelos y servicios en la nube. Esta integración vertical ofrece la ventaja de poder optimizar de forma conjunta el hardware y el software para tareas específicas.
Especialmente en los servicios a gran escala, reducir la cantidad de cálculo por respuesta, la latencia y el consumo de energía puede tener un impacto mayor sobre el coste total que una pequeña mejora del rendimiento del modelo. Sin embargo, no puede concluirse que los chips propios sean siempre la opción más barata sin considerar conjuntamente su tasa real de utilización, los costes de desarrollo, la depreciación y el precio de las GPU externas.
Cartera de modelos y enrutamiento
No resulta económico utilizar el modelo más grande para todas las preguntas. Es más eficiente que un modelo pequeño se ocupe de clasificaciones o resúmenes sencillos y que solo el razonamiento complejo o la programación se envíen a modelos más grandes.
La calidad de esta estrategia depende de tres factores:
- Si clasifica con precisión la dificultad de las solicitudes
- Si define de forma segura los límites de las tareas que puede procesar un modelo pequeño
- Si, cuando se produce un fallo, transfiere rápidamente la tarea a un modelo más potente o a una persona
Por tanto, colocar modelos pequeños y rápidos en primera línea puede considerarse una estrategia de cartera para gestionar tráfico a gran escala, más que una prueba de que se haya abandonado el desarrollo de modelos de máximo nivel.
Cómo se conectan la búsqueda con IA y la publicidad
Google puede integrar publicidad en resultados de búsqueda generativos como AI Overviews. Esto se debe a que, si se detecta una intención comercial en la consulta del usuario y existen anuncios adecuados, puede utilizarse el sistema publicitario de búsqueda existente.
Sin embargo, no puede afirmarse que «cuanto más larga sea la respuesta, más espacios publicitarios habrá y mayores serán los ingresos», por los siguientes motivos:
- La publicidad depende de la intención de búsqueda, la demanda de los anunciantes, la subasta y las políticas de exposición, no de la longitud de la respuesta.
- Un exceso de publicidad puede perjudicar la experiencia de búsqueda y la confianza.
- Si la IA resuelve una pregunta de una sola vez, pueden disminuir las búsquedas posteriores y los clics del usuario en sitios web.
- Las consultas informativas pueden tener poca intención comercial y, por tanto, un bajo valor publicitario.
- Incluso si se generan ingresos publicitarios, deben descontarse los costes adicionales de inferencia y de adquisición de tráfico.
Alphabet publica sus ingresos publicitarios totales y sus ingresos de Cloud, pero no desglosa de forma detallada los ingresos, los costes de inferencia y el beneficio operativo correspondientes exclusivamente a AI Overviews. Por tanto, desde fuera no es posible determinar el «beneficio neto por cada respuesta de IA».
Una perspectiva fácil de pasar por alto: no los ingresos por respuesta, sino el margen de contribución
Al evaluar la estrategia de IA de Google, la unidad más útil no es el número de respuestas ni el número de tokens en sí, sino el margen de contribución de cada interacción con la IA.
Conceptualmente, el margen de contribución puede expresarse de la siguiente manera:
Margen de contribución de una interacción con la IA = ingresos adicionales por publicidad, suscripciones y nube − costes de inferencia − costes de búsqueda e invocación de herramientas − costes de procesamiento de seguridad − costes de adquisición de tráfico
Aquí deben reflejarse no solo los ingresos directos, sino también la canibalización de los negocios existentes. Si una respuesta de IA genera nuevas búsquedas, el efecto es positivo; pero si sustituye clics publicitarios que se habrían producido de todos modos, el efecto neto puede ser reducido.
Además, alargar las respuestas de los modelos no constituye una estrategia de ingresos. Las respuestas largas aumentan el coste de los tokens de salida y la latencia. Puede resultar económicamente más ventajoso resolver con precisión el problema del usuario utilizando menos capacidad de cálculo y ofrecer conexiones comerciales solo cuando sean necesarias.
Indicadores clave para evaluar la estrategia de Google
Para seguir el éxito o fracaso de la estrategia mediante información pública y cambios en los productos, deben distinguirse los siguientes indicadores.
| Área | Indicadores que observar | Precauciones al interpretarlos |
|---|---|---|
| Calidad de los modelos | Tasa de éxito de las tareas, evaluaciones de programación y razonamiento, tasa de alucinaciones | No depender de un único benchmark ni de cifras comunicadas por la propia empresa |
| Adopción por los usuarios | Usuarios activos mensuales y diarios, tasa de retorno, tasa de conversión a pago | Distinguir entre usuarios con el producto preinstalado y usuarios que realmente lo usan de forma recurrente |
| Eficiencia económica | Coste de inferencia por solicitud, latencia, tasa de aciertos de caché, tasa de utilización | Los precios públicos por token no son necesariamente iguales a los costes internos |
| Negocio de búsqueda | Proporción de consultas que incluyen resultados de IA, conversión publicitaria, frecuencia de búsqueda | Es posible que no se publiquen los ingresos independientes de las funciones de IA |
| Cloud | Contratos relacionados con IA, uso de API, cartera de pedidos, beneficio operativo | Distinguir el crecimiento total de Cloud de la contribución de la IA |
| Ecosistema de desarrolladores | Uso de API, compatibilidad con frameworks, casos de implementación empresarial | La clasificación de una plataforma no representa a todo el mercado |
| Talento e investigación | Artículos clave, velocidad de incorporación a productos, retención de investigadores | No extrapolar una salida individual como un colapso de toda la capacidad investigadora |
Condiciones que separan el optimismo del pesimismo
Condiciones para que la estrategia tenga éxito
- Gemini mantiene una calidad suficientemente similar a la de los modelos competidores en el trabajo real.
- La integración entre los productos de Google reduce el tiempo real de trabajo de los usuarios.
- Los modelos pequeños y las TPU propias reducen el coste por respuesta.
- La búsqueda con IA genera nuevas consultas comerciales sin perjudicar los ingresos publicitarios existentes.
- Las funciones de IA de Cloud y Workspace se convierten en contratos de pago.
Condiciones que pueden hacer fracasar la estrategia
- La brecha de calidad en programación y tareas de agentes aumenta, y los desarrolladores y las empresas eligen otros modelos como opción predeterminada.
- Las respuestas de IA reducen los ingresos de búsqueda existentes sin generar suficientes ingresos nuevos.
- La integración de productos provoca problemas de privacidad, gestión de permisos y confianza.
- El coste de corregir los errores de los modelos baratos supera el ahorro en costes de inferencia.
- El debilitamiento del talento investigador y del ecosistema de desarrolladores reduce la competitividad de los modelos a largo plazo.
Conclusión
Google ha dejado de realizar un gasto excesivo para forzar el primer puesto en modelos de máximo rendimiento y ha virado hacia la relación calidad-precio. Una interpretación más convincente es que Google está optimizando simultáneamente la competencia en rendimiento de modelos y el despliegue a gran escala, el enrutamiento de modelos, la infraestructura propia y la monetización mediante publicidad, suscripciones y nube.
Asimismo, el planteamiento según el cual «OpenAI y Anthropic pierden dinero cuanto más responden, mientras que Google gana dinero cuanto más responde» es excesivamente simplista. Todos los operadores asumen costes de inferencia, y es probable que el verdadero ganador no sea la empresa que produzca las respuestas más largas, sino la que resuelva de forma fiable las tareas de los usuarios mientras mantiene el margen de contribución por respuesta y la confianza a largo plazo.
FAQ
¿Ha renunciado Google a ocupar el primer puesto en rendimiento de modelos de IA?
Es difícil concluir, basándose únicamente en la gama de productos anunciada, que haya renunciado. Google desarrolla modelos grandes y, al mismo tiempo, optimiza conjuntamente la calidad y los costes mediante modelos pequeños, el enrutamiento de modelos, sus propias TPU y la integración de productos.
¿OpenAI y Anthropic pierden dinero cada vez que la IA responde?
Cada respuesta conlleva costes de inferencia, pero las API de pago también generan ingresos en función del uso. Como también existen suscripciones y contratos empresariales, es inexacto afirmar que cada respuesta siempre supone una pérdida; la rentabilidad real depende de los precios, los costes, el volumen de uso y la estructura contractual.
¿Obtiene Google más ingresos publicitarios cuanto más largas son las respuestas de la IA?
No se puede afirmar que sea así. La exposición de anuncios depende más de la intención comercial del usuario, la demanda de los anunciantes, las subastas y las políticas de producto que de la longitud de las respuestas; además, las respuestas largas pueden aumentar el coste de los tokens de salida y el tiempo de latencia.
¿La cuota del 42 % del gasto en IA para programación representa la cuota de todo el mercado?
No. La cifra procedente de un estudio concreto de una empresa de capital riesgo representa a las empresas participantes en ese estudio y el ámbito de gasto definido. No debe interpretarse como la cuota del mercado mundial, que abarcaría el uso por parte de consumidores, las herramientas gratuitas, todo el tráfico de API y los mercados regionales.
¿Se puede determinar cuál es el mejor modelo de IA mediante la clasificación de OpenRouter?
La clasificación de OpenRouter es una señal útil que muestra el volumen de uso o las tendencias de elección en esa plataforma. Sin embargo, como refleja los precios, las promociones, la disponibilidad de los modelos y la composición de los usuarios, no equivale al mercado general de desarrolladores ni a una clasificación objetiva del rendimiento.
¿Por qué las TPU propias de Google son importantes en la competencia de la IA?
Google puede optimizar conjuntamente los modelos, el hardware, las redes y los centros de datos. A gran escala de solicitudes, incluso una pequeña reducción del cómputo por respuesta y del tiempo de latencia puede generar una gran diferencia de costes, pero para determinar si existe una ventaja real en costes también hay que examinar la tasa de utilización y los costes de desarrollo y operación.
¿Cuáles son las métricas más importantes para determinar el éxito o el fracaso de la estrategia de IA de Google?
Más que un único benchmark, hay que considerar conjuntamente la tasa de éxito en tareas reales, la tasa de uso repetido, la tasa de conversión a servicios de pago, el coste de inferencia por solicitud, el crecimiento de Cloud y el impacto de la búsqueda con IA en los ingresos publicitarios existentes. Mientras Alphabet no publique por separado los beneficios de cada función de IA, las evaluaciones externas tienen la limitación de ser estimaciones.
Sources
- Formulario 10-K de Alphabet de 2024
- Relaciones con inversores de Alphabet
- Precios de la API para desarrolladores de Gemini
- Google Cloud TPU
- Precios de la API de OpenAI
- Precios de Anthropic Claude
- Clasificaciones de OpenRouter
- Menlo Ventures 2024: El estado de la IA generativa en la empresa
- Google Marketing Live 2024
Images

