Microsoft presenta un nuevo y potente chip de inferencia de IA

Microsoft ha presentado su nuevo chip, el Maia 200, describiéndolo como un “caballo de fuerza” de silicio diseñado para escalar las inferencias de inteligencia artificial.
Sucediendo al Maia 100 lanzado en 2023, el Maia 200 ha sido desarrollado para ejecutar modelos avanzados de IA con mayor velocidad y eficiencia. Contiene más de 100 mil millones de transistores, logrando más de 10 petaflops con precisión de 4 bits y aproximadamente 5 petaflops en rendimiento de 8 bits, lo que representa un avance significativo con respecto a su predecesor.
La inferencia es el proceso computacional mediante el cual se ejecuta un modelo, a diferencia del entrenamiento del mismo. A medida que las empresas de IA maduran, los costos asociados a la inferencia representan una proporción cada vez mayor del total de gastos operativos, lo que impulsa nuevos esfuerzos por optimizar este proceso.
Microsoft tiene como objetivo que el Maia 200 contribuya a esta optimización, ayudando a las empresas de IA a funcionar con menos interrupciones y un menor consumo de energía. “En términos prácticos, un único nodo Maia 200 puede manejar sin problemas los modelos más grandes de la actualidad, y tiene suficiente capacidad para abordar modelos aún más complejos en el futuro”, afirmó la empresa.
El nuevo chip de Microsoft también se inscribe en una tendencia general entre los gigantes tecnológicos de desarrollar su propio silicio con el fin de reducir su dependencia de Nvidia, cuyas avanzadas GPU son esenciales para el éxito en el campo de la IA. Por ejemplo, Google ofrece sus TPU como capacidad computacional accesible desde la nube, en lugar de vender chips directamente. Amazon cuenta con su acelerador AI Trainium, y la versión más reciente, Trainium3, fue lanzada en diciembre. Estos chips reducen algunas tareas computacionales que antes se realizaban con las GPU de Nvidia, lo que disminuye los costos totales en hardware.
Con el Maia, Microsoft se posiciona para competir con estas alternativas. En su comunicado de prensa del lunes, la empresa señaló que el Maia ofrece tres veces más rendimiento FP4 que los chips de tercera generación de Amazon Trainium y supera al TPU de séptima generación de Google en rendimiento FP8.
Microsoft informa que el Maia ya está siendo utilizado para alimentar los modelos de IA de su equipo de Superintelligence, así como para respaldar a su chatbot Copilot. Desde el lunes, la empresa ha invitado a desarrolladores, académicos y laboratorios de vanguardia en IA a utilizar el kit de desarrollo software Maia 200 en sus proyectos.
Evento Techcrunch
Entradas para Disrupt 2026: Oferta exclusiva por tiempo limitado
Las entradas ya están disponibles. Ahorre hasta $680 mientras duren estos precios y sea uno de los primeros 500 inscritos en obtener un descuento del 50% en su pase +1. TechCrunch Disrupt reúne a líderes destacados de Google Cloud, Netflix, Microsoft, Box, a16z, Hugging Face y muchos otros en más de 250 sesiones diseñadas para acelerar el crecimiento y mejorar su ventaja competitiva. Conecte con cientos de startups innovadoras y participe en redes de contacto organizadas que impulsan negocios, conocimientos e inspiración.
Entradas para Disrupt 2026: Oferta exclusiva por tiempo limitado
Las entradas ya están disponibles. Ahorre hasta $680 mientras duren estos precios y sea uno de los primeros 500 inscritos en obtener un descuento del 50% en su pase +1. TechCrunch Disrupt reúne a líderes destacados de Google Cloud, Netflix, Microsoft, Box, a16z, Hugging Face y muchos otros en más de 250 sesiones diseñadas para acelerar el crecimiento y mejorar su ventaja competitiva. Conecte con cientos de startups innovadoras y participe en redes de contacto organizadas que impulsan negocios, conocimientos e inspiración.
San Francisco | 13-15 de octubre de 2026 Regístrese ahora
Artículo relacionado
Dentro de los detalles revelados sobre el Gemini de próxima generación: Potencia de cálculo limitada, los equipos internos discreparon sobre las prioridades de desarrollo y la asignación de recursos
Los informes indican que el lanzamiento del tan esperado modelo Gemini de próxima generación de Google ha sido pospuesto. Los desacuerdos internos sobre las prioridades de desarrollo y la asignación de recursos, combinados con una capacidad de comput
OpenAI descarta preocupaciones por la desaceleración del crecimiento y afirma que múltiples unidades de negocio están acelerando
En respuesta a la escrutinio externo sobre el desaceleramiento del crecimiento de las ventas y el incumplimiento de las metas internas, el líder en inteligencia artificial, OpenAI, emitió una declaración contundente el martes 28 de abril. La empresa
Copa Super de Alibaba: Qwen3.8-Max hace su debut con herramientas de codificación y oficina mejoradas
Alibaba ha presentado oficialmente Qwen3.8-Max, un modelo base de última generación con 2,4 billones de parámetros. Este importante avance en inteligencia artificial ofrece mejoras sustanciales en áreas clave como la programación y las tareas profesi
Recomendaciones de temas especiales relacionados
comentario (1)
0/500
Just saw the news about Microsoft's new Maia 200 chip. Finally, someone is tackling the inference bottleneck with actual silicon instead of just throwing money at cloud services. 🚀 It’s wild how fast these models are evolving, but I’m still skeptical about whether this will actually lower costs for regular users or just make big tech richer. Anyone else excited for cheaper AI access, or is it all hype? 🤔

Microsoft ha presentado su nuevo chip, el Maia 200, describiéndolo como un “caballo de fuerza” de silicio diseñado para escalar las inferencias de inteligencia artificial.
Sucediendo al Maia 100 lanzado en 2023, el Maia 200 ha sido desarrollado para ejecutar modelos avanzados de IA con mayor velocidad y eficiencia. Contiene más de 100 mil millones de transistores, logrando más de 10 petaflops con precisión de 4 bits y aproximadamente 5 petaflops en rendimiento de 8 bits, lo que representa un avance significativo con respecto a su predecesor.
La inferencia es el proceso computacional mediante el cual se ejecuta un modelo, a diferencia del entrenamiento del mismo. A medida que las empresas de IA maduran, los costos asociados a la inferencia representan una proporción cada vez mayor del total de gastos operativos, lo que impulsa nuevos esfuerzos por optimizar este proceso.
Microsoft tiene como objetivo que el Maia 200 contribuya a esta optimización, ayudando a las empresas de IA a funcionar con menos interrupciones y un menor consumo de energía. “En términos prácticos, un único nodo Maia 200 puede manejar sin problemas los modelos más grandes de la actualidad, y tiene suficiente capacidad para abordar modelos aún más complejos en el futuro”, afirmó la empresa.
El nuevo chip de Microsoft también se inscribe en una tendencia general entre los gigantes tecnológicos de desarrollar su propio silicio con el fin de reducir su dependencia de Nvidia, cuyas avanzadas GPU son esenciales para el éxito en el campo de la IA. Por ejemplo, Google ofrece sus TPU como capacidad computacional accesible desde la nube, en lugar de vender chips directamente. Amazon cuenta con su acelerador AI Trainium, y la versión más reciente, Trainium3, fue lanzada en diciembre. Estos chips reducen algunas tareas computacionales que antes se realizaban con las GPU de Nvidia, lo que disminuye los costos totales en hardware.
Con el Maia, Microsoft se posiciona para competir con estas alternativas. En su comunicado de prensa del lunes, la empresa señaló que el Maia ofrece tres veces más rendimiento FP4 que los chips de tercera generación de Amazon Trainium y supera al TPU de séptima generación de Google en rendimiento FP8.
Microsoft informa que el Maia ya está siendo utilizado para alimentar los modelos de IA de su equipo de Superintelligence, así como para respaldar a su chatbot Copilot. Desde el lunes, la empresa ha invitado a desarrolladores, académicos y laboratorios de vanguardia en IA a utilizar el kit de desarrollo software Maia 200 en sus proyectos.
Evento Techcrunch
Entradas para Disrupt 2026: Oferta exclusiva por tiempo limitado
Las entradas ya están disponibles. Ahorre hasta $680 mientras duren estos precios y sea uno de los primeros 500 inscritos en obtener un descuento del 50% en su pase +1. TechCrunch Disrupt reúne a líderes destacados de Google Cloud, Netflix, Microsoft, Box, a16z, Hugging Face y muchos otros en más de 250 sesiones diseñadas para acelerar el crecimiento y mejorar su ventaja competitiva. Conecte con cientos de startups innovadoras y participe en redes de contacto organizadas que impulsan negocios, conocimientos e inspiración.
Entradas para Disrupt 2026: Oferta exclusiva por tiempo limitado
Las entradas ya están disponibles. Ahorre hasta $680 mientras duren estos precios y sea uno de los primeros 500 inscritos en obtener un descuento del 50% en su pase +1. TechCrunch Disrupt reúne a líderes destacados de Google Cloud, Netflix, Microsoft, Box, a16z, Hugging Face y muchos otros en más de 250 sesiones diseñadas para acelerar el crecimiento y mejorar su ventaja competitiva. Conecte con cientos de startups innovadoras y participe en redes de contacto organizadas que impulsan negocios, conocimientos e inspiración.
San Francisco | 13-15 de octubre de 2026 Regístrese ahora
Dentro de los detalles revelados sobre el Gemini de próxima generación: Potencia de cálculo limitada, los equipos internos discreparon sobre las prioridades de desarrollo y la asignación de recursos
Los informes indican que el lanzamiento del tan esperado modelo Gemini de próxima generación de Google ha sido pospuesto. Los desacuerdos internos sobre las prioridades de desarrollo y la asignación de recursos, combinados con una capacidad de comput
OpenAI descarta preocupaciones por la desaceleración del crecimiento y afirma que múltiples unidades de negocio están acelerando
En respuesta a la escrutinio externo sobre el desaceleramiento del crecimiento de las ventas y el incumplimiento de las metas internas, el líder en inteligencia artificial, OpenAI, emitió una declaración contundente el martes 28 de abril. La empresa
Copa Super de Alibaba: Qwen3.8-Max hace su debut con herramientas de codificación y oficina mejoradas
Alibaba ha presentado oficialmente Qwen3.8-Max, un modelo base de última generación con 2,4 billones de parámetros. Este importante avance en inteligencia artificial ofrece mejoras sustanciales en áreas clave como la programación y las tareas profesi
Just saw the news about Microsoft's new Maia 200 chip. Finally, someone is tackling the inference bottleneck with actual silicon instead of just throwing money at cloud services. 🚀 It’s wild how fast these models are evolving, but I’m still skeptical about whether this will actually lower costs for regular users or just make big tech richer. Anyone else excited for cheaper AI access, or is it all hype? 🤔





Hogar






