Descubre herramientas de IA de calidad
Reúna las principales herramientas de inteligencia artificial del mundo para ayudar a mejorar la eficiencia laboral
Artículos publicados por RalphBaker
E-MoKe presenta en la IFA 2026 el mini PC EVO-X5Pro, equipado con el chip AMD Ryzen AI Max+ PRO495 y una potencia de cálculo total de 131 TOPS. Admite 192 GB de memoria LPDDR5X, lo que permite la inferencia local de modelos de lenguaje grandes (LLM) de 300 mil millones de parámetros. Equipado con refrigeración por líquido (VC) y puertos USB4, el dispositivo está destinado a aplicaciones de IA periférica de alto rendimiento. Su lanzamiento está previsto para octubre de 2026; el precio aún está por determinar.
E-MoKe presenta en la IFA 2026 el mini PC EVO-X5Pro, equipado con el chip AMD Ryzen AI Max+ PRO495 y una potencia de cálculo total de 131 TOPS. Admite 192 GB de memoria LPDDR5X, lo que permite la inferencia local de modelos de lenguaje grandes (LLM) de 300 mil millones de parámetros. Equipado con refrigeración por líquido (VC) y puertos USB4, el dispositivo está destinado a aplicaciones de IA periférica de alto rendimiento. Su lanzamiento está previsto para octubre de 2026; el precio aún está por determinar.
Google ha lanzado Gemini 3.5 Transcribe, su modelo de conversión de voz a texto más preciso, que ya está disponible para desarrolladores y usuarios. Alcanza una tasa de error por palabra del 2,6 % en situaciones que no requieren transmisión en directo, y destaca en entornos ruidosos y con terminología compleja. Entre sus características principales se incluyen el filtrado de ruido, la eliminación de palabras de relleno y la delegación de tareas entre varios modelos. Es compatible con 85 idiomas e incluye identificación del hablante, y se integra en Android, macOS y Chrome. Este lanzamiento refuerza el ecosistema de IA de Google, junto con Gemini 3.7 Flash y la integración con Waymo, ofreciendo un reconocimiento de voz robusto para diversas aplicaciones.
Google ha lanzado Gemini 3.5 Transcribe, su modelo de conversión de voz a texto más preciso, que ya está disponible para desarrolladores y usuarios. Alcanza una tasa de error por palabra del 2,6 % en situaciones que no requieren transmisión en directo, y destaca en entornos ruidosos y con terminología compleja. Entre sus características principales se incluyen el filtrado de ruido, la eliminación de palabras de relleno y la delegación de tareas entre varios modelos. Es compatible con 85 idiomas e incluye identificación del hablante, y se integra en Android, macOS y Chrome. Este lanzamiento refuerza el ecosistema de IA de Google, junto con Gemini 3.7 Flash y la integración con Waymo, ofreciendo un reconocimiento de voz robusto para diversas aplicaciones.
En una prueba realizada por el Gobierno de EE. UU., el modelo de IA «Mythos» de Anthropic identificó múltiples vulnerabilidades en sistemas de alto secreto en cuestión de horas, superando con creces a los métodos manuales. Sin embargo, la Casa Blanca ordenó a Anthropic que restringiera el acceso extranjero a sus últimos modelos, alegando riesgos de seguridad. Más de 100 empresas, entre ellas Adobe y NVIDIA, instaron al Gobierno a revocar la directiva, advirtiendo de que podría beneficiar a los adversarios.
En una prueba realizada por el Gobierno de EE. UU., el modelo de IA «Mythos» de Anthropic identificó múltiples vulnerabilidades en sistemas de alto secreto en cuestión de horas, superando con creces a los métodos manuales. Sin embargo, la Casa Blanca ordenó a Anthropic que restringiera el acceso extranjero a sus últimos modelos, alegando riesgos de seguridad. Más de 100 empresas, entre ellas Adobe y NVIDIA, instaron al Gobierno a revocar la directiva, advirtiendo de que podría beneficiar a los adversarios.
Alibaba lanza Qwen3.7-Plus, un nuevo modelo de agente multimodal que integra capacidades avanzadas de visión y lenguaje con sólidas habilidades de agente para la programación, el uso de herramientas y los flujos de trabajo. Esta versión marca un giro hacia la inteligencia incorporada y la automatización a nivel empresarial en la carrera por los modelos de gran tamaño.
Alibaba lanza Qwen3.7-Plus, un nuevo modelo de agente multimodal que integra capacidades avanzadas de visión y lenguaje con sólidas habilidades de agente para la programación, el uso de herramientas y los flujos de trabajo. Esta versión marca un giro hacia la inteligencia incorporada y la automatización a nivel empresarial en la carrera por los modelos de gran tamaño.
La herramienta de IA de Meitu,herramienta de IA de Meitu, RoboNeo, ha lanzado un modelo de equipos de agentes de creación de imágenes que transforma la IA de una herramienta única a un equipo creativo multifuncional. La actualización introduce agentes de IA basados en roles que gestionan tareas desde la concepción hasta el perfeccionamiento, lo que permite a los usuarios generar contenido de marca mediante lenguaje natural. Según se informa, reduce drásticamente el tiempo de producción de vídeos, por ejemplo, reduciendo la replicación de vídeos de comercio electrónico transfronterizo de horas a minutos, y admite la automatización de toda la cadena para vídeos cortos. La actualización integra Seedance 2.0 para una mayor coherencia visual y añade una biblioteca de memoria para ayudar a las marcas a acumular y reutilizar activos digitales
La herramienta de IA de Meitu,herramienta de IA de Meitu, RoboNeo, ha lanzado un modelo de equipos de agentes de creación de imágenes que transforma la IA de una herramienta única a un equipo creativo multifuncional. La actualización introduce agentes de IA basados en roles que gestionan tareas desde la concepción hasta el perfeccionamiento, lo que permite a los usuarios generar contenido de marca mediante lenguaje natural. Según se informa, reduce drásticamente el tiempo de producción de vídeos, por ejemplo, reduciendo la replicación de vídeos de comercio electrónico transfronterizo de horas a minutos, y admite la automatización de toda la cadena para vídeos cortos. La actualización integra Seedance 2.0 para una mayor coherencia visual y añade una biblioteca de memoria para ayudar a las marcas a acumular y reutilizar activos digitales
Counterpoint Research prevé que entre 2025 y 2035 se comercialicen 145 millones de dispositivos físicos de IA, liderados por los drones (59 millones de unidades), los robots (48 millones) y los vehículos autónomos (38 millones). Los robots humanoides son el segmento de más rápido crecimiento, con unas instalaciones que se prevé que superen las 100 000 en 2028, lo que supone un aumento de siete veces con respecto a 2025. Los drones se señalan como una de las primeras aplicaciones a gran escala, con una fuerte demanda en logística y vigilancia.
Counterpoint Research prevé que entre 2025 y 2035 se comercialicen 145 millones de dispositivos físicos de IA, liderados por los drones (59 millones de unidades), los robots (48 millones) y los vehículos autónomos (38 millones). Los robots humanoides son el segmento de más rápido crecimiento, con unas instalaciones que se prevé que superen las 100 000 en 2028, lo que supone un aumento de siete veces con respecto a 2025. Los drones se señalan como una de las primeras aplicaciones a gran escala, con una fuerte demanda en logística y vigilancia.
Zhipu AI ha lanzado GLM-5V-Turbo, un modelo de programación multimodal para la programación visual. Este modelo interpreta imágenes, bocetos de diseño y documentos para generar código front-end funcional. Cuenta con una ventana de contexto de 200 000 palabras y lidera las pruebas de rendimiento en programación multimodal y agentes de interfaz gráfica de usuario (GUI). Además, mejora el agente AutoClaw de Zhipu, permitiendo el análisis visual de datos y la generación de informes.
Zhipu AI ha lanzado GLM-5V-Turbo, un modelo de programación multimodal para la programación visual. Este modelo interpreta imágenes, bocetos de diseño y documentos para generar código front-end funcional. Cuenta con una ventana de contexto de 200 000 palabras y lidera las pruebas de rendimiento en programación multimodal y agentes de interfaz gráfica de usuario (GUI). Además, mejora el agente AutoClaw de Zhipu, permitiendo el análisis visual de datos y la generación de informes.
Los investigadores proponen las "cascadas especulativas", que fusionan la descodificación especulativa y las cascadas estándar para mejorar la eficiencia del LLM. El método utiliza un modelo más pequeño para redactar las salidas y una regla de aplazamiento para decidir si aceptar o pasar tareas a un modelo mayor. Las pruebas demuestran que logra mejores equilibrios entre velocidad y calidad que las técnicas independientes, optimizando el coste y el rendimiento en tareas como el resumen, el razonamiento y la codificación.
Los investigadores proponen las "cascadas especulativas", que fusionan la descodificación especulativa y las cascadas estándar para mejorar la eficiencia del LLM. El método utiliza un modelo más pequeño para redactar las salidas y una regla de aplazamiento para decidir si aceptar o pasar tareas a un modelo mayor. Las pruebas demuestran que logra mejores equilibrios entre velocidad y calidad que las técnicas independientes, optimizando el coste y el rendimiento en tareas como el resumen, el razonamiento y la codificación.





