Descubre herramientas de IA de calidad
Reúna las principales herramientas de inteligencia artificial del mundo para ayudar a mejorar la eficiencia laboral
Artículos publicados por JamesLopez
Prime Intellect, una empresa emergente que ofrece recursos informáticos y herramientas para el desarrollo de inteligencia artificial, recaudó 130 millones en su ronda de financiación Serie A, liderada por Radical Ventures, con la participación también de Nvidia Ventures e Intel Capital. Fundada en 2024, esta compañía ayuda a las empresas a crear agentes de IA personalizados sin depender de laboratorios externos. Su plataforma modular generó unos 100 millones en ingresos anuales gracias a clientes como Ramp y Zapier. Con una valoración que la clasifica como unicornio, Prime Intellect tiene como objetivo democratizar el desarrollo de inteligencia artificial a nivel empresarial.
Prime Intellect, una empresa emergente que ofrece recursos informáticos y herramientas para el desarrollo de inteligencia artificial, recaudó 130 millones en su ronda de financiación Serie A, liderada por Radical Ventures, con la participación también de Nvidia Ventures e Intel Capital. Fundada en 2024, esta compañía ayuda a las empresas a crear agentes de IA personalizados sin depender de laboratorios externos. Su plataforma modular generó unos 100 millones en ingresos anuales gracias a clientes como Ramp y Zapier. Con una valoración que la clasifica como unicornio, Prime Intellect tiene como objetivo democratizar el desarrollo de inteligencia artificial a nivel empresarial.
La comunidad openJiuwen lanzó Skill-Omni, el primer paradigma de habilidades multimodales validado desde el punto de vista ingenieril en la industria. Este sistema eleva a los agentes de IA de un modelo basado únicamente en texto a uno con percepción visual, lo que permite ejecutar con precisión tareas como la edición de fotos y las operaciones de interfaz gráfica al convertir capturas de pantalla, estados de interfaz y secuencias de video en recursos visuales reutilizables. Las herramientas integradas de generación automática crean habilidades multimodales a partir de contenido en línea, mientras que un mecanismo de lectura bajo demanda carga las pruebas visuales únicamente cuando son necesarias. Esto representa un cambio hacia una ingeniería de experiencias para agentes basada en modalidades múltiples en lugar de documentos, y ya está disponible en JiuwenSwarm.
La comunidad openJiuwen lanzó Skill-Omni, el primer paradigma de habilidades multimodales validado desde el punto de vista ingenieril en la industria. Este sistema eleva a los agentes de IA de un modelo basado únicamente en texto a uno con percepción visual, lo que permite ejecutar con precisión tareas como la edición de fotos y las operaciones de interfaz gráfica al convertir capturas de pantalla, estados de interfaz y secuencias de video en recursos visuales reutilizables. Las herramientas integradas de generación automática crean habilidades multimodales a partir de contenido en línea, mientras que un mecanismo de lectura bajo demanda carga las pruebas visuales únicamente cuando son necesarias. Esto representa un cambio hacia una ingeniería de experiencias para agentes basada en modalidades múltiples en lugar de documentos, y ya está disponible en JiuwenSwarm.
ByteDance ha hecho disponible bajo código abierto a Bernini, un framework para la generación y edición de videos que utiliza un mecanismo de “primero comprender, luego generar” para resolver problemas de inestabilidad en las imágenes y parpadeo de los fotogramas. Este framework separa la planificación semántica de la renderización visual, y permite el uso de texto, imágenes y videos en la edición controlada. El código de inferencia y el modelo Bernini-R ya han sido publicados; la versión completa seguirá siendo lanzada en breve.
ByteDance ha hecho disponible bajo código abierto a Bernini, un framework para la generación y edición de videos que utiliza un mecanismo de “primero comprender, luego generar” para resolver problemas de inestabilidad en las imágenes y parpadeo de los fotogramas. Este framework separa la planificación semántica de la renderización visual, y permite el uso de texto, imágenes y videos en la edición controlada. El código de inferencia y el modelo Bernini-R ya han sido publicados; la versión completa seguirá siendo lanzada en breve.
Una demanda colectiva acusa a Ring, de Amazon, de recopilar en secreto datos biométricos faciales de transeúntes sin su consentimiento a través de su función «Familiar Faces». La demanda fue presentada en Seattle por un residente de Virginia. Ring encripta los datos y elimina los rostros no identificados al cabo de 30 días, pero sigue siendo objeto de escrutinio en materia de privacidad tras una multa de 5,8 millones de dólares impuesta por la FTC en 2023.
Una demanda colectiva acusa a Ring, de Amazon, de recopilar en secreto datos biométricos faciales de transeúntes sin su consentimiento a través de su función «Familiar Faces». La demanda fue presentada en Seattle por un residente de Virginia. Ring encripta los datos y elimina los rostros no identificados al cabo de 30 días, pero sigue siendo objeto de escrutinio en materia de privacidad tras una multa de 5,8 millones de dólares impuesta por la FTC en 2023.
Google lanza el portátil Googlebook AI, que traslada la informática personal a una lógica centrada en los modelos. Integra profundamente Gemini a nivel del sistema, ofreciendo un entorno informático dinámico impulsado por IA. Una innovación clave consiste en la incorporación de Gemini al cursor, lo que permite el análisis de la pantalla en tiempo real y la predicción proactiva de intenciones. Esto permite realizar acciones como programar citas a partir de fechas o resumir texto mediante gestos con el puntero. La plataforma también introduce un escritorio dinámico que genera paneles personalizados a través del lenguaje natural, denominado «Vibe Computing». Esto posiciona a la IA como el cerebro central del sistema, remodelando la interfaz de usuario y automatizando tareas, lo que establece un nuevo paradigma para los ordenadores con IA
Google lanza el portátil Googlebook AI, que traslada la informática personal a una lógica centrada en los modelos. Integra profundamente Gemini a nivel del sistema, ofreciendo un entorno informático dinámico impulsado por IA. Una innovación clave consiste en la incorporación de Gemini al cursor, lo que permite el análisis de la pantalla en tiempo real y la predicción proactiva de intenciones. Esto permite realizar acciones como programar citas a partir de fechas o resumir texto mediante gestos con el puntero. La plataforma también introduce un escritorio dinámico que genera paneles personalizados a través del lenguaje natural, denominado «Vibe Computing». Esto posiciona a la IA como el cerebro central del sistema, remodelando la interfaz de usuario y automatizando tareas, lo que establece un nuevo paradigma para los ordenadores con IA
Nvidia presenta Cosmos Reason, un modelo de IA de 7B parámetros para robótica, además de nuevos modelos Cosmos, bibliotecas neuronales y el servidor RTX Pro Blackwell para impulsar datos sintéticos y la planificación de robots en SIGGRAPH 2025.
Nvidia presenta Cosmos Reason, un modelo de IA de 7B parámetros para robótica, además de nuevos modelos Cosmos, bibliotecas neuronales y el servidor RTX Pro Blackwell para impulsar datos sintéticos y la planificación de robots en SIGGRAPH 2025.





