Noticias sobre IA, 25 de agosto de 2026

Resumen de noticias y cuestionario sobre IA: 25 de agosto de 2026

Los primeros resultados de Jalapeño muestran una velocidad y eficiencia líderes en la industria en inferencia de IA

OpenAI publicó los primeros resultados de rendimiento de Jalapeño, su chip de inferencia personalizado. En el GPT-OSS 120B, el chip ofreció aproximadamente 1,9 veces más rendimiento máximo por kilovatio y una latencia de extremo a extremo alrededor de 1,7 veces menor que el sistema de comparación.

Las mejoras se extendieron también a DeepSeek R1 y Kimi K2.5. OpenAI planea implementar Jalapeño en su propia infraestructura informática, mientras que los diseños de segunda y tercera generación ya están en marcha... así que sí, OpenAI se está convirtiendo cada vez más en una empresa de chips, en cierto modo. (OpenAI)

Claude Cowork finalmente recuerda lo que le dijiste a la aplicación en el chat

Anthropic unificó la memoria de Claude entre el chat habitual y Cowork. La información aprendida durante las conversaciones ahora puede acompañar a los usuarios en sus tareas, eliminando ese ritual un tanto exasperante de explicar el mismo proyecto una y otra vez. 

Los usuarios pueden inspeccionar, editar y eliminar temas guardados, mientras que los recuerdos se actualizan a medida que las conversaciones continúan. Esta función está habilitada por defecto en los planes Gratuito, Pro y Max. (TechCrunch)

Google Cloud lanza Gemini Enterprise para el sector legal

Google Cloud presentó un paquete Gemini Enterprise diseñado específicamente para abogados, que amplía las capacidades de sus agentes más allá del chat genérico, abarcando la revisión de contratos, la investigación legal, el monitoreo regulatorio, las solicitudes de privacidad y la redacción de documentos.

Incluye conectores para plataformas como Harvey, iManage, DocuSign, RelativityOne y Thomson Reuters, a la vez que preserva los controles de acceso y las barreras éticas existentes de las empresas. La toma de control de los agentes de IA ha llegado al departamento legal... como era de esperar, pero aun así con bastante rapidez. (Google Cloud Press Corner)

Google Cloud lanza Gemini Enterprise para servicios financieros

Google también lanzó Gemini Enterprise, una solución específica para el sector financiero que incluye un agente de investigación financiera gestionado, más de 50 habilidades especializadas y 13 conectores a sistemas de datos financieros y de mercado.

La plataforma está diseñada para flujos de trabajo que incluyen la evaluación del riesgo crediticio, el monitoreo de carteras, la investigación KYC y el análisis de mercado. CME Group y Deutsche Bank se encuentran entre las organizaciones que ya participan; los agentes empresariales se están especializando cada vez más, casi como software con traje. (Google Cloud Press Corner)

NVIDIA anuncia el ordenador robótico Jetson Orin Nano 2 para redefinir la IA de borde de nivel básico

Nvidia presentó Jetson Orin Nano 2, un ordenador compacto diseñado para robots, drones y otros sistemas de inteligencia artificial física. Ofrece 78 billones de operaciones por segundo, 8 GB de memoria y una CPU Arm de ocho núcleos. 

Nvidia afirma que el rendimiento de inferencia se duplica en comparación con el anterior Nano Super, y que igualar su rendimiento puede requerir un 40 % menos de energía. Lo interesante es que los modelos más pequeños se vuelven realmente capaces en hardware compacto: la IA ya no necesita conectarse siempre al enorme centro de datos. (Sala de prensa de NVIDIA)

Perplexity se asocia con Nvidia para lanzar Portable Computer, un agente de IA totalmente local con cero costes de token

Perplexity lanzó Portable Computer, llevando su experiencia de computación basada en agentes al hardware local con tecnología Nvidia. Los modelos, archivos y la ejecución de agentes pueden permanecer en la máquina del usuario, y el trabajo completado localmente no consume créditos de facturación en la nube.

Las tareas se inician localmente y el sistema solicita autorización antes de pasar a un modelo de nube de vanguardia. Su lanzamiento se basa en sistemas Nvidia DGX Spark y Linux con GPU RTX suficientemente potentes; la privacidad y el coste se convierten de repente en parte fundamental del argumento de venta de la IA local, no solo la velocidad. (Venturebeat)

Según informa el Wall Street Journal, se espera que Anthropic comunique a sus inversores que prevé ingresos potenciales superiores a los 30 billones de dólares

Según se informa, Anthropic se está preparando para comunicar a los inversores que su mercado potencial total podría superar los 30 billones de dólares. Es importante aclarar que se trata de la oportunidad anual teórica si la IA captara el trabajo relevante, no de una predicción de Anthropic que anuncie que alcanzará los 30 billones de dólares. (Reuters)

Esta cifra descomunal ayuda a contextualizar el gasto en infraestructura de Anthropic, su competencia con OpenAI y Google, y la historia general de los inversores. Es una cifra espectacularmente grande... incluso para los estándares de la industria de la IA. (Reuters)

Preguntas frecuentes

¿Qué significan los resultados de OpenAI sobre el chip de jalapeño para la inferencia de IA?

OpenAI afirma que Jalapeño ofreció un mayor rendimiento máximo por kilovatio y una menor latencia de extremo a extremo que su sistema de comparación al ejecutar GPT-OSS 120B. Se reportaron mejoras similares con DeepSeek R1 y Kimi K2.5. Los resultados sugieren que OpenAI está diseñando cada vez más hardware en función de las exigencias específicas de eficiencia y velocidad de la inferencia de IA a gran escala.

¿Cómo funciona la memoria compartida de Claude entre el chat y el espacio de coworking?

Ahora, Claude puede incorporar información aprendida en conversaciones cotidianas a las tareas de Cowork, lo que reduce la necesidad de explicar repetidamente el mismo proyecto o contexto. Los usuarios pueden inspeccionar, editar y eliminar temas guardados, y estos se actualizan continuamente a medida que avanzan las conversaciones. Según el anuncio mencionado en el artículo, esta función está habilitada de forma predeterminada en los planes Gratuito, Pro y Max.

¿Qué puede hacer Gemini Enterprise por los servicios legales y financieros?

Las soluciones especializadas Gemini Enterprise de Google Cloud están orientadas a flujos de trabajo específicos de cada sector, en lugar de a chats de IA genéricos. El paquete legal abarca áreas como la revisión de contratos, la investigación, el seguimiento normativo, las solicitudes de privacidad y la redacción de documentos, mientras que la versión para servicios financieros admite flujos de trabajo que incluyen la evaluación del riesgo crediticio, el seguimiento de carteras, la investigación KYC y el análisis de mercado. Ambas pueden conectarse con sistemas de software y datos profesionales ya existentes.

¿Por qué la inferencia de IA local está adquiriendo mayor importancia?

La inferencia de IA local puede reforzar la privacidad, reducir la dependencia de la infraestructura en la nube y, potencialmente, disminuir los costos de uso continuos. El Jetson Orin Nano 2 de Nvidia está diseñado para robots, drones y otros sistemas periféricos, mientras que el Portable Computer de Perplexity mantiene los modelos, archivos y la ejecución de agentes en hardware local compatible. En muchos flujos de trabajo, los modelos en la nube pueden reservarse para tareas que requieren capacidades adicionales.

¿Cómo decide Perplexity Portable Computer cuándo utilizar la IA en la nube?

Las tareas están diseñadas para iniciarse en el hardware local del usuario con tecnología Nvidia, manteniendo la ejecución del modelo compatible y los archivos en la máquina. Si un paso requiere un modelo en la nube de vanguardia, el sistema solicita permiso al usuario antes de escalarlo. El trabajo realizado localmente no consume créditos de facturación en la nube, lo que hace que este enfoque sea relevante para los usuarios preocupados tanto por la privacidad como por los costos recurrentes de inferencia.

¿Qué significa la estimación de Anthropic sobre el mercado de la IA, que asciende a 30 billones de dólares?

La cifra mencionada se refiere a la visión de Anthropic sobre el mercado potencial total para la IA, no a una predicción de que Anthropic generará 30 billones de dólares en ingresos anuales. Representa el valor teórico del trabajo que la IA podría abordar en toda la economía. Esta estimación también ayuda a explicar por qué las principales empresas de IA están invirtiendo tanto en infraestructura y capacidades empresariales.

Noticias de IA de ayer: 24 de agosto de 2026

Encuentra la última IA en la tienda oficial de AI Assistant

Sobre nosotros

Cuestionario sobre noticias y novedades del sector de la IA
1. ¿Qué mejoras de rendimiento reportó OpenAI para su chip de inferencia personalizado Jalapeño que ejecuta GPT-OSS 120B?

2. ¿Cómo ha actualizado Anthropic la funcionalidad de memoria de Claude en el chat normal y en Cowork?

3. ¿Cuáles son las especificaciones clave y los aspectos más destacados del rendimiento del Jetson Orin Nano 2 de NVIDIA?

4. ¿Cómo gestiona el Portable Computer de Perplexity la ejecución híbrida local y en la nube?

5. ¿Qué significa realmente la cifra de 30 billones de dólares que reporta Anthropic?


Volver al blog