Al utilizar este sitio, acepta la Política de privacidad y Terms y Condiciones.
Aceptar
MastekHwMastekHwMastekHw
  • Noticias
  • Tecnología
    Tecnología
    Todas las noticias más importantes de la tecnología la encuentras aquí en MastekHw, Categoría Tecnología, noticias, lanzamientos, entrevistas y más.
    Ver más
    Noticias Destacadas
    Bose Professional anuncia la adquisición de Fulcrum Acoustic
    Bose Professional anuncia la adquisición de Fulcrum Acoustic
    hace 3 semanas
    Comic Con Colombia llega a Medellín el 28 de noviembre
    Comic Con Colombia llega a Medellín el 28 de noviembre
    hace 9 meses
    Airbnb, Gobernación del Valle del Cauca y Alcaldía de Cali firman acuerdos estratégicos
    Airbnb, Gobernación del Valle del Cauca y Alcaldía de Cali firman acuerdos estratégicos
    hace 1 año
    Últimas Noticias
    Kaspersky sobre señuelos de 4,7 millones de ciberataques dirigidos al entorno laboral
    hace 14 horas
    Las Chromebooks transforman la educación con una experiencia simple
    hace 14 horas
    Oracle y AWS profundizan su colaboración estratégica
    hace 16 horas
    Razer Huntsman V3 Pro Low-profile Tenkeyless 8KHz es anunciado de manera oficial
    hace 14 horas
  • Móviles
    MóvilesVer más
    motorola razr 70 Ultra ofrece experiencias fotográficas que van más allá 
    motorola razr 70 Ultra ofrece experiencias fotográficas que van más allá 
    9 Min en Leer
    HUAWEI celebra el primer aniversario de sus tiendas de experiencia en Colombia
    HUAWEI celebra el primer aniversario de sus tiendas de experiencia en Colombia
    4 Min en Leer
    La nueva tendencia para tomar selfies llega a Colombia con el OPPO Bubble
    La nueva tendencia para tomar selfies llega a Colombia con el OPPO Bubble
    5 Min en Leer
    Formas en las que la HUAWEI MatePad Mini acompaña a los jóvenes
    Formas en las que la HUAWEI MatePad Mini acompaña a los jóvenes
    6 Min en Leer
    Motorola presenta el nuevo moto g max en Colombia
    Motorola presenta el nuevo moto g max en Colombia
    2 Min en Leer
  • PC
  • Gaming
  • Reviews
  • Guardados
  • Contacto
Buscar
  • Contacto
  • Blog
  • Publicidad
© 2018 MastekHw Service International. LLc. Todos los derechos reservados.
Leyendo: Intel sugiere contar el trabajo realizado. No solo los núcleos
Compartir
Notificación
Tamaño TextoAa
MastekHwMastekHw
Tamaño TextoAa
  • Noticias
  • Tecnología
  • Móviles
Buscar
  • Categorias
    • Noticias
    • Tecnología
    • PC
    • Móviles
    • Entretenimiento
    • Gaming
    • Reviews
Síguenos
  • Contacto
  • Blog
  • Publicidad
© 2018 MastekHw Service International. LLc. Todos los derechos reservados.
MastekHw > Noticias > Noticias > Intel sugiere contar el trabajo realizado. No solo los núcleos
Noticias

Intel sugiere contar el trabajo realizado. No solo los núcleos

Carlos Cantor
Última actualización: agosto 23, 2026 8:17 pm
Carlos Cantor
Compartir
Intel sugiere contar el trabajo realizado. No solo los núcleos
Compartir

Por: Karin Eibschitz Segal

El debate sobre las CPUs para la IA Agente se ha vuelto demasiado estrecho. Gran parte de la conversación del sector se centra en el rendimiento de un solo hilo, la densidad de núcleos y el rendimiento del rack. Las tres son importantes. Pero ninguno responde por sí solo a la pregunta que finalmente tienen los clientes: ¿Cuánto trabajo útil de agente puede completar mi infraestructura de forma fiable dentro de los límites de latencia, coste y consumo que requiere mi empresa?

El recuento de núcleos indica a los clientes cuánta capacidad de cómputo se destina a un sistema. La IA agente requiere medir cuán eficazmente el sistema convierte esa capacidad en trabajo terminado.

La concurrencia cambia la respuesta

Un único bucle de agente hace que el rendimiento parezca sencillo: termina cada paso más rápido y el flujo de trabajo avanza más rápido. Los sistemas de producción ejecutan muchos agentes a la vez, compitiendo por CPU, memoria, E/S y recursos de aceleradores. Bajo esa carga, el cuello de botella cambia.

En un análisis público reciente que utilizó 739 conversaciones anonimizadas en Claude Code—flujos de trabajo de agentes codificadores que implican razonamiento de varios turnos, generación de código y uso de herramientas—el procesamiento y el tiempo de espera en el lado de la CPU aumentaron de menos del 1% de la latencia total para una sola petición a hasta un 15% en 32 solicitudes concurrentes. La mayor parte de ese aumento vino de la programación y la colocación en cola, no de la computación.

Un núcleo más rápido puede ejecutar el trabajo más rápido. No puede hacer desaparecer una cola.

La espera también llega a la parte más cara del sistema. Para los agentes de ejecución de código, la misma investigación estima que las GPUs realizan un trabajo útil solo durante el 50% al 60% del tiempo de reloj de pared. Cuando un agente espera una base de datos, un sistema de recuperación o un sandbox, la GPU también espera. La Ley de Amdahl sigue vigente:

«El acelerador más caro es el que espera al resto del sistema.»

Agentes entregados por medida, no capacidad teórica

Intel propone una medida más útil: agentes entregados por rack: los flujos de trabajo de agentes que un rack puede completar de forma fiable con el rendimiento, calidad y latencia requeridos, dentro de un límite definido de consumo y costes.

Una forma de entender la capacidad entregada es:

Agentes entregados por rack = Agentes teóricos por rack × Eficiencia de enrutamiento × Balance de recursos × eficiencia de descarga

La capacidad teórica refleja el cálculo, memoria y ancho de banda disponibles del rack. La eficiencia del enrutamiento refleja la calidad de la colocación del trabajo. El equilibrio de recursos captura las pérdidas por cuellos de botella y colas. La eficiencia de descarga refleja la capacidad recuperada al trasladar las tareas de infraestructura lejos de los núcleos de uso general. El documento técnico adjunto define estos factores y la metodología con mayor detalle.

El verdadero límite es cuando añadir agentes lleva la latencia más allá del objetivo del cliente, no la cima de un gráfico teórico de rendimiento.

Intel está diseñado para todo el flujo de trabajo

Intel no está eligiendo entre núcleos rápidos y más núcleos. Estamos construyendo el sistema que convierte ambos en trabajos terminados.

Mantén el estado disponible. El ancho de banda mantiene a un agente en movimiento; La capacidad evita que vuelva a empezar. El Modo de Memoria Plana Intel Xeon 6 combina memoria conectada a CXL y DDR5 nativa en un solo espacio de direcciones. En una evaluación conjunta de Intel y SAP, ofreció el 96% del rendimiento totalmente DDR5 con aproximadamente un 25% menos de coste total de propiedad de memoria, una vía práctica para mantener más sesiones calientes a menor coste.

Devuelve la capacidad al sistema. La tecnología Intel QuickAssist, el Data Streaming Accelerator y el In-Memory Analytics Accelerator (Intel® IAA) descargan trabajos de infraestructura que de otro modo consumirían núcleos de propósito general. El trabajo publicado usando Intel IAA para compresión de instantáneas ofrecía completaciones de instantáneas aproximadamente 1,2 veces más rápidas. La descarga no es una lista de comprobación de características; es la capacidad devuelta al cliente.

Adapta el recurso al trabajo. La orquestación, la ejecución de herramientas, los servicios de datos y el movimiento de estados tienen necesidades diferentes. El portafolio Xeon abarca un alto rendimiento por hilo P-core y un rendimiento denso de núcleo E en una arquitectura común, permitiendo al sistema situar cada fase en el perfil de ejecución adecuado.

No dejes el acelerador en marcha. Por supuesto, las empresas necesitarán GPUs optimizadas para agentes tanto como CPUs, e Intel está preparando su GPU Crescent Island para cumplir exactamente ese papel. Pero si la GPU siguiera esperando, sigue siendo solo una pieza cara de potencia de bastidor que quema silicio. Por eso esta discusión sobre la CPU sigue siendo importante. Xeon es el controlador de tráfico del sistema agente, manteniendo las sesiones en movimiento, las herramientas en ejecución, el flujo de datos y los aceleradores alimentados.»

Un marcador más útil

Cada afirmación de rendimiento de IA agente—incluida la de Intel—debería indicar la concurrencia, el objetivo de latencia y las pérdidas entre la capacidad teórica y la entregada. Sin esos, un resultado describe potencial, no capacidad de producción.

Intel pretende informar agentes por rack a un objetivo de latencia p99 declarado sobre trazas agenticas reales, junto con la eficiencia del enrutamiento, las ganancias de la descarga de función fija, la eficiencia del host en sistemas conectados a GPU y los agentes por vatio bajo una restricción de potencia definida en el rack.

El rendimiento en un solo hilo importa. La densidad del núcleo importa. Pero el sistema que gane será el que mantenga cada hilo alimentado, cada sesión caliente y cada acelerador productivo.

La industria ya ha dedicado suficiente tiempo a contar lo que va en la estantería. Es hora de medir lo que sale.

Para más información, el whitepaper de Intel, Cuántos agentes ejecutará realmente tu rack, explora esta idea con mayor profundidad, exponiendo el marco técnico, los datos de apoyo y consideraciones prácticas detrás de los «agentes entregados por rack» — y cómo las organizaciones pueden aplicarlo para evaluar el rendimiento real del sistema.

Claro y Oracle aceleran la transformación digital en Colombia
NVIDIA rompe la barrera de los $5 trillones de dólares
OMD continuará su alianza con Tigo
Cooler Master lanza el nuevo cooler Hyper 612 APEX
Claves para seleccionar un CRM que impulse a su pyme
Comparte este artículo
Facebook Copiar enlace
Compartir
Artículo anterior Las Chromebooks transforman la educación con una experiencia simple Las Chromebooks transforman la educación con una experiencia simple
Siguiente Artículo Kaspersky sobre señuelos de 4,7 millones de ciberataques dirigidos al entorno laboral Kaspersky sobre señuelos de 4,7 millones de ciberataques dirigidos al entorno laboral
- Publicidad -
Ad imageAd image

Síguenos

FacebookSeguir Fb
XSeguir
InstagramSeguir
YouTubeSuscríbete
TikTokSeguir
LinkedInSeguir

Últimas noticias

Regresa el Reto Conexión 1014 a Call of Duty Mobile
Regresa el Reto Conexión 10/14 a Call of Duty: Mobile
Gaming Noticias
WAR llegará a HBO Max el 1 de octubre
WAR llegará a HBO Max el 1 de octubre
Entretenimiento Noticias
Kaspersky sobre señuelos de 4,7 millones de ciberataques dirigidos al entorno laboral
Kaspersky sobre señuelos de 4,7 millones de ciberataques dirigidos al entorno laboral
Noticias Tecnología
Las Chromebooks transforman la educación con una experiencia simple
Las Chromebooks transforman la educación con una experiencia simple
Noticias Tecnología

Te puede interesar...

Coherent inicia las obras de ampliación de sus instalaciones en Texas
NoticiasTecnología

Coherent inicia las obras de ampliación de sus instalaciones en Texas

Carlos Cantor
Carlos Cantor
6 Min en Leer
Intel anuncia cambios en el Intel Partner Alliance
NoticiasTecnología

Intel anuncia cambios en el Intel Partner Alliance

Carlos Cantor
Carlos Cantor
2 Min en Leer
Escala 24x7 es adquirido por Stefanini Group
NoticiasTecnología

Escala 24×7 es adquirido por Stefanini Group

Carlos Cantor
Carlos Cantor
//

Somos el portal donde obtendrás las novedades sobre tecnología y entretenimiento digital

Enlaces Rápido

  • Contacto
  • Blog
  • Publicidad

Soporte

  • Términos y Condiciones
  • Política de cookies
  • Política de Privacidad

Suscríbete a nuestro boletín

Suscríbase a nuestro boletín para recibir nuestros artículos más recientes.

MastekHwMastekHw
Síguenos
© 2018 MastekHw Service International. LLc. Todos los derechos reservados.
Bienvenido de nuevo!

Accede a tu cuenta

Usuario o Email
Contraseña

¿Ha perdido su contraseña?