> ## Content Index
> Fetch the complete content index at: https://fomoera.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# El Apple Watch no sube tu audio a la nube, pero sí un texto condensado de tu conversación
- URL: https://fomoera.com/el-apple-watch-no-sube-tu-audio-a-la-nube-pero-si-un-texto-condensado-de-tu-conversacion/
- Published: 2026-09-10T03:30:48.000Z
- Updated: 2026-09-10T03:30:48.000Z
- Description: Apple publicó un documento de privacidad de 11 páginas sobre Audio Intelligence. De las cuatro funciones del Apple Watch Series 12, tres se resuelven en el aparato. Siri Recap manda a Private Cloud Compute un texto condensado, diseñado para ocupar menos de la mitad de la transcripción.
- Author: Patricia Rodriguez
- Tags: Tecnología y Ciencia, Privacidad

Apple publicó el 9 de septiembre de 2026 una página de soporte y un documento de privacidad de 11 páginas sobre Audio Intelligence, el paquete de funciones que estrenan el Apple Watch Series 12 y el Ultra 4 y que escucha lo que ocurre alrededor de la muñeca. El mensaje que repite la empresa es que el audio en bruto no se graba, no se guarda y no puede consultarlo nadie, ni el sistema, ni las apps, ni el usuario, ni la propia Apple. El documento agrega el reparto exacto. De las cuatro funciones, tres se resuelven dentro del reloj o del iPhone emparejado, y una, Siri Recap, envía a los servidores de Apple un texto condensado de la conversación, diseñado para ocupar menos de la mitad de la transcripción original, junto con datos de calendario y una etiqueta general del lugar.

## Solo una de las cuatro funciones manda texto de tu conversación a un servidor

Audio Intelligence agrupa cuatro cosas y cada una trata el sonido de forma distinta. El reconocimiento de sonidos, pensado sobre todo para personas sordas o con problemas de audición, detecta sirenas, alarmas, timbres o el llanto de un bebé y avisa; ese análisis ocurre en el reloj y, según el documento, ahí el audio no se transcribe ni se transmite. Shazam identifica la música alrededor, pero lo que viaja a los servidores del servicio es una firma acústica de la canción, una representación compacta que, dice Apple, no se puede revertir al sonido original.

Live Rewind se activa a propósito. Con doble pulsación de la corona digital, el reloj toma los 15 segundos de audio que ya tenía en un búfer que se sobrescribe solo y los manda al iPhone emparejado; ahí el reconocimiento de voz los convierte en texto y el audio se descarta enseguida. Si el iPhone no está al alcance, la transferencia falla y el audio también se descarta. El texto vuelve al reloj y desaparece unos 30 segundos después de que la pantalla se atenúa, salvo que el usuario lo guarde en la app Siri o le pregunte a Siri por su contenido, y en ese caso lo único que sale es el texto.

Siri Recap funciona distinto. Un modelo ligero en el chip S11 vigila si hay alguien hablando cerca, sin transcribir ni grabar. Cuando detecta conversación, el audio entra al Secure Exclave del reloj, se cifra y viaja al Secure Exclave del iPhone, donde se descifra, se transcribe y un modelo local lo comprime. Ese texto intermedio está diseñado para ocupar menos de la mitad de la transcripción original: quita muletillas, redundancias y las marcas de tono, y conserva los temas de los que se habló. El audio en bruto se borra ahí. A partir de ese punto, lo que viaja es texto.

La tabla ordena cada función por dónde se procesa el sonido y qué acaba saliendo hacia un servidor.

__Qué sale del Apple Watch en cada función de Audio Intelligence, según el documento de privacidad de Apple de septiembre de 2026__
| Función                   | Dónde se analiza o transcribe                                          | Qué sale hacia un servidor                                                                                      |
| ------------------------- | ---------------------------------------------------------------------- | --------------------------------------------------------------------------------------------------------------- |
| Reconocimiento de sonidos | En el Apple Watch, dentro del Secure Exclave                           | Nada. Apple dice que ahí el audio no se transcribe ni se transmite                                              |
| Shazam                    | En el Apple Watch, dentro del Secure Exclave                           | Una firma acústica de la canción, no el audio, a los servidores de Shazam                                       |
| Live Rewind               | En el iPhone emparejado, con reconocimiento de voz en el propio equipo | Nada, salvo que el usuario guarde el texto o pregunte a Siri; entonces viaja solo el texto                      |
| Siri Recap                | Transcripción y compresión en el Secure Exclave del iPhone             | Un texto condensado de la conversación, con contexto de calendario y ubicación general, a Private Cloud Compute |

A ese texto cifrado Apple le suma contexto para mejorar el resumen: qué se estaba reproduciendo, datos del calendario para titular y etiquetas generales de lugar como casa, trabajo o escuela, además de ciudad, estado y país y categorías de sitio del estilo tienda de abarrotes o parque. La ubicación precisa y el punto de interés concreto quedan fuera. Con eso, los modelos de Apple en Private Cloud Compute generan título, resumen y puntos clave, devuelven el texto cifrado al iPhone y al reloj y borran de inmediato el resultado. La empresa sostiene que nadie, ni siquiera ella, puede acceder a lo que pasa por Private Cloud Compute, y que expertos de seguridad independientes pueden comprobarlo en cualquier momento.

## La función que puede correr todo el día es la que no suena

Live Rewind avisa a quien esté cerca. Al activarse suena un tono desde el altavoz del reloj aunque esté en silencio o con audífonos conectados, y la pantalla muestra una animación completa con un indicador de micrófono. Siri Recap, que puede quedarse encendido durante horas según el horario o el lugar que fije el usuario, no emite ninguna señal. El documento razona que no hay aviso audible porque no se conserva audio en bruto, y cierra el punto con una recomendación dirigida al dueño del reloj: tener en cuenta a los demás cuando la conversación pueda ser privada.

Ninguna de las funciones atribuye lo que dijo cada persona. Un resumen de Siri Recap puede incluir nombres si alguien los menciona en voz alta, pero no marca quién habló, ni con nombre ni con etiquetas del tipo hablante A y hablante B. Live Rewind puede transcribir una frase palabra por palabra y tampoco le pone dueño.

Los resúmenes están diseñados, además, para dejar fuera lenguaje que promueva el daño a uno mismo o el discurso de odio, y datos sensibles como información financiera, identificadores oficiales, datos de autenticación y ciertos identificadores personales. La letra chica matiza dos veces: el filtrado automático puede no retirar toda la información sensible, y los resúmenes se generan con Apple Intelligence, así que pueden salir incompletos o inexactos. La recomendación de la propia Apple para cuando la exactitud importe es confirmar el dato con las personas involucradas.

![Business professionals in a focused discussion during an office meeting.](https://fomoera.com/content/images/2026/09/fomoera-pexels-8428082--source.jpg)

Imagen ilustrativa: los resúmenes de Siri Recap se generan a partir de conversaciones cotidianas y no identifican a quién habló · Foto de [Kampus Production](https://www.pexels.com/@kampus?ref=fomoera.com) en [Pexels](https://www.pexels.com/photo/men-having-a-conversation-8428082/?ref=fomoera.com)

Queda un frente que el documento no resuelve. Sarah Perez escribió en TechCrunch que, como no hay audio guardado, no está claro cómo tratarían los tribunales estadounidenses estas notas de solo texto: podrían llegar a presentarse como prueba, pero sin grabación serían más difíciles de autenticar, y las reglas probatorias cambian de un estado a otro. Lo que Apple sí dejó escrito es la consecuencia de no guardar audio. Como no existe grabación, no hay nada "que compartir, reenviar o entregar si alguien la solicita".

## Qué equipo hace falta y cuánto dura lo que se guarda

Dentro de Audio Intelligence hay dos pisos de hardware. El reconocimiento de sonidos y Shazam funcionan con el Series 12 o el Ultra 4 y cualquier iPhone 11 o posterior, o un iPhone SE de segunda generación o más nuevo, con iOS 27\. Live Rewind y Siri Recap exigen una lista cerrada de 12 modelos: iPhone 16, 16 Plus, 16 Pro y 16 Pro Max; 17, 17e, 17 Pro y 17 Pro Max; iPhone Air; 18 Pro y 18 Pro Max; y el iPhone Duo. Esa lista no incluye al iPhone 16e ni a ningún iPhone 15\. El documento de privacidad da la razón técnica, y es que el teléfono emparejado también necesita su propio Secure Exclave para descifrar y procesar el audio; ahí Apple nombra al iPhone 16, el 16 Pro, el 17e, el Air y los modelos posteriores.

Las dos funciones tampoco están disponibles para menores de 13 años, y en una cuenta infantil de un usuario menor de 18 tiene que activarlas un padre o tutor. Llegan en beta a finales de 2026 y empiezan en inglés. La letra chica las condiciona a Apple Intelligence y a Siri AI, que según ese mismo texto no estará disponible al inicio en la Unión Europea.

El reloj que las va a estrenar llega antes que ellas. El Series 12 y el Ultra 4 se venden desde el 18 de septiembre, con su sistema de sensores de salud listo desde el primer día.

[Apple Watch Series 12: pulso cada cinco segundosEl Series 12 y el Ultra 4 salen el 18 de septiembre desde 399 y 799 dólares; su IA llega después y en inglés.![](https://fomoera.com/content/images/icon/favicon-aa22385a-e263-4791-837c-85c89fbccaf6.ico)FomoEraGerardo Pavez![](https://fomoera.com/content/images/thumbnail/fomoera-apple-watch-series-12-y-ultra-4-pulso-cada-5-segundos-la-nueva-siri-hablara-espanol-en-octubre-9f81e4b6-16x9-v2-1200x675-da68dbfe-9563-4d9e-9d08-4832499884d6.webp)](https://fomoera.com/apple-watch-series-12-y-ultra-4-pulso-cada-5-segundos-la-nueva-siri-hablara-espanol-en-octubre/)

Lo que sí se guarda tiene su propio plazo. Un resumen de Siri Recap se borra solo a los 7 días si nadie lo salva o lo exporta, y el texto de 15 segundos de Live Rewind desaparece del reloj unos 30 segundos después de que la pantalla se atenúa. Lo que el usuario decide conservar vive en la pestaña Recaps de la app Siri y se sincroniza cifrado de extremo a extremo si hay iCloud con autenticación de dos factores y código en el equipo; borrar una entrada la quita de todos los dispositivos. Las llaves de los Secure Exclave están atadas al aparato, rotan y caducan, y borrar un reloj o un iPhone con Find My invalida el emparejamiento de inmediato.

Nada de esto se puede comprobar todavía en una muñeca, porque las dos funciones que mueven texto entran en beta a finales de año. Cuando lleguen, el documento señala un rastro que el usuario sí puede mirar: el Apple Intelligence Report, que se activa en los ajustes de privacidad del iPhone, registra la petición a Private Cloud Compute y queda visible 15 minutos o 7 días según la configuración, solo en el propio equipo y solo después de autenticarse.

*Fuentes:* [1](https://support.apple.com/en-us/148354?ref=fomoera.com), [2](https://www.apple.com/privacy/docs/Audio%5FIntelligence%5FPrivacy%5FOverview%5FSep%5F2026.pdf?ref=fomoera.com), [3](https://techcrunch.com/2026/09/09/apple-watchs-new-ai-features-are-normalizing-the-idea-that-technology-is-always-listening/?ref=fomoera.com)