Resumi · Cómo funciona

Así viaja una reunión, sin salir de tu Mac.

Resumi graba tu voz y la de los demás en dos pistas, las transcribe en el chip de tu Mac y resume decisiones y pendientes con el minuto donde se dijeron. Ningún paso manda tu audio ni tu texto a internet.

Paso a paso

¿Qué pasa desde que abres la app hasta que mandas la minuta?

  1. 01

    Instala y baja el modelo, una vez

    Abres Resumi, sin cuenta ni registro, y desde Ajustes bajas Whisper large-v3-turbo (1.6 GB) de huggingface.co. Es la descarga que necesita para transcribir; si quieres resumen en macOS 14.4 a 15 o preguntarle a tus reuniones, bajas también la IA local Qwen3 4B (2.5 GB). Después puedes apagar el WiFi.

  2. 02

    Avisa que vas a grabar

    Antes de cada grabación sale la hoja «Antes de grabar»: un guion para leer en voz alta o un texto para pegar en el chat, en español o en inglés. Te dice qué micrófono y qué salida va a usar, y la grabación anota cómo avisaste.

  3. 03

    Graba en dos pistas

    Tu micrófono queda como «Tú» y el audio del sistema (Zoom, Meet, Teams o cualquier app) como «Ellos», sin invitar a un bot. Si la llamada deja de oírte o el micrófono muere, te avisa en ese momento; si la app se cierra, al abrir recuperas lo grabado.

  4. 04

    Se transcribe en tu chip

    Al detener, la grabación entra a una cola y vuelves a «Grabar» de inmediato. Un detector de voz recorta el silencio, se quita el eco si grabaste sin audífonos y Whisper large-v3-turbo transcribe a ~20× tiempo real, con los nombres de tu trabajo y las palabras dudosas subrayadas.

  5. 05

    Resume, con citas

    Apple Intelligence en macOS 26 o la IA local en macOS 14.4 o superior escriben decisiones y pendientes con responsable, fecha y el minuto donde se dijo cada cosa. Con la IA local, además, le preguntas a la reunión con ⌘K.

  6. 06

    Comparte la minuta

    «Compartir minuta» copia el resumen y los pendientes, o guarda la minuta en Word o PDF; también exportas a Markdown, texto, SRT, VTT o JSON. Sale solo lo que tú exportas, por el canal que tú elijas.

  7. 07

    Queda en tu Mac, bajo llave si quieres

    Todo vive en una carpeta de tu usuario. Con candado, el transcript y el audio se cifran con AES-256-GCM y se abren con Touch ID; la clave de recuperación la genera tu Mac y no la tenemos.

El mapa · qué sale y qué no sale de tu Mac

Cero flechas hacia afuera al transcribir. Una sola hacia adentro, cuando tú la pides.

El mismo diagrama que dibujan las páginas de VPN y de cifrado, con la diferencia de que aquí no hay servidor en medio: el audio, el texto y la base no cruzan el borde de tu equipo.

Flujo de datos de Resumi: micrófono y audio del sistema entran, Whisper transcribe en el chip, SQLite guarda en el disco, y solo sale lo que exportas; las únicas conexiones a internet son descargas de modelosTu MacMicrófonolo que dices túAudio del sistemaZoom, Meet, TeamsWhisper en tu chipwhisper.cpp · Metalmodelos/1.6 GB, en tu discoSQLite · SQLCipheren tu discoInternethuggingface.coLo que exportas.md .srt .json .vttsolo lo que tú exportasdescarga del modelo · una vez, cuando tú lo pides✕0 bytes al transcribirFlujo de datos de Resumi: micrófono y audio del sistema entran, Whisper transcribe en el chip, SQLite guarda en el disco, y solo sale lo que exportas; las únicas conexiones a internet son descargas de modelosTu MacInternet · huggingface.codescarga del modelo · una vez, cuando tú lo pidesMicrófonolo que dices túAudio del sistemaZoom, Meet, TeamsWhisper en tu chipwhisper.cpp · Metal · modelos/ (1.6 GB)SQLite · SQLCipheren tu disco✕0 bytes a internet al transcribirLo que exportassolo tú, cuando tú lo decides
Entra
Tu micrófono (lo que dices tú) y el audio del sistema (lo que dicen ellos en Zoom, Meet o Teams), en dos pistas. Ningún bot entra a la llamada.
Se procesa
Whisper large-v3-turbo corre con whisper.cpp sobre el chip de tu Mac. El resumen lo hace el modelo de Apple Intelligence de macOS 26 o, en macOS 14.4 o superior, la IA local Qwen3 4B; los dos en tu Mac.
Se guarda
En SQLite con búsqueda de texto completo, en tu disco. Con el candado activado, AES-256-GCM para el audio y para cada grabación bloqueada, y SQLCipher para la base si cifras toda la biblioteca.
Sale
Solo lo que tú exportas (.md, .txt, .json, .srt, .vtt), cuando tú lo decides y por el canal que tú elijas.
Las únicas conexiones
Las descargas de modelos desde huggingface.co: el de transcripción (1.6 GB) una vez, cuando tú lo pides, y los opcionales que actives, sin cabeceras de identificación. Al transcribir, 0 bytes.

Preguntas.

6 preguntas · cada respuesta se entiende sola

¿Funciona con Zoom, Google Meet y Microsoft Teams?

Sí, con cualquier app que suene en tu Mac. Resumi no invita a ningún bot a la llamada: captura el audio del sistema con Core Audio taps (lo que dice la otra persona) y el micrófono (lo que dices tú), en dos pistas separadas, incluso si usas audífonos. A las personas les avisas tú antes de empezar.

¿Tengo que avisar que estoy grabando la reunión?

Sí, avisa siempre antes de empezar; es tu responsabilidad, no de la app. En México la Suprema Corte ha resuelto que la inviolabilidad de las comunicaciones del art. 16 constitucional se impone solo frente a terceros ajenos, no entre quienes participan (tesis 1a./J. 5/2013, registro 159859), así que grabar tu propia conversación no la viola; divulgar lo íntimo o lo sensible sí puede violar la privacidad, y si grabas a clientes o pacientes tratas datos personales bajo la LFPDPPP, DOF 20 de marzo de 2025. Si alguien se conecta desde otro país, revisa la ley de su lugar: en California, por ejemplo, grabar una conversación confidencial pide el consentimiento de todas las partes (California Penal Code §632); en la Unión Europea necesitas una base legal e informar antes de grabar (RGPD, arts. 6 y 13). Antes de cada grabación, la hoja «Antes de grabar» te da un guion para leer o pegar en el chat y anota cómo avisaste. Resumi no recibe, guarda ni procesa tus grabaciones, así que no es responsable ni persona encargada de ese tratamiento (LFPDPPP, DOF 20 de marzo de 2025, art. 2, fracciones XII y XIV): lo eres tú. Tampoco tiene modo oculto: macOS muestra el indicador del micrófono y la app la grabación en curso.

¿Resumi sube mi audio o mi transcript a algún servidor?

No. Resumi graba, transcribe, busca y resume dentro de tu Mac; no tiene servidor, cuenta ni telemetría. Las únicas conexiones a internet que hace son para descargar modelos desde huggingface.co: el de transcripción (1.6 GB) cuando tú pulsas «Descargar», junto con el detector de voz Silero (menos de 1 MB, que se vuelve a bajar solo si falta), y los opcionales que actives: la IA local Qwen3 4B (2.5 GB) y el ahorro de batería (1.2 GB); y, solo cuando pulsas «Buscar actualizaciones» en Ajustes, leer un archivo público con el número de la versión más nueva. Ninguna de esas peticiones lleva nada tuyo. Puedes comprobarlo con lsof -i -n -P -a -c privatemeet: en uso normal no devuelve nada.

¿Distingue quién habla?

Por pista, no por voz. En una videollamada guarda en pistas separadas tu micrófono («Tú») y el audio del sistema («Ellos»), y así las marca en el transcript. No hay diarización: en una reunión presencial todo entra por el micrófono y queda como una sola voz. Puedes ponerle nombre a cada hablante después.

¿Puedo grabar sin audífonos?

Sí. Sin audífonos, la voz de los demás sale por las bocinas y vuelve a entrar por tu micrófono; al transcribir, Resumi quita ese eco de tu pista para que nada salga dos veces. Viene encendido y se apaga en Ajustes. Antes de grabar te dice qué salida y qué micrófono va a usar, y si conectas audífonos el aviso se quita solo.

¿Qué pasa si la app se cierra a media grabación?

El audio se va guardando mientras grabas. Si la app o la Mac se cierran, al abrirla de nuevo te ofrece recuperar lo interrumpido y lo transcribe; si no quieres, lo descartas y no vuelve a aparecer. Si el micrófono deja de oír a media junta, te avisa en ese momento, no al terminar.