Estábamos pidiendo a gritos una IA que viviera en nuestro escritorio sin molestar, y parece que Google ha tomado buena nota de ello. Tras unos cuantos meses afinando su propuesta, la gran G acaba de dar un golpe en la mesa de Apple. La última actualización de Gemini para macOS cambia por completo las reglas del juego en la interacción ordenador-usuario. Y lo hace atacando de frente el mayor cuello de botella de cualquier asistente actual: la fricción de tener que cambiar constantemente de ventana.

Ya no hace falta saltar del navegador a la app de turno para lanzar un prompt o hacer una consulta rápida. Tal y como han detallado en una publicación en el blog de Google, la integración en el entorno de Apple es ahora total y transparente. Básicamente, la inteligencia artificial se queda esperando en segundo plano, en silencio, hasta que realmente la necesitas para trabajar. Así de simple.

El truco de la tecla Fn que destroza al dictado tradicional

Aquí viene lo verdaderamente interesante para los que pasamos horas tecleando. Si tienes un Mac, puedes ir olvidándote de redactar párrafos interminables a mano. La nueva actualización permite que baste con mantener pulsada la tecla Fn de tu teclado para invocar a Gemini y empezar a darle instrucciones en voz alta.

Y es que el sistema que ha montado Google está a años luz del clásico dictado de voz integrado en el sistema operativo. El dictado tradicional se limita a transcribir y suele dejarte un texto lleno de errores si dudas un segundo o respiras cerca del micrófono. Gemini, por el contrario, actúa como un editor de texto en tiempo real.

También te puede interesar:La Gente está Usando el Editor de Fotos de Gemini para Eliminar Marcas de Agua

Si te trabas pensando, haces una pausa incómoda o sueltas el típico «ehhh…», la IA procesa ese audio, interpreta tus vacilaciones y limpia el texto automáticamente. El resultado final que se inyecta en el prompt es un mensaje directo, profesional y sin basura gramatical. Una auténtica locura para acelerar la productividad cuando tienes que redactar correos densos o responder hilos interminables en Slack.

Una IA que ve, analiza y entiende tu pantalla

Pero claro, hablarle al ordenador está muy bien, aunque la verdadera magia de los LLM modernos ocurre cuando entienden el contexto de lo que estamos haciendo. La nueva función de razonamiento visual permite a Gemini analizar directamente el contenido que tienes abierto en pantalla para ejecutar órdenes complejas sobre la marcha.

En concreto, el usuario puede seleccionar archivos sueltos, hojas de cálculo, documentos de texto o fotografías y pedirle al modelo que extraiga datos muy específicos de ellos. Ni siquiera tienes que molestarte en arrastrar el archivo dentro de la ventana de la IA. El modelo lee el contexto visual, lo procesa y te da la respuesta al instante.

Una IA que ve, analiza y entiende tu pantalla

A ello se le suma la capacidad de manipular el texto de otras aplicaciones en caliente. Imagina que tienes un borrador de un informe abierto. Solo tienes que seleccionar ese fragmento, pulsar Fn, y pedirle a la IA de Google que lo reescriba con un tono más agresivo o que le cambie el formato por completo. Lo hace sin inmutarse y sin romper tu flujo de trabajo.

También te puede interesar:La Gente está Usando el Editor de Fotos de Gemini para Eliminar Marcas de Agua
También te puede interesar:Google lanza las funciones de vídeo en tiempo real de Gemini

Evidentemente, esta lectura inteligente de la pantalla también se aplica al terreno multimedia. Gemini es capaz de identificar las imágenes que tienes a la vista e incluso generar versiones alternativas o ediciones basándose estrictamente en ese contexto visual que le acabas de proporcionar.

Un ecosistema pesado que exige hardware moderno

Quizás no lo recuerdes por el ritmo frenético de lanzamientos, pero la aplicación nativa de Gemini para los ordenadores de la manzana aterrizó originalmente en abril de 2026. En aquel momento, la propuesta ya presumía de un chat muy minimalista y atajos de teclado bastante cómodos, además de la opción de compartir ventanas enteras con el asistente.

Desde esa versión inicial, Google ha ido metiendo con calzador todo su arsenal tecnológico para crear el asistente definitivo. Hablamos de funciones muy pesadas a nivel de inferencia como Canvas, Deep Research o el Aprendizaje guiado. Todo esto sin olvidar las integraciones directas con su propia suite: Google Drive, Fotos y la siempre brillante herramienta NotebookLM.

La letra pequeña es que tanta potencia requiere una base sólida a nivel de software. Para que esta orquesta de dictado inteligente y análisis de pantalla funcione sin latencia, la aplicación requiere tener instalado macOS 15 Sequoia o una versión superior. Si tienes un Mac más antiguo que se ha quedado fuera de las actualizaciones, no podrás aprovechar estas novedades.

La actualización ya está disponible para descargar. La pelota está ahora en el tejado de OpenAI con su app de escritorio y, sobre todo, en el de Apple, que sigue desplegando su propia IA a cuentagotas. Lo que está claro es que el teclado y el ratón empiezan a tener compañía seria en nuestro día a día. Veremos cómo responde la competencia en los próximos meses.

0 0 votos
Valoración del artículo
Suscribirte
Notificar sobre
guest
0 Comentarios
Más Antiguos
Más Nuevos Más Votados