07 octubre 2024

Tecnología de reconocimiento facial en Harvard: estudiantes advierten sobre riesgos de privacidad

Tecnología de reconocimiento facial en Harvard: estudiantes advierten sobre riesgos de privacidad

Los estudiantes de la Universidad de Harvard son conocidos por estar un paso adelante, y dos de ellos están demostrando estar a la altura de su reputación.


Anhphu Nguyen y Caine Ardayfio crearon un software que puede revelar el nombre, dirección, número de teléfono y biografía de alguien a partir de una sola imagen.


Ambos han pasado años programando, y crear su última aplicación les tomó solo unos días. “Usamos una serie de fuentes de datos públicas para demostrar que es posible obtener información personal de alguien solo con su rostro”, dijo Anhphu Nguyen.


Escaneo envía imagen personal al teléfono


El dúo está usando los Ray-Ban de Meta, que tienen una cámara en la lente, para transmitir video en vivo a través de Instagram y el programa que crearon. En un minuto y medio, su escaneo de alguien puede devolver información personal directamente al teléfono.



Todo esto es legal. Existen algunas restricciones sobre cómo los gobiernos pueden usar esta tecnología, pero no para las personas. Esto fue algo que Nguyen y Ardayfio tuvieron en cuenta al crear el código, y esperan que los legisladores actúen pronto.


“Por eso dedicamos la mayor parte del tiempo, no a programar, sino a analizar las regulaciones de privacidad y ver cómo podemos ayudar a las personas a protegerse”, dijo Ardayfio.


“Una advertencia que retumba en todo el mundo”


El experto en ciberseguridad de WBZ, Peter Tran, dijo que los estudiantes habían creado una de las pruebas de concepto más claras para esta tecnología.


“Es literalmente una prueba de concepto”, comentó Tran. “Es una advertencia que retumba en todo el mundo. Estoy tanto emocionado como realmente asustado al punto de que probablemente no me deje dormir por la preocupación en términos de ciberseguridad”.


Los estudiantes han creado una razón para que las personas eliminen su información de bases de datos públicas en minutos. Pero Tran advirtió que, aunque privatices tu información en estos sitios, otros podrían aparecer con el tiempo.


Vía | Harvard students create app that reveals personal info using smart glasses - CBS Boston (cbsnews.com)


https://tecnologiaconjuancho.com/tecnologia-de-reconocimiento-facial-en-harvard-estudiantes-advierten-sobre-riesgos-de-privacidad/

Meta revoluciona la IA con Movie Gen: Crea videos y audio desde texto

Meta revoluciona la IA con Movie Gen: Crea videos y audio desde texto

Meta ha presentado Movie Gen, un nuevo modelo de inteligencia artificial que genera videos, imágenes y audio a partir de texto. También permite editar videos ya existentes.


En el núcleo de Movie Gen se encuentra un modelo transformador de 30 mil millones de parámetros para la generación de video e imágenes. Produce videos de hasta 16 segundos de duración a 16 fotogramas por segundo, con soporte para diferentes proporciones (1:1, 9:16, 16:9) en una resolución de 768 × 768 píxeles. Un escalador adicional permite aumentar la resolución a Full HD (1080p).


Un modelo independiente de 13 mil millones de parámetros se encarga de la generación de audio. Este puede crear sonido, música de fondo y efectos de sonido que coincidan con videos de hasta 45 segundos de duración a una frecuencia de muestreo de 48 kHz.


Movie Gen también incluye funciones de edición que pueden modificar videos existentes mediante instrucciones de texto. Otra característica permite crear videos personalizados al combinar una foto de una persona con una descripción de texto.


Meta afirma una ventaja en rendimiento 


Meta asegura que Movie Gen supera a modelos similares de empresas como Runway, Sora, LumaLabs, Kling y Pika en evaluaciones humanas. La diferencia es menor con Sora y Kling, que, según se informa, puede producir videos consistentes de hasta un minuto de duración a una tasa de fotogramas superior a la de Movie Gen.



La compañía entrenó los modelos usando conjuntos de datos con licencia y de acceso público. El modelo de generación de video fue preentrenado con unos 100 millones de videos y mil millones de imágenes. El modelo de audio utilizó aproximadamente un millón de horas de datos de audio.


Por ahora, Movie Gen está destinado a investigación y no está disponible al público. Meta planea trabajar con cineastas y creativos para recopilar comentarios antes de un posible lanzamiento.


La tercera generación de modelos de medios de IA de Meta 


Meta describe Movie Gen como la tercera generación de sus modelos de medios de IA, que combina modalidades previas y permite un control más preciso. La compañía cree que estos modelos podrían habilitar nuevos productos.


Sin embargo, Meta reconoce que los modelos actuales tienen limitaciones. En particular, el tiempo de inferencia y la calidad podrían mejorar con mayor escalado. Persisten desafíos con geometrías complejas, manipulación de objetos, física y sincronización de audio en movimientos densos u obstruidos.


Meta subraya que la tecnología no está pensada para reemplazar a artistas y animadores, sino para crear nuevas formas de expresión. Entre sus posibles aplicaciones menciona videos animados de "un día en la vida" para Instagram Reels o felicitaciones personalizadas de cumpleaños para WhatsApp.


Vía | Meta's new AI model "Movie Gen" brings text to life with video, image, and audio generation (the-decoder.com)


https://tecnologiaconjuancho.com/meta-revoluciona-la-ia-con-movie-gen-crea-videos-y-audio-desde-texto/

04 octubre 2024

Nuevo iPhone SE y iPad Air con Apple Intelligence: Lo que debes saber

Nuevo iPhone SE y iPad Air con Apple Intelligence: Lo que debes saber

Apple planea lanzar un nuevo iPhone SE con soporte para Apple Intelligence, nuevos modelos de iPad Air y un teclado Magic Keyboard actualizado para el iPad Air en algún momento a "principios del próximo año", según un informe de Mark Gurman de Bloomberg.



El próximo iPhone SE tendrá un diseño similar al iPhone 14, incluyendo una pantalla de borde a borde con una muesca, según Gurman. Esto significa que probablemente el dispositivo soportará Face ID, mientras que el actual iPhone SE tiene un botón de Touch ID. También se espera que el dispositivo sea compatible con Apple Intelligence, que actualmente está disponible en el iPhone 15 Pro, iPhone 15 Pro Max y cualquiera de los nuevos modelos del iPhone 16.


Los nuevos modelos de iPad Air aparentemente tendrán "mejoras internas", aunque Gurman no dio detalles específicos. También se espera una versión actualizada del Magic Keyboard para el iPad Air de 11 pulgadas y de 13 pulgadas, con algunas de las nuevas funciones que ya se introdujeron en la última versión del teclado para el iPad Pro.



Marzo y abril son meses habituales para que Apple anuncie nuevos modelos de iPhone SE y iPad Air, ya sea en un evento virtual o a través de comunicados de prensa.


Apple actualizó por última vez el iPhone SE en marzo de 2022, mientras que la línea de iPad Air se actualizó en mayo de este año con el chip M2 y el primer modelo de 13 pulgadas.


Vía | iPhone SE With Apple Intelligence, New iPad Air, and More Reportedly Launching 'Early Next Year' - MacRumors


https://tecnologiaconjuancho.com/nuevo-iphone-se-y-ipad-air-con-apple-intelligence-lo-que-debes-saber/

Google Revolutioniza la Búsqueda con IA: Encuentra Todo a tu Alrededor Fácilmente

Google Revolutioniza la Búsqueda con IA: Encuentra Todo a tu Alrededor Fácilmente

A lo largo de los años, hemos reinventado continuamente la Búsqueda de Google, para que puedas hacer preguntas de la manera que quieras: ya sea escribiendo una consulta, buscando con tu cámara o simplemente tarareando una melodía.


Las capacidades avanzadas de la IA han sido fundamentales para ampliar lo que puede hacer la Búsqueda, y nuestro modelo Gemini personalizado para Búsqueda ha mejorado nuestra capacidad de ayudar a las personas a descubrir más del internet y del mundo que las rodea. De hecho, las personas que usan Resúmenes de IA utilizan más la Búsqueda y están más satisfechas con sus resultados. Y Google Lens ahora se utiliza para casi 20 mil millones de búsquedas visuales cada mes, ayudando a las personas a buscar lo que ven con su cámara o en su pantalla.


Hoy estamos dando un gran salto con algunas de nuestras actualizaciones más importantes hasta la fecha en Búsqueda, utilizando IA para ampliar drásticamente cómo Google puede ayudarte, desde encontrar la información exacta que necesitas hasta explorar cualquier curiosidad que te surja.


Nuevas formas de buscar lo que ves (y oyes)


Desde que pioneros en la búsqueda visual con Lens hace años, hemos seguido mejorando la experiencia usando nuestros últimos avances en IA. A principios de este año, incorporamos IA generativa en Lens, para que puedas apuntar con tu cámara, hacer una pregunta y obtener un Resumen de IA con la información que necesitas, junto con enlaces para aprender más. Ya, muchas personas están encontrando esta función increíblemente útil. Esta característica ha aumentado el uso general de Lens, ya que la gente vuelve para obtener ayuda con preguntas más complejas.



Las consultas con Lens son ahora uno de los tipos de consulta de más rápido crecimiento en Búsqueda, y los usuarios más jóvenes (de 18 a 24 años) son los que más interactúan con Lens. Ahora, estamos introduciendo más capacidades a Lens para hacer que buscar el mundo que te rodea sea aún más fácil.


Comprensión de videos en Lens


En el I/O mostramos nuestras capacidades de comprensión de videos, y ahora puedes usar Lens para buscar grabando un video y haciendo preguntas sobre los objetos en movimiento que ves. Digamos que estás en un acuario y quieres saber más sobre algunos peces interesantes en una exhibición. Abre Lens en la app de Google y mantén presionado el botón de captura para grabar mientras haces tu pregunta en voz alta, como "¿Por qué nadan juntos?". Nuestro sistema entenderá el video y tu pregunta para ofrecerte un Resumen de IA, junto con recursos útiles de la web.


Esta función está disponible globalmente en la app de Google (Android y iOS) para los usuarios de Search Labs inscritos en el experimento “Resúmenes de IA y más”, con soporte para consultas en inglés.


Preguntas por voz en Lens


La opción de hacer preguntas con tu voz también está disponible cada vez que tomas una foto con Lens. Solo apunta con tu cámara, mantén presionado el botón de captura y pregunta lo que quieras, como si estuvieras señalando algo y preguntándole a un amigo sobre ello. La entrada por voz para Lens ya está disponible globalmente en la app de Google para Android e iOS, para consultas en inglés.


Actualizaciones de Lens para ayudarte a comprar lo que ves


También estamos facilitando la compra de lo que ves con Lens. Durante años, has podido usar Lens para encontrar productos visualmente similares de minoristas en la web. Pero a partir de esta semana, verás una página de resultados mucho más útil que muestra información clave sobre el producto que estás buscando, incluidos reseñas, información de precios en varios minoristas y dónde comprar.


Por ejemplo, si ves una mochila en el aeropuerto y quieres comprar una para ti, solo toma una foto y Lens combinará nuestros avanzados modelos de IA y el Shopping Graph de Google (que tiene información sobre más de 45 mil millones de productos) para identificar el artículo exacto. Así puedes aprender más sobre lo que te llama la atención y comenzar a comprar de inmediato.


Una nueva forma de identificar las canciones que escuchas


Ya sea en un video mientras navegas por redes sociales, en una película que estás viendo o en un sitio web que visitas, con nuestra última actualización de "Círculo para Buscar", puedes buscar instantáneamente las canciones que escuchas sin cambiar de aplicación. Y estamos expandiendo "Círculo para Buscar" a más usuarios con nuestra última expansión en Android: ahora está disponible en más de 150 millones de dispositivos Android.


Tu página de resultados de búsqueda, organizada con IA


A principios de este año, mostramos cómo la IA puede ayudarte a explorar y descubrir una mayor variedad de resultados en la web para aquellas preguntas que pueden ser abiertas o no tener una única respuesta correcta, como si estás buscando un aperitivo vegetariano para una cena.


Esta semana, estamos lanzando páginas de resultados de búsqueda organizadas con IA en los EE. UU., comenzando con recetas e inspiración culinaria en dispositivos móviles. Ahora verás una experiencia de página completa, con resultados relevantes organizados solo para ti. Puedes explorar fácilmente contenido y perspectivas de toda la web, incluidos artículos, videos, foros y más, todo en un solo lugar.


En nuestras pruebas, las personas han encontrado las páginas de resultados organizadas con IA más útiles. Y con estas páginas, estamos trayendo a las personas más formatos de contenido y sitios diversos, creando aún más oportunidades para que se descubra contenido.


Más conexiones a lo mejor de la web


Sabemos que las personas quieren ir directamente a la fuente para muchas de sus preguntas. Con la IA en Búsqueda, nos centramos en ayudar a las personas a descubrir contenido y perspectivas de una amplia gama de fuentes en la web.


Hemos estado probando un nuevo diseño para los Resúmenes de IA que agrega enlaces destacados a páginas web dentro del texto del Resumen de IA. En nuestras pruebas, hemos visto que esta experiencia mejorada ha aumentado el tráfico hacia las páginas de soporte en comparación con el diseño anterior, y la gente encuentra más fácil visitar los sitios que les interesan. Basándonos en esta recepción positiva, a partir de hoy estamos implementando esta experiencia globalmente en todos los países donde están disponibles los Resúmenes de IA.


Además, como compartimos en Google Marketing Live, hemos estado probando cuidadosamente anuncios en los Resúmenes de IA para consultas relevantes. Hemos visto que las personas encuentran útiles los anuncios dentro de los Resúmenes de IA porque pueden conectarse rápidamente con negocios, productos y servicios relevantes. Tras recibir comentarios positivos, estamos comenzando a llevar los anuncios en los Resúmenes de IA a los EE. UU. para consultas relevantes, para seguir conectando a las personas con los productos y marcas que les son útiles en sus búsquedas. Puedes leer más sobre esto en esta publicación.


Ya sea buscando con texto, audio, voz o imágenes, siempre hemos trabajado para ampliar el tipo de preguntas que puedes hacer en Google. Con la IA, seguimos reinventando cómo la Búsqueda puede ayudarte a obtener la información que necesitas rápidamente, y estamos emocionados de llevar estas experiencias a más personas en todo el mundo.


Vía | Google updates: AI-Organized Search, Google Lens, and more (blog.google)


https://tecnologiaconjuancho.com/google-revolutioniza-la-busqueda-con-ia-encuentra-todo-a-tu-alrededor-facilmente/

Quioscos robóticos Cofe+: Café más rápido, barato y sin contacto en Shanghái

Quioscos robóticos Cofe+: Café más rápido, barato y sin contacto en Shanghái

En Shanghái, se está gestando una revolución del café.


Philip Han, el fundador de Hi-Dolphin Robot Technology, cree que sus innovadores quioscos de café robóticos pueden transformar la forma en que las personas disfrutan su taza diaria de café.


Fundada en 2018, la empresa ha desarrollado “Cofe+”, un quiosco robótico autónomo que ofrece una experiencia de preparación de café completamente automatizada.


El Cofe+ presenta varias ventajas: es más rentable de operar, requiere poco mantenimiento y garantiza una calidad constante en el café.


https://twitter.com/COFEROBOT/status/1841055970111140048

Funciona las 24 horas


Este pequeño quiosco de café ofrece una variedad de opciones. Permite a los clientes elegir entre dos tipos de granos, dos tamaños de taza y tres opciones de temperatura (fría, caliente y con hielo).


Además, los clientes tienen control total sobre la intensidad del café, la temperatura, el nivel de dulzura y la cantidad de hielo. Este barista robótico de última generación tiene el potencial de servir más de 50 sabores.


Curiosamente, todo el sistema requiere menos de 2.5 metros cuadrados de espacio y pesa alrededor de 800 kg. También puede funcionar las 24 horas del día, los 7 días de la semana.


La pieza central del quiosco es un "brazo robótico de cuatro ejes" que realiza todo el proceso de preparación del café, desde llenar las tazas hasta entregarlas a los clientes. El robot maneja cada paso con precisión y eficiencia.



Según el South China Morning Post, la automatización del quiosco permite una preparación rápida del café, con un tiempo de elaboración de alrededor de 50 segundos. Tiene una capacidad diaria de aproximadamente 300 bebidas.


El Cofe+ es limpio e higiénico. Está cerrado con vidrio y cuenta con protección incorporada contra insectos y bacterias. También tiene funciones de autolimpieza y mantiene la leche a una temperatura constante.


“El quiosco robótico de café COFE+ está completamente cerrado para la esterilización y eliminación de polvo, desinfecta y limpia de manera inteligente, y funciona las 24 horas del día. Puede producir continuamente entre 200 y 300 tazas con un solo recambio, requiriendo solo 30 minutos de mantenimiento al día”, señaló la página web.


La empresa destaca el ahorro de costos como la principal ventaja de usar quioscos de café robóticos. Hi-Dolphin afirma que operar un quiosco completamente automatizado es aproximadamente un 90% más barato que manejar una cafetería tradicional. Además, requiere menos personal.


Curiosamente, cada quiosco puede ser reabastecido y preparado para funcionar en menos de 30 minutos, permitiendo que una persona encargada de mantenimiento maneje hasta 10 quioscos al día.


https://youtu.be/YW1Jre3Fj0s

Más de 500 ubicaciones


Según el sitio web, el quiosco ha pasado por cinco iteraciones de producto, lo que refleja mejoras continuas en su diseño y funcionalidad.


El Cofe+ ofrece una manera conveniente y sin contacto de pedir un café. Simplemente seleccionas la bebida que deseas, pagas y esperas unos segundos para que tu bebida esté lista.


Su diseño compacto y versatilidad lo hacen ideal para una amplia variedad de entornos.


Se ha instalado en más de 500 ubicaciones, incluidos hospitales, museos, librerías, templos, puntos turísticos y centros de investigación en China.


Según SCMP, Hi-Dolphin cree que sus quioscos robóticos de café pueden ayudar a las cafeterías chinas a sobrevivir a la recesión económica. Muchas cafeterías en China han cerrado debido a la difícil situación económica, pero la tecnología de Hi-Dolphin ofrece una posible solución.


Vía | China's 'Cofe+' robot baristas brewing fast, cost-effective coffee (interestingengineering.com)


https://tecnologiaconjuancho.com/quioscos-roboticos-cofe-cafe-mas-rapido-barato-y-sin-contacto-en-shanghai/

03 octubre 2024

Protege tu identidad: la verdad sobre fraudes con IA y deepfakes

Protege tu identidad: la verdad sobre fraudes con IA y deepfakes

A medida que la tecnología avanza, también lo hace el fraude, y eso es especialmente cierto con la innovación más comentada del momento: la inteligencia artificial (IA). Hoy en día, la IA está de moda, ya sea como una nueva función en el último modelo de celular, una herramienta para generar imágenes o una forma de crear podcasts en segundos.


Lamentablemente, la IA también es popular en el mundo criminal. Muchos estafadores la utilizan en distintos tipos de fraudes, como una llamada con un supuesto familiar llorando que suena muy real y parece haber sido secuestrado, una factura falsa por una compra de criptomonedas, o una estafa que ha afectado a la comunidad de tejido y crochet, impulsada por IA.


Según un estudio reciente de Censuswide, más del 25% de las personas afirmaron haber sido víctimas de un fraude relacionado con el robo de identidad. La mayoría de estas personas culpó a la IA.


Aunque la estafa que sufrieron puede no haber sido causada directamente por IA, su mayor preocupación para el futuro es el uso de “deep fakes”. Al preguntarles sobre la mayor amenaza para la seguridad de su identidad, el 78% mencionó el mal uso de la IA.



Hasta el 70% de los encuestados dijo que se encuentra con contenido manipulado por IA al menos una vez por semana. Menos de la mitad de las personas encuestadas afirmó sentirse lo suficientemente segura como para detectar cuándo algo era falso creado por IA.


Estos datos muestran que, aunque la IA parece estar en todas partes, muchas personas se dan cuenta de que también conlleva grandes riesgos.


Entonces, ¿cuál es la solución? Más de la mitad (55%) de los encuestados cree que la tecnología actual no es suficiente para proteger nuestras identidades y que más avances tecnológicos son la mejor opción para detectar deepfakes. Otro gran grupo (45%) cree que las opciones legales, como regulaciones y leyes más estrictas para la IA, son el camino correcto.


Está claro, según la investigación, que las personas comprenden los peligros de la IA. Sin embargo, también sienten que no tienen suficiente conocimiento para enfrentarlos y no confían completamente en otras tecnologías para ayudar. Los resultados son una advertencia de que todos deberíamos ser más cautelosos.


Vía | 1 in 4 people have experienced identity fraud - and most of them blame AI | ZDNET


https://tecnologiaconjuancho.com/protege-tu-identidad-la-verdad-sobre-fraudes-con-ia-y-deepfakes/

Microsoft lanza Copilot Voice: un asistente de voz gratis y eficiente

Microsoft lanza Copilot Voice: un asistente de voz gratis y eficiente

Aunque los chatbots de IA parecían la tecnología más avanzada hace solo dos años, los asistentes de IA multimodal son ahora la nueva frontera, con empresas lanzando rápidamente asistentes de voz impulsados por IA. Microsoft es la más reciente en unirse a esta carrera.


El martes, Microsoft presentó una versión actualizada de Copilot, destacando especialmente la inclusión de Copilot Voice, un asistente de voz que puede ser interrumpido para tener conversaciones continuas contigo y responder a tus emociones.


Copilot Voice tiene cuatro voces diferentes: Wave, Meadow, Grove y Canyon. Está disponible en todas las plataformas donde puedas acceder a Copilot, incluyendo la app, el sitio web y Windows. ¿La mayor ventaja? Es gratuito para todos los usuarios.


Esto significa que, a diferencia del Modo de Voz de ChatGPT, no necesitas gastar $20 al mes en una membresía premium de IA para usarlo. Aunque el asistente de Google, Gemini Live, también es gratuito con la app de Gemini, está limitado solo a usuarios de Android, mientras que Copilot Voice no lo está.



Entonces, ¿qué tan bien funciona en una conversación? Hoy tuve la oportunidad de probarlo en el evento de Microsoft Copilot y Windows en Nueva York, y me dejó impresionado.


Al conversar con la opción de voz "Wave," una voz masculina y animada, me sorprendió lo entusiasta que fue el asistente desde el principio. A pesar del ruido de fondo, entendió claramente cada palabra que dije, incluso sin tener que pronunciar cada palabra con cuidado como normalmente lo haría con un asistente de voz.


También llevó la conversación con respuestas rápidas, ingeniosas y, quizás lo más importante, oportunas, sin perder el ritmo. Las respuestas también eran relevantes en contexto, algo que suele ser un problema con los asistentes de voz, que no siempre entienden la intención de lo que dices y, como resultado, dan respuestas extrañas.


En una demostración diferente, una representante de Microsoft pidió a Copilot Voice que la ayudara a resolver el problema de querer adoptar un perro sin que su pareja estuviera de acuerdo. Copilot Voice trabajó diligentemente en el problema, haciendo preguntas de seguimiento para entender mejor la situación y ofreciendo soluciones bastante sólidas, comparables a lo que sugeriría un ser humano.


Entonces, la pregunta clave: ¿cómo se compara con Gemini Live y el Modo de Voz de ChatGPT? En mi experiencia, lo encontré igual de bueno, funcionando de manera casi idéntica. La única gran diferencia es que cualquiera puede aprovecharlo sin tener que pagar una suscripción o poseer un dispositivo específico, lo cual es una ventaja para mí.


El despliegue del Modo de Voz comienza hoy. Si estás interesado en acceder a él, crea una cuenta de Microsoft, descarga la app gratuita de Copilot si planeas usarlo en tu teléfono, o actualiza la app si ya la tienes instalada.


Al momento de escribir esto, tengo acceso a la versión actualizada de Copilot en mi iPhone 16 Pro desde mi cuenta gratuita.


Vía | Copilot Voice beats Gemini Live and ChatGPT's Voice Mode in one big way | ZDNET


https://tecnologiaconjuancho.com/microsoft-lanza-copilot-voice-un-asistente-de-voz-gratis-y-eficiente/

Apple Intelligence retrasado: ¿La privacidad frena su IA?

Hasta los usuarios más fieles de Apple admiten que la compañía va atrasada en inteligencia artificial. La gran actualización de Siri con App...