miércoles, 21 de diciembre de 2022
Las cuatro cosas que jamás debes cocinar en tu freidora de aire
via Tecnología https://ift.tt/3RG4kNZ
lunes, 19 de diciembre de 2022
ChatGPT no será gratis para siempre. OpenAI espera que genere 1.000 millones de dólares en 2024, según Reuters

ChatGPT es una de las aplicaciones del momento. Su sorprendente capacidad para responder a casi cualquier cosa que se le pida está siendo utilizada para una amplia variedad de tareas. Desde resumir reuniones hasta crear videojuegos en 2D. Sin embargo, todo parece indicar que las bondades de esta herramienta desarrollada por OpenAI no siempre serán gratuitas.
De acuerdo a Reuters, la compañía dirigida por Sam Altman espera que la tecnología subyacente del popular ChatGPT se convierta en uno de sus pilares económicos. En otras palabras, las proyecciones destinadas a los inversionistas señalan que GTP-3.5 podría generar 200 millones de dólares en ingresos el próximo año y 1.000 millones de dólares en 2024.
En busca del músculo financiero
OpenAI, fundada en 2015 por varios inversionistas entre los que se encontraban Elon Musk (que se retiró en 2018) todavía es una compañía pequeña en comparación con las Big Tech. Bajo su status de startup, en 2018 recibió una inversión de 1.000 millones de dólares por parte de Microsoft para impulsar sus desarrollos, entre los que se encuentran DALL-E y GPT.
Con el paso de los años, y especialmente en los últimos meses, estos modelos han pasado de ser una primitiva expresión de las posibilidades de la inteligencia artificial a soluciones reales que se han puesto a disposición del público. El propio Altman reconoce este escenario con la siguiente reflexión: “una vez que comienza una revolución tecnológica, no se puede detener”.
Así, todo parece indicar que la “revolución tecnológica” de la IA estimulada por OpenAI puede traducirse en un importante salto en los balances trimestrales de la compañía. DALL-E 2 ya es un producto comercial. Los usuarios reciben una determinada cantidad de créditos gratuitos, pero si quieren seguir usando la herramienta deben comprar más créditos.

El modelo de lenguaje GPT-3 también aporta a los ingresos de OpenAI. La compañía licencia el uso de su tecnología a diferentes compañías para su uso en apps como Synthesia, Jasper y Canva Docs, pero el salto en las capacidades de GPT-3.5, el corazón de ChatGPT, y la futurible llegada de GPT-4, podría atraer a nuevos clientes si se lanzan comercialmente.
OpenAI no ha hecho comentarios sobre la supuesta estrategia difundida por la agencia de noticias. No obstante, Altman sí ha sugerido que ChatGPT podría dejar de ser gratuito. El consejero delegado de la compañía dijo que los costes relacionados a la infraestructura en la nube para mantener en funcionamiento el programa “son deslumbrantes”.
“Tendremos que monetizarlo de alguna manera en algún momento”, dijo el ejecutivo, dando luz sobre el futuro de ChatGPT. La herramienta, recordemos, de momento se encuentra en fase de desarrollo y liberarla al público ha sido parte de la estrategia de OpenAI para refinar sus habilidades. Aparentemente, el chatbot también aspira a convertirse como tal en una app comercial.
Imágenes: Destacada generada con DALL-E | OpenAI | Boris Dayma
En Xataka: Stack Overflow acaba de prohibir las respuestas de ChatGPT: esto es lo que ha sucedido
via Robótica e IA - Xataka https://ift.tt/3u2Sh4G
viernes, 16 de diciembre de 2022
Esta empresa ha creado un chatbot de IA capaz de hablar con atención al cliente por ti y conseguir descuentos

Comunicarnos con los servicios de atención al cliente, por lo general, no suele ser la tarea más agradable de nuestras vidas. Entre los minutos que tenemos que esperar hasta que nos contesten y las posibles demoras en resolver nuestras reclamaciones, podemos llegar a perder bastante tiempo y paciencia.
La inteligencia artificial, que bajo nuestras órdenes ya puede diseñar, escribir, sugerir código y hasta tocar la batería, también puede ayudarnos con nuestras comunicaciones con los servicios de atención al cliente. Además, en ciertos casos, es capaz de conseguir que paguemos menos en la próxima factura.
El chatbot que consigue descuentos
La herramienta, que todavía no tiene nombre, es el más reciente desarrollo de DoNotPay, una compañía estadounidense que tiene distintos productos impulsados por IA, como uno que ayuda a los usuarios a recurrir sus multas de aparcamiento. Ahora también renegocia facturas y cancela servicios.
En una serie de mensajes publicados en Twitter, el consejero delegado de la compañía, Joshua Browder, demostró las capacidades del chatbot. La IA se contactó con servicio al cliente de la compañía de telecomunicaciones Comcast y consiguió un descuento de 10 dólares en la próxima factura del servicio de Internet de Xfinity.
Según explica el ejecutivo, el chatbot habló en nombre de uno de sus ingenieros y, para conseguir los beneficios, “exageró las interrupciones de Internet, de forma similar a como lo haría un cliente”. De hecho, según podemos ver en la conversación, la IA amenazó con emprender acciones legales por los “problemas de servicio”.
Here it is! The first ever Comcast bill negotiated 100% with A.I and LLMs.
— Joshua Browder (@jbrowder1) December 12, 2022
Our @DoNotPay ChatGPT bot talks to Comcast Chat to save one of our engineers $120 a year on their Internet bill.
Will be publicly available soon and work on online forms, chat and email. pic.twitter.com/eehdQ5OXrl
DoNotPay señala que su chatbot todavía tiene que mejorar, pero asegura que lanzarán una versión comercial que permitirá a los usuarios utilizarlo en formularios en línea, chats y correo electrónico. La compañía, no obstante, no ha indicado una fecha específica para el despliegue de esta herramienta.
El "cerebro" detrás de esta herramienta no es otro que GPT-3, el modelo de lenguaje autorregresivo de OpenAI que está siendo implementado en distintos productos y servicios. Una de las compañías más recientes en adoptarlo ha sido Canva, precisamente como asistente en su herramienta de redacción de textos.

Con este tipo de herramientas apareciendo en escena, surgen algunas preguntas sobre las futuras dinámicas de los servicios de atención al cliente. Algunos usuarios han expresado su preocupación que, en caso de popularizarse, las compañías endurezcan sus términos para ofrecer posibles descuentos a los clientes.
Por otra parte, surge la posibilidad curiosa posibilidad de que un chatbot contratado por un cliente se conecte con un chatbot de la compañía que se quiere obtener el descuento. ¿Quién ganaría? ¿El chatbot mejor entrenado? Con el tiempo sabremos si este escenario termina haciéndose una realidad.
En Xataka: Stable Diffusion nos alucinó con sus imágenes. Ahora resulta que también es capaz de generar música
Imágenes: Owen Beard | Omer Shahzad | Flaticon | Pngmart
En Xataka: Los programadores ya alucinaban con CoPilot y ChatGPT, pero ahora DeepMind va más allá con AplhaCode
via Robótica e IA - Xataka https://ift.tt/DkLVf3l
Stable Diffusion nos alucinó con sus imágenes. Ahora resulta que también es capaz de generar música

DALL·E 2, Midjourney y sobre todo Stable Diffusion se han convertido en un verdadero fenómeno que ha sacudido el mundo de arte y el diseño y ha permitido a cualquiera generar imágenes sorprendentes gracias a la inteligencia artificial. Las aplicaciones parecían fantásticas en esa disciplina artística, pero unos desarrolladores nos han dado una sorpresa y han ido un poco más allá.
Riffusion. Así se llama el modelo de inteligencia artificial que es una pequeña variación de Stable Diffusion y que genera música. Riffusion ha sido creado "como un hobby) por dos desarrolladores que aprovechan su capacidad para generar unas imágenes muy especiales.

Hola, espectrograma. Stable Diffusion no solo puede generar imágenes al estilo de cualquier artista: si uno se lo manda, puede generar curiosos espectrogramas. Estas singulares representaciones del espectro de una señal tienen la particularidad de que se pueden convertir en clips de audio.
Del texto al sonido. Los 'prompts' o descripciones de imagen que le damos a Stable Diffusion acaban por tanto convirtiéndose en música, y como explican los desarrolladores, el procesado de audio se realiza de forma transparente con un modelo basado en Torchaudio que además puede crear "variaciones infinitas" al ir haciendo que la "semilla" —el prompt original— cambie ligeramente.
Pequeños clips que se hacen grandes. Los espectrogramas generan clips de audio de apenas cinco segundos, pero los desarrolladores querían "ritmos infinitos generados por IA".
Para ello lo que hacían era, a partir de un espectrograma inicial, ir variando esa semilla para que la música fluyera de forma continua. Aplicaron además una serie de técnicas para que los espectrogramas fueran demasiado distintos y las transiciones fueran suaves.
Prueba en la web o instálatelo. Los desarrolladores tienen un singular generador de melodías en el sitio web del proyecto, pero el código está disponible en GitHub y solo necesitas un equipo con una GPU decente para generar este tipo de melodías en apenas unos segundos.
No compondrá bandas sonoras, pero... La música creada probablemente no vaya a ganar premios de la crítica, pero una vez más puede ser utilizada como inspiración o "borrador" para el compositor humano, que puede elaborar melodías con o sin letra a partir de ella. Eso sí: Esto plantea una potencial amenaza a la industria musical.
via Robótica e IA - Xataka https://ift.tt/HuN2DtO
Google tiene LaMDA para enfrentarse a ChatGPT, pero no lo sacará del laboratorio para no dañar su reputación

ChatGPT lleva poco más de dos semanas entre nosotros, pero gran parte de Internet está hablando de él. Las sorprendentes capacidades del chatbot de OpenAI han ayudado a que el programa de inteligencia artificial se convierta rápidamente en un fenómeno viral, poniendo a prueba las capacidades de la infraestructura en la nube que permite su funcionamiento.
Durante todos estos días se ha especulado bastante sobre el futuro de los modelos de lenguaje avanzados, como GPT-3.5, que es el corazón de ChatGPT. Algunas personas, incluso, creen que esta tecnología conversacional podría reemplazar a los buscadores tradicionales en muchos casos. Google, sin embargo, cree que es demasiado pronto como para adoptar esta herramienta.
Un problema de reputación
De acuerdo a CNBC, el consejero delegado de Alphabet, Sundar Pichai, abordó junto al jefe de inteligencia artificial de Google, Jeff Dean, el fenómeno de ChatGPT. En la reunión, un empleado preguntó si el programa de OpenAI podría significar “una oportunidad perdida” para el buscador de la compañía. Los ejecutivos dejaron en claro la postura actual de la compañía.
Pichai y Dean señalaron que Alphabet debe actuar “de manera más conservadora que una empresa emergente” debido a los “riesgos de reputación” relacionados al estado actual de los modelos de lenguaje de inteligencia artificial. No obstante, los ejecutivos no olvidaron de señalar que sí están trabajando activamente para adoptar esta tecnología.
“Estamos absolutamente buscando convertir estas cosas en productos reales y en cosas que presenten de manera más prominente el modelo de lenguaje en lugar de debajo de las cubiertas”, dijo Dean. Pichai, por su parte, aseguró que Google tiene “mucho” planeado con este tipo de tecnología para el año que viene, aunque remarcó que trabajarán cautelosamente.
Pichai y Dean, al menos según el artículo de CNBC, no profundizaron sobre los problemas específicos que pondrían en riesgo la reputación de la compañía, pero los propios desarrolladores de estas herramientas de inteligencia artificial admiten que su funcionamiento incluye sesgos, respuestas incorrectas y todavía tienen problemas para moderar el contenido peligroso.

Ahora bien, no debemos olvidar que OpenAI no es la única compañía que ha hecho avances significativos en el campo de los bots conversacionales. Google es un peso pesado en este campo, aunque ha sido mucho más cautelosa en publicar sus avances y, de momento, no ha puesto a disposición del público las capacidades de sus modelos más avanzados.
La compañía del buscador ha destinado una gran cantidad de recursos en entrenar grandes modelos de lenguaje que estarían a la altura de GPT-3,5, como MUM y LaMDA. En relación a este último, recordemos, que un ingeniero de Google había asegurado que la herramienta estaba cobrando “cierta conciencia”, e incluso acabó publicando lo que él aseguraba que eran las charlas.
Google, por su parte, reaccionó con contundencia. Dijo que las afirmaciones del ingeniero eran “totalmente infundadas” y aseguró que había hecho pública información confidencial de la empresa sobre sus investigaciones en materia de inteligencia artificial. La respuesta de la compañía fue despedirlo.
Puede Google no abrace inmediatamente estos modelos de IA, pero si algo queda claro en todo este asunto es que la inteligencia artificial ha llegado para quedarse. Ya sea como bots conversacionales, como asistentes de programación o como generadores de imágenes a partir de texto. Se avecinan tiempos de muchos cambios y, también, de grandes desafíos.
Imágenes: Google | Gertruda Valaseviciute
via Robótica e IA - Xataka https://ift.tt/msgCTjf
jueves, 15 de diciembre de 2022
Hay una IA para cancelar el ruido al comer patatas fritas. La hemos probado con unos Doritos, Chettos y Ruffles

¿Sabéis qué hay mejor que tener un par de horas (o más) para viciar a tu juego favorito? Jugar y picar algo entre y durante partida y partida. Que sí Jose Miguel, que tú tienes una vida y no pasas tus horas delante del ordenador jugando al 'WoW' y comiendo Doritos, pero algunos disfrutamos de estos pequeños placeres de la vida.
En fin, volviendo al tema. ¿Cuál es el problema de picar algo mientras juegas? Que se te llenan los dedos de grasa y pizcos (salvo que te comas una pera, que bueno, no es lo normal) y, por supuesto, que tus compañeros de escuadra seguramente estén deseando saber donde vives para ir a decirte de forma muy respetuosa que dejes de comer patatas mientras hablas por Discord.
¿Y cómo solucionamos este problema? ¿Cómo hacemos que la gente pueda seguir comiendo Doritos mientras juega a 'Warzone 2.0' sin que el chat de voz se llene de ñams, cracks, crunchs y demás sonidos al masticar? Pues Doritos ha tenido una idea: un sistema basado en inteligencia artificial bautizado Doritos Crunch Cancellation. Y sí, lo hemos probado.
Lo primero: cómo funciona el filtro antidoritos

Antes de poner a prueba esta tecnología, no está de más repasar cómo funciona. Muy grosso modo, una inteligencia artificial necesita mucha información para aprender a hacer algo. Por ejemplo, imaginemos que queremos enseñarle a una IA a dibujar un árbol. ¿Cómo lo hacemos? La entrenamos con miles y miles y miles de imágenes de árboles para que sepa qué es un árbol, cuál es su estructura, etc. Insisto, esto es en términos muy generales, la realidad es bastante más compleja.
Pues con los sonidos es igual. Si queremos que la IA sepa detectar y, en este caso, filtrar un sonido tan característico como puede ser el crack al comer Doritos, "simplemente" tenemos que exponerla a cuántos más cracks diferentes, mejor. Eso es, más o menos, lo que han hecho Doritos y Glassworks a través de su departamento Glassworks Labs para desarrollar esta, cuanto menos, curiosa funcionalidad que no deja de ser parte de una campaña de publicidad ideada por la agencia TWBA.
Para desarrollar el software, Doritos pidió a los usuarios que enviasen vídeos o audios comiendo Doritos (el llamado "Casting de crujidos"). Con esos clips (y algo más, como veremos enseguida), Glassworks (la compañía que hay detrás de esta tecnología) se encargó de desarrollar el sistema. El desarrollo ha llevado cuatro meses y se ha usado como base una biblioteca de NVIDIA: Maxine.

El software se puede descargar de forma totalmente gratuita desde la web de Doritos previa cumplimentación de un formulario. Es compatible solo con Windows 10/11 y requiere de una tarjeta gráfica NVIDIA RTX 20 o 30 para funcionar. Una barrera de entrada, sin duda, pero por una razón sencilla: la librería Maxine de NVIDIA.
Según nos explican Xavi Tribó (Director Tecnológico en Glassworks) y Clara Titos (Producer en Glassworks), el software desarrollado para Doritos está basado en la librería Maxine de NVIDIA, cuyo SDK es compatible con las arquitecturas Turing, Ampere y Ada. Si bien es cierto que los crujidos enviados por los usuarios se han usado para entrenar al modelo, la mayor parte de la magia recae en manos del SDK de NVIDIA. Si el nombre de Maxine te resulta familiar es posible que se deba a que hayas usado NVIDIA Broadcast, puesto que usa la misma biblioteca.
Básicamente, el software ejecuta la inteligencia artificial en tiempo real con un retraso de 25 milisegundos, algo que desde Glassworks aseguran es inapreciable en el uso. El software recoge 1.000 muestras de audio por segundo y lo envía a la gráfica, que se encarga de ejecutar los algoritmos en tiempo real. La gráfica hace uso de los Tensor Core para este proceso (y no precisamente bajo), de ahí que se requiera una gráfica de la serie 20 o 30 de NVIDIA. La RTX 40 también debería funcionar, pero es más nueva.
Y ahora que ya conocemos mejor el sistema, toca la parte divertida: comer Doritos y, ya que estamos, merendar ver si funciona con otras patatas.
Doritos, otros snacks e inteligencia artificial, a prueba

Para poner a prueba la tecnología de Doritos he hecho una prueba bastante sencilla: una cata en directo. Para amenizar la jornada, me he abierto un paquete de Doritos, uno de Ruffles Jamón y unos Cheetos Pandilla, así podemos ver cómo rinde la IA en diferentes situaciones.
El software que hemos usado para capturar imagen y sonido es OBS. El sistema funciona mediante un cable virtual que se instala en el proceso de instalación principal. Simplemente hay que seleccionar Cable Input como dispositivo de entrada. Dicho lo cual, he aquí el resultado (¿nos seguís ya en Twitch, por cierto?). Durante el vídeo, podéis ver cuándo y qué patatas estoy comiendo y que tal se comporta el software según lo hayamos configurado.
Como podemos comprobar, el software funciona sorprendentemente bien independientemente de los snacks que comamos porque, como vimos anteriormente, no es una cuestión de haber entrenado el modelo sola y exclusivamente con sonidos de Doritos, sino que la librería Maxine de NVIDIA es capaz de ir mucho más allá.
De hecho, no solo cancela el crujido al comer, sino también las palmas, los chasquidos de dedos, etc. La cosa es que este mismo resultado se puede conseguir con NVIDIA Broadcast porque, recordemos, usa la misma librería que el software de Doritos. Tendremos que esperar para ver si este proyecto tiene más continuidad y si hay más versiones o implementaciones, pero lo que queda claro es que funcionar, funciona.

Tiene sus cosas, evidentemente: el software no es perfecto. Si hablamos a la misma vez que hacemos ruidos estridentes, nuestra voz tiende a ser más metálica o incluso a no escucharse bien.
Más allá de la curiosidad del software, lo que realmente llama la atención es el avance que está teniendo la tecnología de inteligencia artificial en tiempo real. Ya no es solo que sea posible cancelar el ruido con un delay inexistente, sino que Maxine es capaz, por ejemplo, de corregir nuestros ojos durante las videollamadas. ¿Hasta dónde llegará esta tecnología? No lo sabemos, pero lo que es seguro es que nos depara cosas muy interesantes.
PD: dejo una idea gratuita para desarrolladores: desarrollar un software que sea capaz de eliminar en tiempo real los brillos provocados por los focos en las gafas. Atentamente: alguien que hace TikTok y streaming y está cansado de tener un brillo verde en la cara todo el rato.
via Robótica e IA - Xataka https://ift.tt/OE0Sfob
martes, 13 de diciembre de 2022
Estamos utilizando tanto ChatGPT que hemos saturado sus servidores. No es tan mala noticia

‘Network error’, ‘Too many requests’, ‘Internal server error’. Los servidores de ChatGPT no dan a basto y la aplicación que causa furor por estos días en Internet ha empezado a dar fallos. Al momento de escribir este artículo, muchos de los usuarios que intentan probar el modelo de generación de texto basado en GPT-3.5 se encuentran con algunos de los mencionados mensajes de error.
Las enormes capacidades de ChatGPT, que es capaz de responder a casi cualquier cosa, recordar y conectar ideas, no tardaron en conquistar a los internautas. Algunos motivados por la curiosidad, y otros con la intención de utilizar la herramienta para crear obras creativas, han provocado una avalancha de solicitudes a los servidores de OpenAI. En concreto, más de un millón de usuarios en siete días.
ChatGPT al límite por la afluencia de usuarios
La inestabilidad de ChatGPT, que empezó hace aproximadamente una semana, ha escalado junto con el creciente número de usuarios. Como podemos ver en Reddit, uno de los primeros movimientos de OpenAI para mantener la aplicación en funcionamiento ha sido limitar el ritmo de solicitudes que pueden enviar los usuarios. Es decir, si se hacen demasiadas preguntas, ChatGPT se bloquea por algunos minutos.
“Esto es tan increíble que quiero usarlo una y otra vez, pero no puedo”, decía un usuario que se lamentaba de no poder pagar para utilizar el sistema libremente. Pero esta no es la única restricción. Si las respuestas son demasiado largas, ChatGPT simplemente colapsa arrojando el mensaje ‘Network error’, obligando a los usuarios utilizar algunas técnicas para seguir obteniendo respuestas extensas.
La conversación sobre los problemas también se trasladó también a Stack Exchange. En esa plataforma de preguntas y respuestas, algunos programadores que utilizan la herramienta para obtener código sugieren indicarle al modelo que muestre las primeras 10 o 20 líneas de texto, y el resto a continuación. La solución, sin embargo, no parece ser completamente útil en todos los casos.
Recordemos que ChatGPT, en combinación con otras herramientas de inteligencia artificial, ha empezado a ser utilizada para una enorme cantidad de tareas. Mientras que algunos usuarios se divierten haciendo preguntas y obteniendo respuestas, otros se han aventurado hasta a “coescribir libros” con la herramienta de generación de texto.

Más allá de las cuestiones legales y éticas que podrían llegar a envolver el uso de ChatGPT y la inteligencia artificial, nos estamos acostumbrando a implementar en una amplia cantidad de escenarios una herramienta que se encuentra en fase de pruebas. No estamos, de momento, ante una versión definitiva de GPT-3.5. Sin embargo, el éxito que está teniendo se traduce en una altísima probabilidad de que sea viable comercialmente.
Ya lo hemos visto con DALL-E, el popular modelo de generación de imágenes a partir de texto de OpenAI. Los usuarios tienen una cierta cantidad de créditos gratuitos para utilizarlo, una vez agotados deben comprar más para seguir haciendo creaciones. ChatGPT podría adoptar un modelo dse negocio similar en el futuro, obligando a los usuarios a pagar para seguir utilizando la herramienta después de cierta cantidad de preguntas.
GPT-3.5, el modelo de lenguaje autorregresivo detrás de ChatGPT, también podría convertirse en parte de distintas herramientas o servicios de pago. Canva, la popular suite de diseño online, acaba de incorporar el hermano menor de este modelo en Canva Docs. La herramienta permite algunos usos gratuitos, pero después obliga a sacar la cartera.
Tampoco debemos olvidar el rol que ocupa Microsoft en OpenAI y, particularmente, en ChatGPT. Los de Redmond y la empresa de inteligencia artificial unieron fuerzas en 2019 con una inversión de 1.000 millones de dólares por parte de la primera. Producto de este acuerdo, como señala la compañía dirigida por Sam Altman, Microsoft Azure es el proveedor exclusivo de servicios en la nube de OpenAI.
Con esta ventaja, Microsoft también se perfila como candidato para implementar GPT-3.5, o la futura versión GPT-4, en algunos de sus productos. Y los de Redmond parecen bastante entusiasmados en abrazar la inteligencia artificial de OpenAI. Microsoft Designer, por ejemplo, adoptó DALL-E para permitir la generación de imágenes a partir de texto, y este podría ser solo el comienzo. Asistentes de voz o el propio buscador Bing podrían beneficiarse con los últimos modelos de lenguaje autorregresivo.
De momento, no sabemos hasta cuándo OpenAI permitirá acceder de forma gratuita a la versión de prueba de ChatGPT. En cualquier caso, la compañía se ha comprometido a aumentar la capacidad de su infraestructura (que es Microsoft Azure) para mejorar la estabilidad de la herramienta a medida que la cantidad de usuarios crece. Por consecuencia, algunos de los problemas podrían resolverse próximamente.
Imágenes: OpenAI | Mahdis Mousavi
via Robótica e IA - Xataka https://ift.tt/5Cu9ZAa



