{"id":128852,"date":"2023-01-16T13:15:19","date_gmt":"2023-01-16T21:15:19","guid":{"rendered":"https:\/\/www.feeling.com.mx\/site\/?p=128852"},"modified":"2023-01-16T13:15:19","modified_gmt":"2023-01-16T21:15:19","slug":"vall-e-la-inteligencia-artificial-que-simula-cualquier-voz-con-solo-tres-segundos-de-audio","status":"publish","type":"post","link":"https:\/\/www.feeling.com.mx\/site\/128852\/vall-e-la-inteligencia-artificial-que-simula-cualquier-voz-con-solo-tres-segundos-de-audio.html","title":{"rendered":"VALL-E, la Inteligencia Artificial que simula cualquier voz con solo tres segundos de audio"},"content":{"rendered":"<p><a href=\"http:\/\/www.feeling.com.mx\/img\/2022\/06\/61808aca4759f.jpeg\"><img loading=\"lazy\" src=\"http:\/\/www.feeling.com.mx\/img\/2022\/06\/61808aca4759f.jpeg\" alt=\"Inteligencia Artificial\" class=\"aligncenter size-full wp-image-116591 img-responsive \" srcset=\"https:\/\/www.feeling.com.mx\/img\/2022\/06\/61808aca4759f.jpeg 980w, https:\/\/www.feeling.com.mx\/img\/2022\/06\/61808aca4759f-549x315.jpeg 549w, https:\/\/www.feeling.com.mx\/img\/2022\/06\/61808aca4759f-300x172.jpeg 300w\" sizes=\"(max-width: 980px) 100vw, 980px\" \/><\/a><\/p>\n<p><strong>La empresa Microsoft contin\u00faa innovando con el desarrollo de diferentes aplicaciones para la Inteligencia Artificial (IA) ya que ahora cuenta con un simulador de voz que puede recrear el tono de cualquier persona con solo tener tres segundos de audio.<br \/>\n<\/strong><\/p>\n<p>Su nombre es VALL-E, y se trata de un modelo de lenguaje para la s\u00edntesis de texto a voz (TTS). Microsoft promete que tan solo necesita tres segundos de grabaci\u00f3n de audio para que el sistema sea capaz de imitar la voz de la misma.<\/p>\n<p>Uno de los puntos m\u00e1s interesantes que comparte la empresa en su comunicado, es que est\u00e1n desarrollando VALL-E para que funcione con otros modelos de IA generativa, como GPT-3, su chat que permite tener una conversaci\u00f3n natural con la Inteligencia Artificial.<\/p>\n<p>En otras palabras, el ChatGPT ser\u00eda capaz de ofrecer resultados de voz una vez que se haya integrado este modelo. <\/p>\n<p>Los ejemplos que muestra Microsoft son muy llamativos. En ellos, nos muestra cu\u00e1l ha sido la entrada de audio que se ha tomado como base, los pasos intermedios y el resultado final de VALL-E. <\/p>\n<blockquote class=\"twitter-tweet\">\n<p lang=\"en\" dir=\"ltr\">Surprised there isn&#39;t more chatter around VALL-E<\/p>\n<p>This new model by <a href=\"https:\/\/twitter.com\/Microsoft?ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">@Microsoft<\/a> can generate speech in any voice after only hearing a 3s sample of that voice <\/p>\n<p>Demo \u2192 <a href=\"https:\/\/t.co\/GgFO6kWKha\" target=\"_blank\">https:\/\/t.co\/GgFO6kWKha<\/a> <a href=\"https:\/\/t.co\/JY88vf4lYc\" target=\"_blank\">pic.twitter.com\/JY88vf4lYc<\/a><\/p>\n<p>&mdash; Steven Tey (@steventey) <a href=\"https:\/\/twitter.com\/steventey\/status\/1612586978201018368?ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">January 9, 2023<\/a><\/p><\/blockquote>\n<p> <script async src=\"https:\/\/platform.twitter.com\/widgets.js\" charset=\"utf-8\"><\/script><\/p>\n<p>El modelo no solo es capaz de imitar la voz, sino la propia cadencia original del lenguaje y el tono original con el que se ha grabado la muestra de la voz.<\/p>\n<p>Fuente: <a href=\"https:\/\/www.unotv.com\/ciencia-y-tecnologia\/vall-e-microsoft-inteligencia-artificial-simula-voz-con-segundos-de-audio\/\" title=\"ver en la fuente\" rel=\"noopener\" target=\"_blank\">Unotv.com<\/a><\/p>\n<blockquote class=\"twitter-tweet\">\n<p lang=\"es\" dir=\"ltr\"><a href=\"https:\/\/twitter.com\/hashtag\/MicrosoftVALLE?src=hash&amp;ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">#MicrosoftVALLE<\/a>: la <a href=\"https:\/\/twitter.com\/hashtag\/IA?src=hash&amp;ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">#IA<\/a> que con 3 segundos de <a href=\"https:\/\/twitter.com\/hashtag\/Audio?src=hash&amp;ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">#Audio<\/a> simula una <a href=\"https:\/\/twitter.com\/hashtag\/Voz?src=hash&amp;ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">#Voz<\/a> humana | <a href=\"https:\/\/twitter.com\/hashtag\/FormatoSiete?src=hash&amp;ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">#FormatoSiete<\/a> <a href=\"https:\/\/twitter.com\/hashtag\/Veracruz?src=hash&amp;ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">#Veracruz<\/a> <a href=\"https:\/\/twitter.com\/hashtag\/Tecnolog%C3%ADa?src=hash&amp;ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">#Tecnolog\u00eda<\/a> <a href=\"https:\/\/t.co\/CKU9T9uYEy\" target=\"_blank\">https:\/\/t.co\/CKU9T9uYEy<\/a><\/p>\n<p>&mdash; Formato Siete (@Formato7oficial) <a href=\"https:\/\/twitter.com\/Formato7oficial\/status\/1614681973263302658?ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">January 15, 2023<\/a><\/p><\/blockquote>\n<p> <script async src=\"https:\/\/platform.twitter.com\/widgets.js\" charset=\"utf-8\"><\/script><\/p>\n<blockquote class=\"twitter-tweet\">\n<p lang=\"es\" dir=\"ltr\">Microsoft VALL-E: La IA que simula una voz humana.<a href=\"https:\/\/t.co\/Fd3Zz6XS9A\" target=\"_blank\">https:\/\/t.co\/Fd3Zz6XS9A<\/a><\/p>\n<p>&mdash; InfoMH (@InfoMHArg) <a href=\"https:\/\/twitter.com\/InfoMHArg\/status\/1614657105302011904?ref_src=twsrc%5Etfw\" target=\"_blank\" rel=\"noopener\">January 15, 2023<\/a><\/p><\/blockquote>\n<p> <script async src=\"https:\/\/platform.twitter.com\/widgets.js\" charset=\"utf-8\"><\/script><\/p>\n","protected":false},"excerpt":{"rendered":"<p>La empresa Microsoft contin\u00faa innovando con el desarrollo de diferentes aplicaciones para la Inteligencia Artificial (IA) ya que ahora cuenta con un simulador de voz que puede recrear el tono de cualquier persona con solo tener tres segundos de audio. Su nombre es VALL-E, y se trata de un modelo de lenguaje para la s\u00edntesis de texto a voz (TTS). Microsoft promete que tan solo necesita tres segundos de grabaci\u00f3n&#8230;<\/p>\n","protected":false},"author":13,"featured_media":116591,"comment_status":"open","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":[],"categories":[29,23],"tags":[39360,39412,39566,39565],"views":76,"_links":{"self":[{"href":"https:\/\/www.feeling.com.mx\/site\/wp-json\/wp\/v2\/posts\/128852"}],"collection":[{"href":"https:\/\/www.feeling.com.mx\/site\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.feeling.com.mx\/site\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.feeling.com.mx\/site\/wp-json\/wp\/v2\/users\/13"}],"replies":[{"embeddable":true,"href":"https:\/\/www.feeling.com.mx\/site\/wp-json\/wp\/v2\/comments?post=128852"}],"version-history":[{"count":0,"href":"https:\/\/www.feeling.com.mx\/site\/wp-json\/wp\/v2\/posts\/128852\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.feeling.com.mx\/site\/wp-json\/wp\/v2\/media\/116591"}],"wp:attachment":[{"href":"https:\/\/www.feeling.com.mx\/site\/wp-json\/wp\/v2\/media?parent=128852"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.feeling.com.mx\/site\/wp-json\/wp\/v2\/categories?post=128852"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.feeling.com.mx\/site\/wp-json\/wp\/v2\/tags?post=128852"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}