{"id":40282,"date":"2024-07-02T17:38:00","date_gmt":"2024-07-02T22:38:00","guid":{"rendered":"https:\/\/www.alvarezjoseph.com\/blog\/?p=40282"},"modified":"2024-07-02T15:42:58","modified_gmt":"2024-07-02T20:42:58","slug":"plagio-o-uso-justo-el-debate-sobre-perplexity-y-la-etica-del-web-scraping","status":"publish","type":"post","link":"https:\/\/www.alvarezjoseph.com\/blog\/plagio-o-uso-justo-el-debate-sobre-perplexity-y-la-etica-del-web-scraping\/","title":{"rendered":"\u00bfPlagio o Uso Justo? El Debate sobre Perplexity y la \u00c9tica del Web Scraping"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\"><strong>\u00bfQu\u00e9 sucede cuando la inteligencia artificial comienza a navegar por el vasto oc\u00e9ano de informaci\u00f3n en la web?<\/strong> Esta pregunta no es solo te\u00f3rica. En la era de la IA generativa, donde los chatbots pueden ofrecer respuestas detalladas basadas en contenido extra\u00eddo de Internet, el l\u00edmite entre el <strong>uso justo y el plagio<\/strong> se vuelve difuso. Perplexity AI, una startup que combina un motor de b\u00fasqueda con un modelo de lenguaje avanzado, se encuentra en el ojo de la tormenta por su enfoque.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Perplexity AI: \u00bfInnovaci\u00f3n o Infracci\u00f3n?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Perplexity AI se distingue de otros como ChatGPT de OpenAI y Claude de Anthropic al no entrenar sus propios modelos b\u00e1sicos. En cambio, <strong>utiliza modelos disponibles comercialmente<\/strong> para traducir la informaci\u00f3n recopilada de la web en respuestas detalladas. Sin embargo, esta metodolog\u00eda ha llevado a acusaciones de <strong>plagio y extracci\u00f3n de datos poco \u00e9tica<\/strong>.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En junio, Forbes denunci\u00f3 a Perplexity por plagiar un art\u00edculo en su funci\u00f3n Perplexity Pages, mientras Wired acus\u00f3 a la startup de raspar il\u00edcitamente su sitio web. <strong>\u00bfEst\u00e1 Perplexity cruzando la l\u00ednea \u00e9tica?<\/strong><\/p>\n\n\n\n<h2 class=\"wp-block-heading\">El Confuso Territorio del Protocolo de Exclusi\u00f3n de Robots y el Uso Justo<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">En el fondo de esta controversia se encuentran dos conceptos cruciales: el <strong>Protocolo de Exclusi\u00f3n de Robots<\/strong> y el <strong>uso justo<\/strong> en la legislaci\u00f3n sobre derechos de autor.<\/p>\n\n\n\n<ol class=\"wp-block-list\">\n<li><strong>Protocolo de Exclusi\u00f3n de Robots:<\/strong> Este est\u00e1ndar permite a los sitios web indicar que no desean que los robots accedan a su contenido. Aunque Perplexity afirma respetar este protocolo, las acusaciones sugieren lo contrario.<\/li>\n\n\n\n<li><strong>Uso Justo:<\/strong> Esta legislaci\u00f3n permite el uso de material protegido por <a href=\"https:\/\/www.copyright.gov\/help\/faq\/faq-fairuse.html#:~:text=Under%20the%20fair%20use%20doctrine,news%20reporting%2C%20and%20scholarly%20reports.\" target=\"_blank\" rel=\"noopener\">derechos de autor<\/a> en ciertas circunstancias, como comentarios, cr\u00edticas y reportajes. <strong>\u00bfLos res\u00famenes generados por Perplexity cumplen con estos criterios?<\/strong><\/li>\n<\/ol>\n\n\n\n<h2 class=\"wp-block-heading\">Experimentos y Acusaciones<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Wired y el desarrollador <a href=\"https:\/\/rknight.me\/blog\/perplexity-ai-is-lying-about-its-user-agent\/\" target=\"_blank\" rel=\"noopener\">Robb Knight llevaron a cabo experimentos para probar sus sospechas<\/a>. Observaron que una <strong>direcci\u00f3n IP vinculada a Perplexity<\/strong> visitaba sus sitios web tras solicitar res\u00famenes de URL espec\u00edficas. <strong>\u00bfEs esto una forma de scraping disfrazada?<\/strong> Wired sostiene que s\u00ed, argumentando que estas visitas y res\u00famenes constituyen una infracci\u00f3n.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">La Defensa de Perplexity<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">El director de negocios de Perplexity, Dmitry Shevelenko, sostiene que <strong>resumir una URL no es lo mismo que rastrear<\/strong>. Seg\u00fan Shevelenko, la IP de Perplexity solo aparece cuando un usuario ingresa una URL en su consulta, lo que no cumple con la definici\u00f3n de rastreo.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>\u00abSimplemente estamos respondiendo a una solicitud directa y espec\u00edfica del usuario,\u00bb<\/strong> dijo Shevelenko. Sin embargo, para Wired y otros editores, esta distinci\u00f3n es insuficiente.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">\u00bfPlagio o Resumen?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Wired y Forbes tambi\u00e9n acusan a Perplexity de plagio. <strong>Wired argumenta que el chatbot de Perplexity reproduce oraciones exactas<\/strong> de sus art\u00edculos, lo que constituye plagio seg\u00fan las <a href=\"https:\/\/www.poynter.org\/reporting-editing\/2014\/is-it-original-an-editors-guide-to-identifying-plagiarism\/\" target=\"_blank\" rel=\"noopener\">pautas del Instituto Poynter<\/a>. Forbes inform\u00f3 que la funci\u00f3n Perplexity Pages inclu\u00eda contenido y dise\u00f1os pr\u00e1cticamente id\u00e9nticos a los originales de Forbes.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>\u00bfEs esto plagio o simplemente un resumen bajo el uso justo?<\/strong> La respuesta no es clara. Mark McKenna, profesor de Derecho en la UCLA, se\u00f1ala que los tribunales considerar\u00edan si los res\u00famenes usan muchas expresiones del art\u00edculo original y si la lectura del resumen podr\u00eda sustituir la lectura del art\u00edculo completo.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Estrategias de Protecci\u00f3n y el Futuro<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Para protegerse, <strong>Perplexity est\u00e1 negociando acuerdos de reparto de ingresos publicitarios con editoriales<\/strong>. Estos acuerdos permitir\u00edan a los editores obtener una porci\u00f3n de los ingresos generados por los anuncios mostrados junto con las respuestas de <a href=\"https:\/\/www.perplexity.ai\/es\/hub\/blog\/perplexity-pages\" target=\"_blank\" rel=\"noopener\">Perplexity<\/a>.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>\u00bfEs esta una soluci\u00f3n sostenible?<\/strong> Si los sistemas de inteligencia artificial contin\u00faan reutilizando el contenido de los editores, estos podr\u00edan enfrentar dificultades para monetizar su trabajo, lo que a largo plazo podr\u00eda reducir la cantidad de contenido disponible para extraer.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Conclusi\u00f3n: Un Futuro Incierto<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">La situaci\u00f3n de Perplexity destaca los complejos desaf\u00edos \u00e9ticos y legales en la era de la IA generativa. <strong>\u00bfHasta d\u00f3nde puede llegar la tecnolog\u00eda antes de cruzar la l\u00ednea \u00e9tica?<\/strong> Esta pregunta sigue siendo objeto de debate, y las respuestas tendr\u00e1n un impacto profundo en el futuro del periodismo y la inteligencia artificial.<\/p>\n\n\n\n<hr class=\"wp-block-separator has-alpha-channel-opacity\"\/>\n\n\n\n<h2 class=\"wp-block-heading\"><strong>En Resumen:<\/strong><\/h2>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Perplexity AI<\/strong> combina un motor de b\u00fasqueda con un modelo de lenguaje avanzado para ofrecer respuestas detalladas.<\/li>\n\n\n\n<li><strong>Acusaciones de Forbes y Wired<\/strong> sugieren que el enfoque de Perplexity podr\u00eda ser poco \u00e9tico.<\/li>\n\n\n\n<li><strong>Conceptos clave:<\/strong> Protocolo de Exclusi\u00f3n de Robots y Uso Justo.<\/li>\n\n\n\n<li><strong>Experimentos de Wired<\/strong> demostraron que Perplexity podr\u00eda estar ignorando las normas de exclusi\u00f3n de robots.<\/li>\n\n\n\n<li><strong>La defensa de Perplexity<\/strong> se basa en la distinci\u00f3n entre resumir y rastrear.<\/li>\n\n\n\n<li><strong>Acusaciones de plagio<\/strong> ponen en duda la legalidad y la \u00e9tica de los res\u00famenes generados por IA.<\/li>\n\n\n\n<li><strong>Futuro incierto<\/strong>: Los acuerdos de reparto de ingresos podr\u00edan ser una soluci\u00f3n temporal, pero los desaf\u00edos persisten.<\/li>\n<\/ul>\n\n\n\n<hr class=\"wp-block-separator has-alpha-channel-opacity\"\/>\n\n\n\n<p class=\"wp-block-paragraph\">Esta <strong>compleja historia<\/strong> nos recuerda que, en la era de la IA, las l\u00edneas entre innovaci\u00f3n y \u00e9tica son cada vez m\u00e1s difusas. <strong>\u00bfQu\u00e9 opinas sobre el futuro de la inteligencia artificial y los derechos de autor?<\/strong> La conversaci\u00f3n apenas comienza.<\/p>\n\n\n<div class=\"kk-star-ratings kksr-auto kksr-align-center kksr-valign-bottom\"\n    data-payload='{&quot;align&quot;:&quot;center&quot;,&quot;id&quot;:&quot;40282&quot;,&quot;slug&quot;:&quot;default&quot;,&quot;valign&quot;:&quot;bottom&quot;,&quot;ignore&quot;:&quot;&quot;,&quot;reference&quot;:&quot;auto&quot;,&quot;class&quot;:&quot;&quot;,&quot;count&quot;:&quot;6&quot;,&quot;legendonly&quot;:&quot;&quot;,&quot;readonly&quot;:&quot;&quot;,&quot;score&quot;:&quot;3&quot;,&quot;starsonly&quot;:&quot;&quot;,&quot;best&quot;:&quot;5&quot;,&quot;gap&quot;:&quot;5&quot;,&quot;greet&quot;:&quot;Valora el post&quot;,&quot;legend&quot;:&quot;3\\\/5 - (6 votos)&quot;,&quot;size&quot;:&quot;24&quot;,&quot;title&quot;:&quot;\u00bfPlagio o Uso Justo? El Debate sobre Perplexity y la \u00c9tica del Web Scraping&quot;,&quot;width&quot;:&quot;84.5&quot;,&quot;_legend&quot;:&quot;{score}\\\/{best} - ({count} {votes})&quot;,&quot;font_factor&quot;:&quot;1.25&quot;}'>\n            \n<div class=\"kksr-stars\">\n    \n<div class=\"kksr-stars-inactive\">\n            <div class=\"kksr-star\" data-star=\"1\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" data-star=\"2\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" data-star=\"3\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" data-star=\"4\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" data-star=\"5\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n    <\/div>\n    \n<div class=\"kksr-stars-active\" style=\"width: 84.5px;\">\n            <div class=\"kksr-star\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n    <\/div>\n<\/div>\n                \n\n<div class=\"kksr-legend\" style=\"font-size: 19.2px;\">\n            3\/5 - (6 votos)    <\/div>\n    <\/div>\n","protected":false},"excerpt":{"rendered":"<p>\u00bfQu\u00e9 sucede cuando la inteligencia artificial comienza a navegar por el vasto oc\u00e9ano de informaci\u00f3n en la web? Esta pregunta no es solo te\u00f3rica. En la era de la IA generativa, donde los chatbots pueden ofrecer respuestas detalladas basadas en contenido extra\u00eddo de Internet, el l\u00edmite entre el uso justo y el plagio se vuelve [&hellip;]<\/p>\n","protected":false},"author":2,"featured_media":40283,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[72],"tags":[],"class_list":["post-40282","post","type-post","status-publish","format-standard","has-post-thumbnail","category-noticias-de-tecnologia"],"_links":{"self":[{"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/posts\/40282","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/comments?post=40282"}],"version-history":[{"count":0,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/posts\/40282\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/media\/40283"}],"wp:attachment":[{"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/media?parent=40282"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/categories?post=40282"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/tags?post=40282"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}