{"id":40285,"date":"2024-07-02T18:10:00","date_gmt":"2024-07-02T23:10:00","guid":{"rendered":"https:\/\/www.alvarezjoseph.com\/blog\/?p=40285"},"modified":"2024-07-02T15:46:43","modified_gmt":"2024-07-02T20:46:43","slug":"anthropic-revoluciona-la-evaluacion-de-la-ia-un-nuevo-programa-para-medir-impacto-y-rendimiento","status":"publish","type":"post","link":"https:\/\/www.alvarezjoseph.com\/blog\/anthropic-revoluciona-la-evaluacion-de-la-ia-un-nuevo-programa-para-medir-impacto-y-rendimiento\/","title":{"rendered":"Anthropic Revoluciona la Evaluaci\u00f3n de la IA: Un Nuevo Programa para Medir Impacto y Rendimiento"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\">En un giro intrigante en la carrera de la inteligencia artificial, <strong>Anthropic<\/strong> ha lanzado un ambicioso <a href=\"https:\/\/www.anthropic.com\/news\/a-new-initiative-for-developing-third-party-model-evaluations\" target=\"_blank\" rel=\"noopener\">programa <\/a>para financiar el desarrollo de nuevos puntos de referencia que eval\u00faen el rendimiento y el impacto de los modelos de IA, incluyendo modelos generativos como su propio <strong>Claude<\/strong>. Este programa, revelado recientemente, promete pagos a organizaciones de terceros capaces de medir eficazmente las capacidades avanzadas de los modelos de IA.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">\u00bfQu\u00e9 Busca Anthropic con Este Programa?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Anthropic ha dejado claro que su <strong><a href=\"https:\/\/www.anthropic.com\/news\/anthropics-responsible-scaling-policy\" target=\"_blank\" rel=\"noopener\">objetivo es mejorar la seguridad en todo el campo de la IA<\/a><\/strong>, proporcionando herramientas valiosas que beneficien a todo el ecosistema. La compa\u00f1\u00eda destaca la demanda creciente y la oferta insuficiente de evaluaciones de alta calidad y relevantes para la seguridad de la IA.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">El Problema de la Evaluaci\u00f3n en la IA<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">La evaluaci\u00f3n de la IA enfrenta serios desaf\u00edos. <strong>Los puntos de referencia actuales no reflejan adecuadamente el uso real<\/strong> de los sistemas por parte de los usuarios. Adem\u00e1s, muchos de estos puntos de referencia, especialmente los creados antes de la llegada de la IA generativa moderna, pueden no estar midiendo lo que pretenden medir.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Anthropic<\/strong> propone una soluci\u00f3n de alto nivel que consiste en crear puntos de referencia desafiantes con un enfoque en la seguridad de la IA y las implicaciones sociales. Esto incluye nuevas herramientas, infraestructura y m\u00e9todos.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">\u00bfQu\u00e9 Tipo de Evaluaciones Busca Anthropic?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">La compa\u00f1\u00eda busca espec\u00edficamente pruebas que eval\u00faen la capacidad de un modelo para llevar a cabo tareas cr\u00edticas, tales como:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Ciberataques<\/strong><\/li>\n\n\n\n<li><strong>Mejora de armas de destrucci\u00f3n masiva<\/strong><\/li>\n\n\n\n<li><strong>Manipulaci\u00f3n o enga\u00f1o a personas<\/strong> (mediante deepfakes o desinformaci\u00f3n)<\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">Adem\u00e1s, <strong>Anthropic<\/strong> est\u00e1 comprometida con el desarrollo de un sistema de alerta temprana para identificar y evaluar estos riesgos, aunque a\u00fan no ha revelado los detalles de c\u00f3mo funcionar\u00e1 este sistema.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Apoyando la Investigaci\u00f3n y Desarrollando Nuevas Plataformas<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">El nuevo programa tambi\u00e9n apoyar\u00e1 la investigaci\u00f3n de puntos de referencia y tareas \u00abde extremo a extremo\u00bb que exploren el potencial de la IA para:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Ayudar en el estudio cient\u00edfico<\/strong><\/li>\n\n\n\n<li><strong>Conversar en varios idiomas<\/strong><\/li>\n\n\n\n<li><strong>Mitigar sesgos arraigados<\/strong><\/li>\n\n\n\n<li><strong>Reducir la toxicidad de la autocensura<\/strong><\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Anthropic<\/strong> planea desarrollar nuevas plataformas que permitan a los expertos crear sus propias evaluaciones y ensayos a gran escala de modelos que involucren a miles de usuarios. La empresa ha contratado a un coordinador a tiempo completo para gestionar el programa y est\u00e1 abierta a comprar o ampliar proyectos con potencial.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Opciones de Financiaci\u00f3n y Colaboraci\u00f3n<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Anthropic<\/strong> ofrece una variedad de opciones de financiaci\u00f3n adaptadas a las necesidades de cada proyecto. Los equipos tendr\u00e1n la oportunidad de interactuar directamente con los <a href=\"https:\/\/newsroom.uw.edu\/news-releases\/sky-is-falling-scenarios-distract-from-risks-ai-poses-today\" target=\"_blank\" rel=\"noopener\">expertos <\/a>de la empresa, incluyendo los equipos de ajuste, confianza y seguridad.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Desaf\u00edos y Confianza en Anthropic<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Aunque el esfuerzo de <strong>Anthropic<\/strong> es loable, la comunidad de IA puede tener reservas sobre las verdaderas intenciones de la empresa, especialmente considerando sus ambiciones comerciales. La transparencia en las evaluaciones financiadas y las definiciones de IA \u00absegura\u00bb o \u00abriesgosa\u00bb ser\u00e1n cruciales para ganar la confianza de la comunidad.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Reflexiones Finales<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Anthropic<\/strong> espera que su programa sea un <strong>catalizador del progreso hacia una evaluaci\u00f3n integral de la IA<\/strong> como est\u00e1ndar de la industria. Sin embargo, queda por ver si los esfuerzos no afiliados a corporaciones estar\u00e1n dispuestos a colaborar con un proveedor de IA cuyo compromiso principal es con sus accionistas.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>El futuro de la IA<\/strong> depende de la colaboraci\u00f3n y transparencia en el desarrollo y evaluaci\u00f3n de estos modelos avanzados. Con programas como el de <strong>Anthropic<\/strong>, el camino hacia una inteligencia artificial m\u00e1s segura y eficaz podr\u00eda estar m\u00e1s cerca de lo que pensamos.<\/p>\n\n\n<div class=\"kk-star-ratings kksr-auto kksr-align-center kksr-valign-bottom\"\n    data-payload='{&quot;align&quot;:&quot;center&quot;,&quot;id&quot;:&quot;40285&quot;,&quot;slug&quot;:&quot;default&quot;,&quot;valign&quot;:&quot;bottom&quot;,&quot;ignore&quot;:&quot;&quot;,&quot;reference&quot;:&quot;auto&quot;,&quot;class&quot;:&quot;&quot;,&quot;count&quot;:&quot;6&quot;,&quot;legendonly&quot;:&quot;&quot;,&quot;readonly&quot;:&quot;&quot;,&quot;score&quot;:&quot;3.3&quot;,&quot;starsonly&quot;:&quot;&quot;,&quot;best&quot;:&quot;5&quot;,&quot;gap&quot;:&quot;5&quot;,&quot;greet&quot;:&quot;Valora el post&quot;,&quot;legend&quot;:&quot;3.3\\\/5 - (6 votos)&quot;,&quot;size&quot;:&quot;24&quot;,&quot;title&quot;:&quot;Anthropic Revoluciona la Evaluaci\u00f3n de la IA: Un Nuevo Programa para Medir Impacto y Rendimiento&quot;,&quot;width&quot;:&quot;93.2&quot;,&quot;_legend&quot;:&quot;{score}\\\/{best} - ({count} {votes})&quot;,&quot;font_factor&quot;:&quot;1.25&quot;}'>\n            \n<div class=\"kksr-stars\">\n    \n<div class=\"kksr-stars-inactive\">\n            <div class=\"kksr-star\" data-star=\"1\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" data-star=\"2\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" data-star=\"3\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" data-star=\"4\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" data-star=\"5\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n    <\/div>\n    \n<div class=\"kksr-stars-active\" style=\"width: 93.2px;\">\n            <div class=\"kksr-star\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n            <div class=\"kksr-star\" style=\"padding-right: 5px\">\n            \n\n<div class=\"kksr-icon\" style=\"width: 24px; height: 24px;\"><\/div>\n        <\/div>\n    <\/div>\n<\/div>\n                \n\n<div class=\"kksr-legend\" style=\"font-size: 19.2px;\">\n            3.3\/5 - (6 votos)    <\/div>\n    <\/div>\n","protected":false},"excerpt":{"rendered":"<p>En un giro intrigante en la carrera de la inteligencia artificial, Anthropic ha lanzado un ambicioso programa para financiar el desarrollo de nuevos puntos de referencia que eval\u00faen el rendimiento y el impacto de los modelos de IA, incluyendo modelos generativos como su propio Claude. Este programa, revelado recientemente, promete pagos a organizaciones de terceros [&hellip;]<\/p>\n","protected":false},"author":2,"featured_media":40286,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[72],"tags":[],"class_list":["post-40285","post","type-post","status-publish","format-standard","has-post-thumbnail","category-noticias-de-tecnologia"],"_links":{"self":[{"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/posts\/40285","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/comments?post=40285"}],"version-history":[{"count":0,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/posts\/40285\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/media\/40286"}],"wp:attachment":[{"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/media?parent=40285"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/categories?post=40285"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.alvarezjoseph.com\/blog\/wp-json\/wp\/v2\/tags?post=40285"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}