{"id":152044,"date":"2025-04-21T14:42:10","date_gmt":"2025-04-21T17:42:10","guid":{"rendered":"https:\/\/radioacuariofm.com.ar\/?p=152044"},"modified":"2025-04-21T14:42:11","modified_gmt":"2025-04-21T17:42:11","slug":"los-flamantes-modelos-o3-y-o4-mini-de-chatgpt-alucinan-mas-que-sus-predecesores","status":"publish","type":"post","link":"https:\/\/radioacuariofm.com.ar\/?p=152044","title":{"rendered":"Los flamantes modelos o3 y o4-mini de ChatGPT alucinan m\u00e1s que sus predecesores"},"content":{"rendered":"<p><\/p>\n<div>\n<p class=\"com-paragraph  --capital --s\">Los nuevos <a href=\"https:\/\/www.lanacion.com.ar\/tecnologia\/openai-presenta-los-nuevos-modelos-o3-y-o4-mini-los-primeros-con-capacidad-para-pensar-con-imagenes-nid17042025\/\" target=\"_self\" title=\"https:\/\/www.lanacion.com.ar\/tecnologia\/openai-presenta-los-nuevos-modelos-o3-y-o4-mini-los-primeros-con-capacidad-para-pensar-con-imagenes-nid17042025\/\" class=\"com-link\" data-mrf-recirculation=\"n_link_parrafo\"><strong>modelos de razonamiento o3 y o4-mini de OpenAI<\/strong><\/a> ofrecen <strong>m\u00e1s resultados con alucinaciones que los modelos de razonamiento anteriores de la compa\u00f1\u00eda<\/strong>, con pr\u00e1cticamente el doble de la tasa de alucinaciones registradas en el modelo o1, seg\u00fan pruebas internas de la evaluaci\u00f3n <strong>PersonQA<\/strong>.<\/p>\n<p class=\"com-paragraph   --s\">La tecnol\u00f3gica present\u00f3 su nueva familia de <strong>modelos de la serie o, centrada en el razonamiento<\/strong>, la semana pasada, concretamente, con los modelos o3 y o4-mini, que est\u00e1n dise\u00f1ados para programar, navegar por la web y generar im\u00e1genes de manera aut\u00f3noma, incluso, con capacidad para \u201cpensar con im\u00e1genes\u201d.<\/p>\n<div class=\"content-media cursor-pointer\">\n<section class=\"mod-media ratio-16-9\">\n<figure class=\"mod-video\">\n<div class=\"video-player bg-black ratio-16-9\">\n<div id=\"facade-yWil9Xnp\" class=\"content-facade-jw relative bg-black ratio-16-9\"><picture><source media=\"(max-width: 767px)\" srcset=\"https:\/\/resizer.glanacion.com\/resizer\/v2\/https%3A%2F%2Fcdn.jwplayer.com%2Fv2%2Fmedia%2FyWil9Xnp%2Fposter.jpg%3Fwidth%3D720?auth=8d7e40dec726c9421666ad2175698e70072c72be9820993f5a74bf197dc84c87&amp;width=480&amp;quality=70&amp;smart=false\"\/><\/picture><\/div>\n<\/div><figcaption class=\"border border-1 border-bottom border-light-300 bg-white relative px-16 py-8 min-h-36 w-100_md px-0_l mb-8\"><span class=\"text ln-text text-16 block\">OpenAI o3 y o4 mini, lo nuevo de ChatGPT<\/span><\/figcaption><\/figure>\n<\/section>\n<\/div>\n<p class=\"com-paragraph   --s\">A pesar de las novedades que integran los \u00faltimos modelos de OpenAI, se han encontrado <strong>problemas relacionados con alucinaciones en sus resultados<\/strong>, esto es, una cuesti\u00f3n que sufren algunos modelos de Inteligencia Artificial (IA) y que se basa en ofrecer resultados que, a pesar de presentarse de manera coherente, <a href=\"https:\/\/www.lanacion.com.ar\/ciencia\/que-es-una-alucinacion-de-la-inteligencia-artificial-y-por-que-es-una-de-las-fallas-potencialmente-nid16052023\/\" target=\"_self\" title=\"https:\/\/www.lanacion.com.ar\/ciencia\/que-es-una-alucinacion-de-la-inteligencia-artificial-y-por-que-es-una-de-las-fallas-potencialmente-nid16052023\/\" class=\"com-link\" data-mrf-recirculation=\"n_link_parrafo\">incluyen informaci\u00f3n incorrecta, sesgada, err\u00f3nea o, incluso, inventada<\/a>.<\/p>\n<p class=\"com-paragraph   --s\">En concreto, los nuevos modelos de razonamiento o3 y o4-mini, alucinan con m\u00e1s frecuencia que los modelos de razonamiento presentados anteriormente por OpenAI, como es el caso de los modelos o1, o1-mini y o3-mini, incluidos otros modelos anteriores como GPT-4o.<\/p>\n<p class=\"com-paragraph   --s\">As\u00ed lo ha se\u00f1alado OpenAI, en base a los resultados obtenidos en sus pruebas internas sobre alucinaciones, con la evaluaci\u00f3n <strong>PersonQA, un sistema que pone a prueba los modelos midiendo la precisi\u00f3n de los intentos de respuesta<\/strong>. Tal y como lo ha explicado en el informe t\u00e9cnico, PersonQA valora la precisi\u00f3n, es decir, si el modelo responde correctamente a la pregunta, y la tasa de alucinaciones, la frecuencia con la que el modelo alucina en sus respuestas.<\/p>\n<p class=\"com-paragraph   --s\">En este sentido, <strong>el modelo o4-mini obtuvo peores resultados que los modelos o1 y o3 en las alucinaciones<\/strong>, aunque OpenAI ha se\u00f1alado que \u201cera de esperar\u201d porque los modelos m\u00e1s peque\u00f1os \u201ctienen m\u00e1s conocimientos del mundo y tienden a alucinar m\u00e1s\u201d.<\/p>\n<p class=\"com-paragraph   --s\">Asimismo, los resultados de PersonQA tambi\u00e9n han reflejado algunas \u201cdiferencias de rendimiento\u201d al comparar o1 y o3, subrayando que o3 tiende a hacer m\u00e1s afirmaciones en general, lo que lleva a afirmaciones m\u00e1s precisas, as\u00ed como afirmaciones \u201cm\u00e1s inexactas o alucinadas\u201d.<\/p>\n<p class=\"com-paragraph   --s\">Seg\u00fan los resultados mostrados, <strong>o3 alucin\u00f3 al responder el 33 por ciento de las preguntas realizadas por la evaluaci\u00f3n PersonQA<\/strong>. Esto equivale a pr\u00e1cticamente el doble de la tasa de alucinaciones del modelo o1 de OpenAI. Por su parte, o4-mini, obtuvo un resultado del 48 por ciento en la tasa de alucinaciones.<\/p>\n<p class=\"com-paragraph   --s\">A pesar de estas conclusiones en las pruebas, OpenAI ha afirmado que, por el momento, continuar\u00e1n investigando para \u201ccomprender la causa de este resultado\u201d, y porqu\u00e9 las alucinaciones han aumentado con concretamente con los modelos de razonamiento.<\/p>\n<p class=\"com-paragraph   --s\">Igualmente, seg\u00fan ha detallado el portavoz de OpenAI, Niko Felix, <a href=\"https:\/\/techcrunch.com\/2025\/04\/18\/openais-new-reasoning-ai-models-hallucinate-more\/\" rel=\"nofollow\" target=\"_blank\" title=\"https:\/\/techcrunch.com\/2025\/04\/18\/openais-new-reasoning-ai-models-hallucinate-more\/\" class=\"com-link\" data-mrf-recirculation=\"n_link_parrafo\">en declaraciones a TechCrunch<\/a>, abordar las alucinaciones en todos los modelos de OpenAI \u201ces un \u00e1rea de investigaci\u00f3n continua\u201d, en la que trabajan para mejorar la precisi\u00f3n y confiabilidad.<\/p>\n<p><a href=\"https:\/\/www.lanacion.com.ar\/economia\/IA\/\" title=\"Futuria\" class=\"com-link --logo container-center-100\"><img src=\"https:\/\/arc-static.glanacion.com\/pf\/resources\/images\/futuria.svg?d=1803\" alt=\"Futuria\" width=\"inherit\" height=\"inherit\" class=\" ln-nota-logo com-logo futuria --xs\" loading=\"lazy\" fetchpriority=\"low\" decoding=\"async\"\/><\/a><\/p>\n<p><span class=\"text ln-text font-bold --twoxs\">LA NACION<\/span><\/p>\n<section class=\"border border-bottom border-thin border-neutral-light-100 py-24 mb-32\">\n<div class=\"w-100 flex flex-column gap-4\"><span class=\"text ln-text text-12\">Conforme a <strong> los criterios de<\/strong><\/span><\/div>\n<\/section>\n<\/div>\n","protected":false},"excerpt":{"rendered":"<p>Los nuevos modelos de razonamiento o3 y o4-mini de OpenAI ofrecen m\u00e1s resultados con alucinaciones que los modelos de razonamiento anteriores de la compa\u00f1\u00eda, con pr\u00e1cticamente el doble de la tasa de alucinaciones registradas en el modelo o1, seg\u00fan pruebas internas de la evaluaci\u00f3n PersonQA. La tecnol\u00f3gica present\u00f3 su nueva familia de modelos de la [&hellip;]<\/p>\n","protected":false},"author":2,"featured_media":152045,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[28],"tags":[],"class_list":["post-152044","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-economia"],"_links":{"self":[{"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=\/wp\/v2\/posts\/152044","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=152044"}],"version-history":[{"count":1,"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=\/wp\/v2\/posts\/152044\/revisions"}],"predecessor-version":[{"id":152046,"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=\/wp\/v2\/posts\/152044\/revisions\/152046"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=\/wp\/v2\/media\/152045"}],"wp:attachment":[{"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=152044"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=152044"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/radioacuariofm.com.ar\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=152044"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}