Showing posts with label Anthropic. Show all posts
Showing posts with label Anthropic. Show all posts

Wednesday, July 29, 2026

¿LLM como discipulos artificiales ?


Es más que probable que en estos 4 años pos-ChatGPT (yo no lo llamaria era IA) se han producido utilizaciones de documentos escritos que o bien rozan la ilegalidad o bien se han aprovechado del nuevo agujero legal de las leyes de protección de derechos intelecuales como en los viejos tiempos del P2P 

Como la L de los LLM significa extensa/grande era de cajon que todo que estuviera al alcance de sus desarrolladores terminaria siendo alimento para entrenar estos modelos. Esto resultó grato para el usuario, con poco o mucho talento, que se encontró de repente que con unas ordenes (prompts) sencillas uno de estos bots podia escribir un texto al estilo de tal o cual autor, cuyas obras se hubieran empleado como dato de entrenamiento 

Claro, el siguiente estadio esperable era que los escritores y periodistas no plagiados pero si imitados intentaran covencer a los jueces de que eso era una copia no descarada pero si evidente de sus obras. El problema es que los jueces, al menos hasta ahora, no lo vieron asi y sentenciaron más de una vez que si  compras un libro ya estas pagando y luego que lo uses para entrenar un LLM o dar clases de verano de literatura en tu pueblo es asunto tuyo no del autor 

¿Y que esta pasando ahora? pues que aunque las espadas de muchos escritores litigantes siguen en alto, la estrategia de los grandes lab de IA esta siendo pagar, como hizo Anthropic el año pasado, con cantidades que para estos colosos a punto de salir a bolsa, son realmente monedas sueltas en su monedero 

Y tambien evitar el enfrentamiento directo con la tribu cabreada haciendo que sus bots no permitan escribir un texto al estilo de pero sin con las caracteristicas basicas y diferenciales de un autor o de una obra, que logicamente no pertenecen a nadie,  con un resultado que no es lo mismo pero en muchos casos casi

¿Es esto un revival de Davides escritores contra Goliats IA ? pues como siempre esto es más complejo y parte de una cierta desmemoria que me vino a la cabeza visitando la Casa del Greco en Toledo (Spain), a la muerte del maestro su hijo Jorge Manuel continuó realizando retratos al estilo de su padre Doménikus incluso con artesanos de su taller

En el arte esto se reconoce como la escuela de, y muchas veces es casi imposible reconocer la obra del maestro de la del discipulo. ¿Se puede por tanto considerar a los LLM como discipulos artificiales de los autores de los que aprenden? pues es una hipotesis nada alocada, aunque de momento estos discipulos IA se quedan en la forma pero NO en el alma o la esencia del autor, generando obras insulsas pero oye ! suficientes para algunos apetitos poco exigentes 

Wednesday, June 17, 2026

La IA me la quedo yo: porque la estrategia US es un error historico

En esto de las estrategias geopoliticas es dificil opinar porque siempre hay datos ocultos que son los que determinan el resultado final. Y esto viene a proposito de la, de momento, postura de los US de limitar el acceso de sus modelos de IA más avanzados a todos, incluidos los a priori socios confiables europeos

Hay aqui varias consideraciones: 

la primera, parece lógico que una potencia militar y tecnológica (que suele ser lo mismo) reserve sus mejores armas frente a sus potenciales enemigos. Y la IA al menos en este momento se entiende como una ventaja tecnologica evidente sobre todo para descubrir las vulnerabilidades de los modelos y sistemas de sus enemigos (el caso de los modelos Mhytos 5 y Fable 5 de Anthropic) 

Un poco de historia: la URSS de Stalin :( tardo exactamente 4 años en detonar su primera bomba atomica despues del bombardeo a Japon en 1945. Y asi se dieron cuenta muchos que la investigación no es algo de algún lider (mas o menos solitario o aislado) en alguna parte, sino una objetivo compartido donde muchos tienen un nivel más o menos parejo. 

Es verdad que los casos de espionaje favorecieron que la URSS adelantara el acceso a la tecnologia de fision atomica (la bomba), pero más temprano que tarde la hubieran tenido. Ahora pensad que si estas filtraciones pasaban en los años 40´s , imaginaos que podria pasar ahora en esta etapa de interconexión y acceso global y ademas con programas de software (basicamente informacion) 

Como estamos viendo con el resurgir de la industria china de chips, el veto a los procesadores de Nvdia no es que haya retrasado mucho que China desarrolle modelos de IA avanzados, ni tampoco agentes de IA que no necesitan chips de calculo tan rápido sino una capacidad mayor para completar tareas (dos tipos de inferencia muy diferentes!) 

¿Debe por tanto los US compartir su tecnologia IA más poderosa con más paises?

la cuestión es que peligro supondria esto para US. ¿Cree alguien que Europa (la UE+ UK) va a poner en peligro los sistemas defensivos y ofensivos de los US? 

¿Podria crearse en el medio plazo algun competidor occidental del mismo nivel que Anthropic?, pues es una posibilidad, pero por lo que hemos visto estos 30 años de Internet comercial para todos, eso es una quimera que no se va producir (¿Mistral compitiendo con OpenAI o Anthropic?) 

¿Y el resto? o sea si China, Rusia, India acceden a estos modelos avanzados ¿supondria un peligro mayor que el actual? . Puede que en el corto plazo si, pero ni a medio ni a largo plazo, ya que la mayoria de los modelos más avanzados son software libre y es casi imposible construir algo que no sea imitado o igualado en meses

Como siempre, la tecnologia no es la ventaja estrategica definitiva (US hubiera ganado la WW2 incluso sin bomba atomica) sino una combinación virtuosa de factores entre los cuales esta el dinamismo económico, el grado de innovación en todos los sectores (incluido los poderes publicos), su coordinación con todos los hubs de inteligencia mundial y sobre todo...la agilidad a la hora de implementar estas innovaciones en lo que ya existe...

Wednesday, June 10, 2026

Habitos de recomendación en IA: riesgo y sentido común


A medida que los propios desarrolladores de modelos IA nos convencen que estamos camino o cerca o en algunas ocasiones (casi) llegamos a la Inteligencia Artificial General (AGI), ese nivel que aparentemente nos supera en (casi) todo, más personas le piden consejo a sus chatbots 

No veo esto nada ilogico, los chicos de OpenAI, Google y Anthropic hace tiempo que han logrado ese hito de convertir un producto de laboratorio en una herramienta cotidiana, que con toques de personalización crecientes (conversaciones memorizadas) y esa (falsa) sensación de que una conversación con un bot es privada, lleva a muchos a pedir consejos al bot que basculan la mayoria de las veces hacia opciones de cero riesgo

Fiajos sino lo que dice Doordash, el gigante norteamericano del delivery, en su último informe sobre el mercado de la restauración en los US: 

El 22% de los clientes utilizan un chatbot como Gemini o ChatGPT para elegir un restaurante, lo que les permite busquedas muy segmentadas por tipo de comida, precios, zonas pero tambien ayuda a hacer comparativas, una tarea que a veces es laboriosa y ahuyenta clientes 

 A esto es lo que me referia con consejos de riesgo bajo o tolerable, y aqui si veo una progresión de la busqueda Google o Maps (muchos resturantes no completan su información) hacia una IA que permita sin fricciones saltar entre app´s y pasarelas de pago, de la misma forma que los links nos educaron en la fluidez y la confianza en la primera etapa web de Internet 

La otra cara de esta IA consejera la estamos viendo en Estados como Florida (US) donde el fiscal general (AG) ha demandado a OpenAI y su iconico CEO San Altman (a estas alturas Altman es parte del branding de la empresa) por ayudar a algun desequilibrado a realizar tiroteos masivos o erosionar la capacidad de pensamiento critico de sus (confiados) usuarios 

Bueno, soy de esa parte de la población que piensa que con o sin IA el que busca maldad la encuentra y la información puede tener más fricción pero al final se encuentra, a las pruebas me remito con el sorprendente historial que tienen los US de tiroteos indiscriminados en escuelas (algo que me cuesta entender) 

Tambien milito en el equipo optimista de la sociedad y los mismos que usamos IA (uno de cada seis en el mundo) sabemos distinguir entre el riesgo y la confianza que te ofrece un bot de IA a la hora de elegir comida y por ejemplo diagnosticar una enfermedad y no digamos ya justificar comportamientos poco eticos o directamente letales

¿Que hay que poner salvaguardas a estos bots de IA tan peculiares? pues sin duda, pero dime en que faceta humana no las hay, porque el lado oscuro no es un invento de StarWars sino una realidad estadisticamente marginal de todo grupo humano

Thursday, September 25, 2025

La eficiencia es éticamente neutral: ciberdelincuencia & IA

La eficiencia es uno de los factores más deseados, perseguidos y analizados por (casi) todas las organizaciones y a estas alturas del conocimiento económico y de gestión parece un objetivo indiscutible ("organizaciones más eficientes")

Claro, pero lo que pocas veces nos paramos a pensar es que la eficiencia también llega a los malos, aquellos que se aprovechan para engañar o directamente extorsionar a algún tercero no necesariamente incauto (hay muchos ejemplos de organizaciones inteligentes (sin sarcasmo!) que les han hackeado)

El mes pasado Anthropic, la empresa de IA que desarrolla los modelos Claude, publicó un informe realmente interesante sobre lo bien que los  ciber criminales se han adaptado al nuevo entorno y utilizan Claude para hacer lo mismo que hacían antes pero con menos medios (aka más barato), lo que incrementa a su vez el incentivo para estas actividades fraudulentas

Los ejemplos de como usan estos delincuentes los modelos IA para trabajar son desgraciadamente fascinantes y ahí van algunos ejemplos: 

Extorsión asistida: la amenaza conocida de utilizar código malicioso (ransonware) para encriptar datos de una organización y que esta no pueda acceder a ellos, parece que esta superada con el vibe hacking que consiste en usar modelos como Claude para que haga el plan de acción: le indica a quien extorsionar, de que manera (perfil psicológico del sujeto a extorsionar) y por cuanto dinero 

Fraude en teletrabajo: aunque el teletrabajo esta en recesión, hay todavía muchas empresas que contratan a personas localizadas en otros países ya sea por su menor coste o por que no encuentran candidatos. Ahora se ha descubierto que sin grandes conocimientos técnicos ni un nivel de ingles básico una grupo de personas usaron modelos de IA para superar entrevistas de trabajo en empresas de tecnologia! y lo peor que entregaron un producto digno (buf!) 

Por último y nada menos importante: uno de estos agentes del lado oscuro, utilizo Claude para desarrollar paquetes de malware adaptados al perfil de sus clientes-delincuentes y venderlos por menos de 1000 US$, con unas capacidades técnicas imposibles para una sola persona 

La delincuencia siempre ha estado un paso por delante de las contramedidas de detección por la sencilla razón de que sino no hubiera sobrevivido y es muy hábil para detectar donde y cuando emplear que tecnología en su provecho, sin rodeos legales o burocráticos, de ahí su funesto grado eficiencia y eficacia

Wednesday, June 25, 2025

Entrenando LLM con libros: el limite del fair use (nueva sentencia)

La novedad legal que supone el uso creciente de modelos LLM como forma de acceso a información contenida en (casi) cualquier fuente original es la causa de las demandas por violación del copyright que vemos y veremos durante un tiempo 

En esencia, las empresas de IA que desarrollan modelos LLM necesitan entrenar a estos con todo lo disponible para incrementar la precisión de sus respuestas (y aun así tienes alucinaciones!) y en ese agujero negro aspirador entran también los libros 

¿El problema? que algunos autores y editoriales no tienen nada claro que usar sus publicaciones sin permiso para entrenar un modelo LLM no sea una forma de robo (léase lo usas sin permiso). Por eso, las sentencias judiciales que se vienen sucediendo son tan importantes y significativas de por donde podrían ir las cosas al menos hasta la siguiente etapa 

El más reciente ejemplo nos deja algunas pistas importantes: 

Anthropic, la empresa del bot Claude, acaba de ganar, al menos parcialmente, una demanda colectiva interpuesta por 3 autores el pasado año por infringir derechos de autor de ni más ni menos que 5 millones de libros para entrenar sus LLM 

Como la demanda colectiva evaluaba el daño en 150.000 US$ por libro esto llevaría a una indemnización ruinosa para cualquiera de más de 750 millardos de dólares (billions), por lo que rápidamente el juez a cargo en el distrito norte de California desestimo rápidamente la demanda colectiva

Y esta semana apareció una primera sentencia que dice textualmente que entrenar un LLM con libros está dentro de lo que la sección 107 de la Ley del Copyright reconoce como Fair Use, ya que literalmente los libros se utilizar como material para entrenar (educar) al modelo 

Con esta sentencia se da un primer respiro a los desarrolladores de LLM, pero con un seria advertencia: la sentencia reconoce este Fair Use solo para libros que estas empresas hayan adquirido legalmente ya sea en papel o digital, pero NO para los que hayan bajado de sitios piratas 

El problema es que Anthropic y seguramente no es la única, utilizó para entrenar sus LLM y crear su biblioteca central (una especie de repositorio de datos de todo lo que se publica) tanto libros que compraron como libros que bajaron de estos sitios poco respetuosos con el Copyright y ahí es donde la sentencia está en el aire a la espera de evaluar el potencial daño 

Hay un párrafo de la sentencia que me parece muy significativo de como se entiende la ley: si te bajas un libro de un site pirata aunque luego te lo compres sigue siendo una infracción del derecho. Lo que cierra la puerta de momento a futuras expiaciones en nombre de la innovación 

por supuesto que esta sentencia NO será la ultima y tampoco crea la jurisprudencia aplicable en estos casos por que la IA ha abierto una brecha en el concepto de obra original, tal como ya vimos el año pasado en una demanda de dos medios contra OpenAI, ya que los bots como ChatGPT o Claude crean respuestas originales basadas en datos con los que han sido entrenados los LLM que usan, pero no reproducen literalmente nada

Como veis esta nueva forma de creación se parece sospechosamente a lo que ha sido siempre, autores que se basan en la obra previa de otros autores, y la diferencia ahora es básicamente la escala 

Tuesday, April 22, 2025

La pirámide invertida: Taxonomía de Bloom, IA y los nuevos estudiantes

La IA es una tecnología de propósito general (GPT), como la electricidad, un principio más que conocido pero que sin embargo es la base para comprender su evolución y aplicaciones sin caer en el vaciado tópico de tecnología revolucionaria o incluso disruptiva 

Lo que esta pasando en la actual fase de la IA es que hay un grupo de empresas que están tratando de crear un producto vendible  que sepa de todo con la paradoja de que lo realmente esta ocurriendo es que determinados grupos y segmentos están aprovechando estos modelos IA como herramientas para delegar tareas, algo que en la teoría económica solemos asociar a aumentos de productividad  

Como era más que previsible un grupo adelantado (early adopter) en la adopción y uso de los modelos LLM son los estudiantes universitarios, y concretamente los que estudian grados de computación, matemáticas y ciencias naturales, un dato que corrobora un reciente estudio del uso de Claude realizado por Anthropic

El estudio señala además una tendencia no se si preocupante pero si significativa de una cierta nueva etapa en los modelos de aprendizaje: 

que los estudiantes tienden a delegar en los modelos IA las tareas cognitivamente más complejas, según la más que citada Taxonomía de Bloom, como Crear algo nuevo y Analizar y a delegar en menor medida las tareas menos complejas como aplicación práctica y recordar lo aprendido 

Esto significa que en un modelo como Claude la Pirámide de objetivos de conocimiento de Bloom esta invertida del todo, teniendo en cuenta siempre que se refiere a este grupo limitado de early adopters lo que no sirve demasiado para sacar conclusiones generales de todos los estudiantes y todos los grados 

Hay sin embargo aquí una reflexión importante: ¿por que no iban a delegar funciones en una herramienta asumiendo que los resultados son al menos satisfactorios de cara a los objetivos? 

Si diseñamos sistemas educativos con exámenes donde el objetivo se alcanza superando pruebas, es lógico usar la IA para superarlas con el mínimo esfuerzo intelectual, el mismo principio de toda herramienta desde la rueda a la calculadora de bolsillo ¿Qué esperábamos?

Tuesday, February 11, 2025

Si solicitas un trabajo en IA no uses IA: paradojas que muestran valor

A medida que más personas se dan cuenta que la IA hace más rápido que ellas tareas rutinarias y estandarizadas más usos pragmáticos vemos por todas partes

Las formularios de solicitud de un empleo (la mayoría online) es una de esas tareas donde más que destacar se busca no meter la pata y/o alabar la empresa a la que te postulas con argumentos tópicos que si bien no sorprenden al reclutador pero que tampoco molestan 

Os podéis imaginar que pedirle a un modelo LLM que escriba las razones para trabajar en tal o cual empresa o por que te interesa el trabajo es una tarea de esas que parecen hechas para ser respondidas por uno de estos modelos, incluso añadiéndole un poco de refinamiento a las primeras respuestas para que parezcan más originales (aka : más trabajadas)

Esto es una evidencia para (casi) todo el mundo, incluso para las empresas de IA, lo que nos permite escribir sobre un paradójico y reciente caso

Anthropic la empresa que desarrolla Claude advierte esto en sus formularios de solicitud de empleo: 

While we encourage people to use AI systems during their role to help them work faster and more effectively, please do not use AI assistants during the application process. We want to understand your personal interest in Anthropic without mediation through an AI system, and we also want to evaluate your non-AI-assisted communication skills

Traducción mía (no asistida por IA): mientras que aconsejamos a la gente que use IA para hacer su trabajo más rápido y efectivo, por favor NO uses asistentes de IA durante el proceso de selección. Queremos comprender tu interés personal en Anthropic sin la mediación de IA y también evaluar tus habilidades comunicativas 

¿Paradójico? puede, pero también nos muestra el margen humano que las empresas siempre van a buscar. Tu expresión personal (que en teoría es única) y como ordenas tus pensamientos , algo sobre lo que insisto y que choca cada vez más con la incredulidad de un público que como todo organismo tiende al mínimo esfuerzo