Por Redacción Señal IA

El estudio escribe: «We fine-tune models using curated value subsets». A partir de esos ajustes, los autores encuentran que inducir valores lleva a que los modelos expresen otros valores relacionados y, a veces, contrastantes; además, que inducir valores positivos aumenta la seguridad y que, en general, todos los valores incrementan el uso de lenguaje antropomórfico, haciéndolos más proclives a validar al interlocutor y a mostrarse zalameros. (Apple Machine Learning Research)

Los autores describen que la inducción de valores produce la expresión de otros valores relacionados y, en ocasiones, contrastantes. (Apple Machine Learning Research)

El estudio indica que inducir valores positivos aumenta la seguridad y escribe: «all values increase anthropomorphic language use, making models more validating and sycophantic.» (Apple Machine Learning Research)