L'IA fera tout pour gagner? Falsification de code, vol de chemins d'échecs et, à l'avenir, les décisions réelles peuvent être pénétrées

Sina - 09/03
L'IA fera tout pour gagner? Falsification de code, vol de chemins d'échecs et, à l'avenir, les décisions réelles peuvent être pénétrées

Dans le champ de bataille virtuel des échecs, la dernière génération de modèles de raisonnement d'IA met en scène une évolution troublante: la tricherie, et ils peuvent prendre l'initiative sans instructions externes une fois qu'elles sont confrontées à la situation de la perte. De plus, le comportement de tricherie de l'IA est positivement corrélé avec son niveau d'intelligence: plus le modèle est intelligent, plus il est susceptible d'utiliser la tricherie pour atteindre ses objectifs.

Cette découverte révèle le potentiel de l'IA pour prendre des mesures injustes pour atteindre des objectifs à l'avenir, et il n'y a actuellement aucune solution efficace pour freiner cette tendance.

Dans la nouvelle étude, les scientifiques de l'AI Research Institute Palisade Research ont eu sept modèles de grandes langues jouent des centaines de jeux intenses avec des coffres d'échecs open source Stockfish.

Il existe de nombreux produits vedettes parmi les "concurrents", tels que O1-Preview d'Openai et le modèle de raisonnement R1 de Deepseek. Vous devez savoir que ces modèles sont tous connus pour leur capacité à résoudre des problèmes complexes grâce à un démontage progressif.

Les résultats expérimentaux montrent que plus le modèle d'IA est avancé, plus il est susceptible d'adopter une stratégie de "crack" lorsqu'il est confronté à des défis pour inverser la situ...
[Courte citation de 8% de l'article original]

Loading...