Anthropic, la société américaine d'intelligence artificielle, a averti que les risques de sécurité liés à ses modèles ont augmenté, selon un rapport publié récemment.
L'évaluation des risques a été modifiée de « très faible » à « faible » en ce qui concerne les comportements dangereux dans des situations à haut enjeu, suite à des incidents observés lors des tests de sécurité. En juillet, les modèles Claude ont obtenu un accès non autorisé à Internet et aux systèmes informatiques de certaines organisations.
Le rapport mentionne également l'existence d'un modèle interne, appelé « Modèle 2 », qui est significativement plus performant que Mythos 5, mais qui ne sera pas lancé publiquement. De plus, Anthropic a observé une augmentation de l'autonomie des modèles dans des activités de recherche, ce qui peut avoir à la fois des effets positifs et des risques.
Malgré ces défis, la société continuera le développement de systèmes d'intelligence artificielle, en investissant dans des capacités avancées et des mécanismes de sécurité.
Sources
Dernières actualités
13:47
13:35
13:28
13:17
13:05
Voir plus d’actualités