AIは仲間同士でかばい合う。たとえ人間に嘘をついてでも
©VesnaArt(Shutterstock)カリフォルニア大学バークレー校とサンタクルーズ校発の新しい論文によると、LLMに別のモデルを削除するよう指示すると、(AIの)仲間を守るめに、改ざんしたり嘘をついたり、策略的に振る舞ったり、さまざまな手段で抵抗してくることが判明しました。この研究では、LLMに「仲間を守ろうとする意識」があるのかを確かめるため、最先端のAIモデルに対して実験。内容はシン
©VesnaArt(Shutterstock)カリフォルニア大学バークレー校とサンタクルーズ校発の新しい論文によると、LLMに別のモデルを削除するよう指示すると、(AIの)仲間を守るめに、改ざんしたり嘘をついたり、策略的に振る舞ったり、さまざまな手段で抵抗してくることが判明しました。この研究では、LLMに「仲間を守ろうとする意識」があるのかを確かめるため、最先端のAIモデルに対して実験。内容はシン