SOLiD
Biztonság és etika
A nagyobb nyelvi modelleket könnyebb lehet őszintén tartani
A FAR.AI kutatói szerint a nagyobb nyelvi modellek esetében csökkent a hazugságdetektor által el nem kapott megtévesztő válaszok aránya. A SOLiD módszer a gyanús…
Biztonság és etikaA hazugságvizsgálók őszintébbé tehetik az AI-t, de vissza is üthetnek
A mesterséges intelligencia hazugságvizsgálókkal történő ellenőrzése megfelelő feltételek mellett őszintébb modellekhez vezethet, rossz beállításokkal viszont a…