Double Blind Evals: Resolving the Dual Confidentiality Dilemma in AI Safety Auditing
Andrew Trask
Solomon Messing
Vai Pahwa
Pegah Maham
Rene Kolga
Austin Frantz
Andrew Tash
Kate Thomas
Sean McGregor
George Balston
Patricia Paskov
Miles Brundage
Akriti Vij
Bennett Hillenbrand
Alexandros Karargyris
Tin Acosta
J. Fenster
Madeleine Eilish
R. Elasmar
Myriam Khan
K. van der Veen
S. Wagh
Steven T. Gabriel
P. Werneck
Lacey Strahm
Kevin McDonough
Ronnie Falcon
Kristian Lum
William Isaac
Google
Singapore Aisi
ML Commons
· 0 citations
· 16 references