AIGoogle DeepMindAI EvaluationConfidential Computing
이중맹검 AI 평가: 기밀 벤치마크와 비공개 모델을 함께 지키다
Google DeepMind와 외부 평가 기관들이 모델 가중치와 비공개 평가 문항을 서로 공개하지 않고 보안 엔클레이브 안에서 실행하는 이중맹검 AI 평가 파일럿을 공개했다.
0 views
로딩 중...
검증 가능한 AI 에이전트와 개발자 도구를 만들고,
여러 오픈소스 생태계에 재현 가능한 수정과 테스트를 기여합니다.
Google DeepMind와 외부 평가 기관들이 모델 가중치와 비공개 평가 문항을 서로 공개하지 않고 보안 엔클레이브 안에서 실행하는 이중맹검 AI 평가 파일럿을 공개했다.
Anthropic과 HHMI Janelia가 AI 에이전트가 실험실·제조 장비를 공통 인터페이스로 발견하고 제어하도록 하는 Model Hardware Standard 연구 프리뷰를 공개했다.
Anthropic이 향후 Claude 모델에 SynthID-Text 기반 워터마크를 전 세계적으로 적용하고 탐지 API를 제공할 계획을 공개했다.
지금 읽기 좋은 글
Google DeepMind와 외부 평가 기관들이 모델 가중치와 비공개 평가 문항을 서로 공개하지 않고 보안 엔클레이브 안에서 실행하는 이중맹검 AI 평가 파일럿을 공개했다.
소스 코드 / 메모
@coyaSONG