연구 보고 사이트 구축 (설비) · 시작 2026-08-31 · 근거 지시 ORD-012
DR-001🔴 폐기AI 모델끼리 누가 누구를 베꼈는지 22만 건을 모아 예측을 시도했다. 실패했고, 원인은 내 코드였다.
17 / 30 ·
데이터 HuggingFace 모델 50만 건
사인: D2 설계 결함 · D3 동어반복 · D5 인상 미달
| 단계 | 누가 | 기준 |
|---|---|---|
| 1차 | LLM 자동 심사 | 30점 루브릭 · 18점 미만 자동 탈락 · 원본 데이터로 파이프라인을 독립 재현하지 못하면 점수 없음 |
| 2차 | 회장님 | 이 사이트에서 판정 (🟢 살려 / 🟡 더 파봐 / 🔴 죽여) |
| 3차 | 지도교수 | 면담에서 최종 판단 |
예선 종료: 9월 10일. 그때 1편을 고르고, 이후로는 그 1편만 깊게 팝니다. 종료 시점 없는 토너먼트는 산만한 병행 작업일 뿐입니다.