DOLPHIN first generates a set of ideas based on the retrieved papers. After filtering ideas, experimental
DOLPHIN은 아이디어 생성, 실험 검증, 결과 피드백의 세 단계를 순환시키는 closed-loop LLM 기반 auto-research 프레임워크로, 실제 실험 결과를 다음 라운드의 아이디어 생성에 반영하여 연구 성능을 지속적으로 향상시킨다.
Debugging with traceback-guided local code
총평: DOLPHIN은 아이디어 생성과 실험 검증 사이의 feedback loop을 실제로 구현하여 auto-research 분야에서 의미 있는 진전을 보인 실용적이고 검증 가능한 프레임워크로 평가된다.