리서치 도구
Tiger3807861189/DeepSeek-V4-J-Space-Capability-Realization-Report
GIGitHub
DeepSeek V4와 J-Space Cognition Suite V3.6의 벤치마크와 공학 관찰을 기록한 깃허브 보고서다.
세 줄 요약
- J-Space는 추론 단계에서 가중치를 바꾸지 않고, V4-Flash-0731의 HLE 무도구 37.8→45.5, V4-Pro-0813의 HLE 도구 60.0→67.7 등 점수 상승을 기록한다.
- DeepSeek V4를 에이전트 작업에 쓰는 경우, J-Space의 검증·상태 관리가 어떤 벤치마크에서 점수 차이를 보이는지 살펴볼 근거가 된다.
- 보고서는 연구 논문이 아니고, 점수는 프로젝트 기록이며, 환경·Harness 설정에 따라 점수 변화가 보고되고, 단일 메커니즘으로 모든 점수 변화를 설명하지 않는다.
DeepSeek V4와 J-Space Cognition Suite V3.6의 벤치마크와 공학 관찰을 기록한 깃허브 보고서다.