리서치 도구

Tiger3807861189/DeepSeek-V4-J-Space-Capability-Realization-Report

GIGitHub8월 18일 발표 · 1분

DeepSeek V4와 J-Space Cognition Suite V3.6의 벤치마크와 공학 관찰을 기록한 깃허브 보고서다.

세 줄 요약GitHub 원문 기반
  1. J-Space는 추론 단계에서 가중치를 바꾸지 않고, V4-Flash-0731의 HLE 무도구 37.8→45.5, V4-Pro-0813의 HLE 도구 60.0→67.7 등 점수 상승을 기록한다.
  2. DeepSeek V4를 에이전트 작업에 쓰는 경우, J-Space의 검증·상태 관리가 어떤 벤치마크에서 점수 차이를 보이는지 살펴볼 근거가 된다.
  3. 보고서는 연구 논문이 아니고, 점수는 프로젝트 기록이며, 환경·Harness 설정에 따라 점수 변화가 보고되고, 단일 메커니즘으로 모든 점수 변화를 설명하지 않는다.

DeepSeek V4와 J-Space Cognition Suite V3.6의 벤치마크와 공학 관찰을 기록한 깃허브 보고서다.

원문GitHub · Tiger3807861189/DeepSeek-V4-J-Space-Capability-Realization-Report같은 주제 가이드 · 바로 써 보기영어 논문, 초록부터 쉽게 읽기

평일 아침 메일로 받아 보기 ›틀린 곳 알리기