이놈의 충돌처리가 단순 연산만으로 작동하는게 아니고 케이스 바이 케이스로 처리할게 많아서 분기가 많다. 그러다보니 병렬화가 어렵다. 나름 죽도록 병렬화 했다고 생각하는데 실제 코드의 50%정도밖에 병렬화가 안되는것 같다.
코드 최적화는 할만큼 한거 같고 나머지는 GPU스펙에 달린듯.
이하는 NV Visual Profiler로 돌린 화면.
컴퓨팅 활용도 72.4%면 할만큼 했다고 생각한다. 매트릭스 연산이나 영상처리가 아닌지라 더 이상은 무리.
여기에 파일을 끌어 놓거나 파일 첨부 버튼을 클릭하세요.
파일 크기 제한 : 0MB (허용 확장자 : *.*)
파일 업로드 중... (0%)
CUDA 충돌처리 현재까지 진행상황
64비트로 gogo
CUDA 첫 프로그램. 시작은 미약하지만.. [2]
프레임 자랑질. [2]
Depth of Field 구현중
주말동안 작업 내용-라이트맵 관련 [3]
계속 개선중인 라이트맵
라이트맵 엣지 블랜딩 관련
64비트 릴리즈 모드 테스트
6core Xeon*2 + GTS250 CDUA 라이트맵 렌더링
엔진 64비트 포팅 프로젝트 진척상황
주말동안 작업내용 [1]
CUDA로 구현한 충돌처리 [5]
요새 관심사는... [2]
nVidia Visual Profiler 4.1로 돌린 결과
TFS Backup Plan 삭제 방법
사내 스트레스 테스트 [16]
3D엔진 및 네트웍 솔루션 x64 포팅 프로젝트 대충 완료 [4]
간단한 눈 처리 [4]
새로 만든 서버용 네트웍 컴포넌트 I4DyuchiNET2.0 [2]
로그인 유지