알파고 ELO Rating 이 4500??

※ 사이트 내부 통합검색
※ 카카오페이로 기부하기

※ 사이트 내부 통합검색

세상의모든계산기2016.11.17 20:18

구글 번역 사이트가 인공신경 지능망으로 업그레이드 되었다고 합니다. (2016-11-16)
그래서 위의 영문을 번역시켜 보았습니다.

저는 Computational Neuroscience / Machine Learning의 박사 과정 학생으로서 AlphaGo Nature 논문의 수석 저자 David Silver가 UCL에서 오늘 연설을했습니다 : http://www.nature.com/nature/journal/v529/n7587/full /nature16961.html 불행히도 사진을 찍지는 않았지만 AlphaGo의 평가 기능에 대한 슬라이드와 각 경기가 진행되는 동안 우승 확률에 대한 평가가 어떻게 달라지는 지 확인할 수있었습니다.

게임이 초기 상태에서 균형을 이루는 지에 대한 관심이 있다고 들었으므로 움직이지 않는 지점에 해당하는 y 축과의 초기 교차점을주의 깊게 살펴 봤습니다. Value Network의 평가에 따르면 흰색은 초기 확률이 50 % 이상인 것으로 나타났습니다. 내 생각에 53 % (25 %의 눈금을 사용했기 때문에 읽는 것이 매우 어려웠습니다)입니다. 대조적으로, 몬테카를로 롤아웃은 거의 정확한 50-50 평가처럼 보였습니다. AlphaGo는 두 가지 평가를 모두 사용하지만 David Silver는 Value Network가 일반적으로 정확하고 AlphaGo의 최신 버전에 더 가중되어 있다고 말했습니다. 그래서 AlphaGo는 흰색 (7.5 komi)이 작은 이점을 가지고 있다고 생각한다고 말하는 것은 공평합니다.

또한, 흥미로운 또 하나의 재미있는 점은 Deepmind의 내부 평가에 따르면 AlphaGo의 ELO가 Lee Sedol (4000 iirc 이상)보다 훨씬 크다는 것입니다. 그러나 David Silver는 AlphaGo가 강화 학습을 통해 버전을 재생하기 때문에 내부 평가를 실제로 신뢰하지 않았기 때문에이를 극복 할 수있는 놀라운 전략을 전혀 알지 못했을 수도 있음을 인정했습니다. 그래서 그들이 흥미 진진한 경기에서 Lee Sedol과 경기를해야했던 이유입니다. (실제로 내부 ELO에 따르면 그들은 아마도 5-0에서 4-1로 예상했을 것입니다)

어쨌든이 재미있는 것을 찾으시기 바랍니다.

와우... 인상적이네요.

▼

전체메뉴

MathJax

XECenter

스케치북 게시판

세상의 모든 계산기 Allcalc