Skip to content
AI DEEP 2 sources· 5 min· cluster 1· updated 14:50 UTC

OpenAI, Navier-Stokes 증명을 코드로 옮기는 과정에서 수학을 잘못 번역

New Scientist는 사람을 위한 증명과 컴퓨터를 위한 증명이 서로 맞지 않는다고 전했다.

TL;DR

  1. New Scientist는 OpenAI가 Navier-Stokes 문제를 사람을 위한 증명과 컴퓨터를 위한 증명으로 각각 냈고, 둘이 일치하지 않는다고 전했다. [1]
  2. 보도는 자연어 증명과 Lean 증명 사이의 차이를 찾기 위해 ChatGPT를 쓴 뒤, 제안을 손으로 확인했다고 설명한다. [1]
  3. 두 텍스트가 어긋난다는 사실만으로 어느 증명이 유효한지에 대한 결론이 되지는 않는다. [1]

New Scientist 제목은 OpenAI가 Navier-Stokes 증명을 코드로 옮기며 수학을 잘못 번역했다는 것이다. 기사 설명은 OpenAI가 이 문제의 풀이를 발표할 때 사람을 위한 증명과 컴퓨터를 위한 증명을 하나씩 냈고, 둘이 맞지 않는다고 한다. [1] [1]

보도는 ChatGPT에게 자연어 증명과 Lean 증명 사이의 차이를 찾아보게 한 뒤, 그 제안을 손으로 확인하는 과정을 설명한다. 비교 방법이다. 모델이 제안한 모든 항목이 실제 오류였다는 뜻은 아니다. [1] [1]

두 질문을 나누는 편이 맞다. 하나는 사람이 읽는 논증과 형식화된 Lean 텍스트가 같은 말을 하는지다. New Scientist는 같지 않다고 한다. 다른 하나는 Navier-Stokes 문제의 올바른 증명이 지금 존재하는지다. 이 브리프는 두 번째 질문에 답하지 않는다. [1] [1]

기사는 Hacker News에서도 다뤄졌다. 어느 쪽을 고칠 수 있는지는 수학자들이 텍스트를 봐야 한다. 그 검토가 둘 이상의 기술 설명으로 공개되기 전에는, 확인된 지점은 New Scientist가 설명한 불일치다. [1,2] [1] [2]

Why it matters

형식 증명은 그 형식 텍스트가 사람들이 증명됐다고 믿는 논증과 같다는 주장만큼만 쓸모가 있다. 두 텍스트 사이의 간극은 AI가 도운 수학의 신뢰 문제다.

Editor's note

불일치와 비교 방법은 New Scientist에서 가져왔다. Lean 파일을 여기서 다시 검사하지는 않았다.

Type to search

↑↓ navigate ↵ open esc close