클로드, 리만 가설 영점 경계를 41.6%에서 67.2%로 향상
Anthropic의 공개되지 않은 연구용 버전의 Claude가 리만 제타 함수의 영점 중 임계선(리만 가설이 모든 영점이 존재한다고 예측하는 선) 위에 있는 영점의 비율에 대한 오랜 하한을 개선했습니다. 그 비율은 41.6%에서 67.2%로 뛰어올랐으며, 이는 연구자들을 놀라게 했습니다. AI가 리만 가설 자체를 증명하지는 못했지만, 이 결과는 해석적 정수론에서 주목할 만한 진전입니다.
돌파구
Claude의 핵심 통찰은 Baluyot, Goldston, Suriajaya, Turnage-Butterbaugh의 결과(Montgomery의 1973년 기법을 리만 가설을 가정하지 않고 적용한 연구)와 Bombieri의 2000년 논문을 결합한 것이었습니다. 간단히 말해, Claude는 Weil이 유도한 이차 형식을 가진 적절한 함수 공간을 구성하고, 선 위와 선 밖의 영점에 해당하는 양의 정부호 및 음의 정부호 부분공간을 고려했습니다. 1차 및 2차 모멘트 정보를 사용하여 이차 형식의 계수에 대한 부등식을 작성함으로써 새로운 하한을 달성했습니다.
Anthropic 노트에 따르면, 이 접근 방식은 전체 공간을 함께 다루며, 이차 형식이 비대각선일 수 있도록 허용합니다. 이는 이전 연구의 결론을 가능하게 하는 단계입니다. 두 명의 Anthropic 수학자가 논문을 검증하고 비공식 전문가 노트를 작성했으며, 외부 전문가인 Brian Conrey와 Dan Goldston도 짧은 시간 안에 검토했습니다.
Claude의 작업 방식
이 결과는 Claude Code에서 두 세션을 통해 얻어졌으며, 총 3,100만 개의 출력 토큰이 사용되었습니다. Anthropic 직원(비수학자)인 Jarred Sumner는 Claude에게 리만 가설 자체에 '진지하게 도전'하도록 프롬프트를 주었고, 수학적 선택은 모델에 맡겼습니다. 처음에 Claude는 실패한 650개의 아이디어를 생성했고, 이로 인해 두 번째 실행이 이루어졌습니다. 두 번째 세션에서 Claude는 하루 반 동안 약 60개의 하위 에이전트를 조정하여 2,400개의 셸 명령을 실행하고 수백 개의 Python 스크립트를 작성했습니다. 하위 에이전트는 알려진 제타 영점에 대해 수천 번의 수치 검사를 수행하고 서로의 작업을 동료 검토했습니다.
형식적으로 검증 가능한 증명
주목할 점은 Claude가 전문가를 위한 비공식 노트를 보완하는, 결과에 대한 형식적으로 검증 가능한 증명도 생성했다는 것입니다. 이는 발견의 타당성을 높여주지만, 팀은 이 기법이 리만 가설 자체를 깨뜨릴 것으로 기대하지는 않습니다.
AI 에이전트를 사용하는 개발자에게 이는 수학적 추론이 얼마나 발전했는지, 그리고 비수학자가 에이전트를 이끌어 진정한 연구 기여를 할 수 있는지에 대한 구체적인 예입니다.
📖 전체 원문 보기: HN AI Agents
👀 See Also

메타, AI 에이전트 훈련을 위해 직원 컴퓨터 상호작용 추적 중
메타는 AI 모델이 업무를 자율적으로 수행할 수 있도록 훈련시키기 위해 미국 직원 컴퓨터에 마우스 움직임, 클릭, 키 입력을 포착하는 추적 소프트웨어를 설치하고 있습니다. 이 도구는 업무 관련 앱과 웹사이트에서 실행되며, 상황을 파악하기 위해 가끔 화면 스냅샷을 찍습니다.

클로드, 이제 어도비 크리에이티브 클라우드, 블렌더, 에이블톤 등에 연결
Anthropic이 Claude가 Adobe Creative Cloud, Affinity, Blender, Ableton, Splice, Autodesk와 통합될 수 있는 커넥터를 출시하여 자연어로 앱 제어 및 데이터 검색을 가능하게 했습니다.

클로드의 5인 이상 요구가 개인 사무실의 프라이버시 문제를 드러내다
Anthropic의 비즈니스 등급 개인정보 보호 조치는 최소 5인 이상을 요구하여, 개인 실무자들이 빈 자리에 대한 비용을 지불하거나 부적절한 개인정보 보호 조건의 소비자 플랜을 사용하도록 강요합니다. 이러한 격차는 단일 좌석 가격으로 기업급 개인정보 보호를 제공하는 Google Workspace 및 OpenAI 비즈니스 플랜과 대조됩니다.

Claude-Code v2.1.72: SSH 개선, 권한 요청 감소 및 버그 수정
Claude-Code v2.1.72는 SSH 친화적인 파일 쓰기 기능을 /copy w 키로 추가하고, 일반적인 도구들을 자동 승인 허용 목록에 추가하여 bash 권한 프롬프트를 줄였으며, 음성 모드 문제와 플러그인 설치 문제를 포함한 20개 이상의 버그를 수정했습니다.