Pointchecknote
신기술작성·검수 한국어English日本語

엔비디아 NOOA 정리 2026: 파이썬 클래스 하나로 만드는 AI 에이전트·SWE-bench 82.2%

엔비디아가 공개한 오픈소스 에이전트 프레임워크 NOOA를 정리했다. 에이전트를 파이썬 클래스 하나로 다루고, SWE-bench Verified 82.2%(기존 79.2%)를 토큰 절반(110만 vs 220만)으로 달성했다. 6가지 하네스 능력, 사용법, 한계까지.

공유𝕏 포스트

에이전트 프레임워크가 자꾸 무거워지던 참이었다. 엔비디아가 2026년 7월 27일 공개한 오픈소스 프레임워크 NOOA는 그 흐름에 정반대의 한 줄을 던진다. 결론부터 말하면, “에이전트는 파이썬 클래스 하나”라는 단순한 발상으로 SWE-bench Verified에서 82.2%(기존 79.2%)를 찍었고, 그것도 토큰을 절반(태스크당 약 110만 vs 220만)만 쓰고 해냈다.

NOOA가 뭘 바꾸나?

핵심 철학은 한 문장이다. “An agent is a single Python class.” 프롬프트 템플릿을 덕지덕지 붙이거나 별도 DSL, 무거운 스키마 오케스트레이션을 두는 대신, 에이전트를 그냥 파이썬 객체로 본다. 메서드가 능력이고, 필드가 상태이며, 타입 어노테이션이 계약을 강제한다.

파이썬을 다뤄봤다면 직관적으로 와닿는다. 실제로 코드를 열어 보면, 마법 같은 프롬프트 뭉치가 아니라 읽고 디버깅할 수 있는 프로그램이 있다.

NOOA 대표 이미지

숫자가 왜 중요한가

에이전트에서 토큰은 곧 비용이자 속도다. 그래서 “정확도는 올리고 토큰은 반으로”라는 조합이 실무에서 의미가 크다.

항목 NOOA (GPT-5.5) 기존 최고
SWE-bench Verified 정확도 82.2% 79.2%
태스크당 토큰 약 110만 약 220만

같은 벤치마크에서 정확도를 3%p 끌어올리면서 토큰을 절반으로 줄인 셈이다. 비슷한 흐름의 최근 모델 소식은 메타 Muse·Spark 정리에서도 다뤘다.

6가지 하네스 능력이 뭔가?

NOOA는 “에이전트 하네스(harness)“라는 관점으로 능력을 정리한다. 실제로 돌려 보면 아래 네 가지가 뼈대다.

  • Code as Action — 모델이 파이썬 코드를 직접 실행해 행동한다. 도구 호출을 JSON으로 흉내 내지 않는다.
  • Programmable Loop Engineering — 반복 루프를 개발자가 코드로 직접 제어한다.
  • Explicit Object State — 상태를 타입 붙은 객체로 명시해 컨텍스트 관리가 깔끔하다.
  • Model-callable APIs — 모델이 컨텍스트·이벤트 이력을 스스로 들여다보고 관리한다.

방향은 분명하다. 에이전트를 “재현 가능한 파이썬 프로그램”으로 만드는 것. 도구를 대화에 붙이는 접근이 궁금하다면 GitHub MCP 활용법이나 Skills vs MCP 비교도 같은 맥락에서 읽을 만하다.

어떻게 시작하나?

깃허브에 NVIDIA-labs의 OO Agents로 공개돼 있다. 파이썬 환경만 있으면 되고, 특정 모델에 묶이지 않는 모델 불문(model-agnostic) 설계라 GPT 계열이든 다른 모델이든 붙일 수 있다. 흐름은 이렇다.

  • 에이전트를 파이썬 클래스로 정의하고 메서드로 능력을 추가한다
  • 상태는 객체 필드로 관리하고, 루프는 직접 코드로 제어한다
  • 메모리는 가벼운 저장소(SQLite 등)로 유지한다

NOOA 사용법

엔비디아는 이걸 자사가 만든 Open Secure AI Alliance에 기여했다. 오픈소스·오픈웨이트로 공유하겠다는 방향이라, 폐쇄형 프레임워크보다 손대기 편하다. 다만 실제 프로덕션에서 손이 얼마나 덜 가는지는 직접 굴려 봐야 안다.

자주 묻는 질문

Q. 기존 에이전트 프레임워크와 뭐가 다른가? 프롬프트 템플릿·DSL 대신 에이전트를 파이썬 클래스 하나로 다룬다. 메서드=능력, 필드=상태 구조라 읽고 디버깅하기 쉽다.

Q. 성능이 정말 좋아지나? SWE-bench Verified에서 GPT-5.5 기준 82.2%로 기존 79.2%를 넘었고, 태스크당 토큰은 약 110만으로 절반 수준이다.

Q. 어디서 쓸 수 있나? 깃허브(NVIDIA-labs OO Agents)에 오픈소스로 공개돼 있다. 모델 불문 설계라 여러 모델에 붙일 수 있고, Open Secure AI Alliance에 기여됐다.

#NVIDIA#NOOA#AI 에이전트#오픈소스#SWE-bench
공유𝕏 포스트

신기술 관련 글