NVIDIA Nemotron 3.5 Lightning, 장기 실행 에이전트를 위한 빠르고 정확한 특화 작업 실행 제공

Originally published at: NVIDIA Nemotron 3.5 Lightning, 장기 실행 에이전트를 위한 빠르고 정확한 특화 작업 실행 제공 - NVIDIA Technical Blog

장기 실행 AI 에이전트는 대부분의 시간을 툴 호출, 결과 검증, 서브 에이전트 작업 위임과 같은 고빈도 실행 단계에 소모합니다. 모든 연산 과정에 프론티어 추론 모델을 사용하면 비용과 지연 시간이 대폭 증가합니다. NVIDIA Nemotron 3.5 Lightning은 총 300억 개(30B)의 파라미터 중 토큰당 30억 개(3B)를 가동하는 오픈 혼합 전문가(MoE) 모델로, 상시 작동하는 에이전트의 실행 레이어를 처리하도록 설계되었습니다.…