
뮤즈 코드(Muse Code)를 소개합니다. 뮤즈 스파크 1.2로 구동되는 터미널 코딩 에이전트로, 지속적인 백그라운드 에이전트, 리포지토리 규모의 실행, 그리고 내장된 검증 기능을 갖추고 있습니다.
Loading comments…
제작자
kettle_dev
웹사이트 방문
research.meta.ai/blog/introducing-muse-code-and-muse-spark-1-2
프로젝트 정보
제품 키워드
Muse Code는 Muse Spark 1.2 모델로 구동되는 터미널 코딩 에이전트로, 대규모 저장소에서 복잡한 소프트웨어 엔지니어링 작업을 처리하도록 설계되었습니다. macOS 또는 Linux의 명령줄에서 변경 사항을 계획하고, 코드를 작성하며, 결과를 검증합니다. 이 도구는 간단한 에이전트 루프와 지속적인 백그라운드 에이전트를 결합하여, 수동 조정을 줄이고 정확성을 높여 다단계 문제를 해결할 수 있습니다.
Muse Code는 작업별로 에이전트를 생성하는 대신, 전체 세션 동안 전문화된 백그라운드 에이전트를 유지합니다. 이 에이전트들은 다음 단계를 독립적으로 수행하고 보고 시점을 스스로 결정하여, 중복 정보 수집을 줄이고 어렵고 다단계 작업의 지연 시간을 낮춥니다.
모든 모델 호출, 도구 실행, 승인 및 편집은 로컬 이벤트 로그에 추가됩니다. 이 단일 진실 소스는 런타임을 재생 정확하고 재시작 안전하게 만들어, 크래시 후 에이전트가 중단된 지점에서 정확히 재개됩니다—처음부터 다시 시작할 수 없는 장기 실행 작업에 이상적입니다.
Muse Code는 세 가지 기본 스킬을 제공합니다: /plan은 작업을 승인 게이트가 있는 계획으로 변환하고, /grill은 그 계획이 견고해질 때까지 스트레스 테스트하며, /goal은 지정된 목표의 성공적 완료를 향해 에이전트를 이끕니다. 이러한 내장 명령은 추가 설정 없이 구조화된 제어를 제공합니다.
기본 모델은 Muse Code 자체와 공동 훈련되었으며, 거부 샘플링 하네스 궤적과 목표, 압축, 하위 에이전트에 대한 레시피 최적화를 사용합니다. 이러한 긴밀한 결합은 모델이 Muse Code 도구 세트를 구동할 때 특히 최상의 성능을 발휘하도록 보장합니다.
Muse Code는 단순히 코드를 작성하는 것에 그치지 않습니다—실패를 견디고, 하위 에이전트를 조정하며, 전체 저장소에 걸쳐 자신의 작업을 검증합니다.
지속적인 백그라운드 에이전트와 크래시 안전 이벤트 로그의 결합은 터미널 코딩 도구에서 드뭅니다. 대부분의 에이전트는 실패 시 컨텍스트를 잃거나 처음부터 다시 시작하지만, Muse Code의 재생 정확 런타임은 24시간 동안 1,000회 이상의 도구 호출이 포함된 커널 최적화 사례 연구와 같은 장기 작업이 궤도를 유지하도록 합니다. 번들 /grill 스킬은 또한 계획이 견고해질 때까지 밀어붙이는 스트레스 테스트 레이어를 추가하여, 일반적인 코드 생성 이상의 기능을 제공합니다.
터미널에서 작업하며 단일 실수가 연쇄적으로 이어질 수 있는 크고 복잡한 저장소를 정기적으로 마주하는 개발자라면, Muse Code의 지속적인 하위 에이전트와 재시작 안전 설계는 컨텍스트를 잃거나, 지속적인 지원이 필요하거나, 작업 중 크래시를 견디지 못하는 에이전트에 대한 불만을 직접 해결합니다. 또한 GPU 커널과 같은 성능 중요 코드에서 반복적인 컴파일-프로파일-개선 루프가 필요하고, 시간이 지나도 탈선하지 않고 집중력을 유지할 수 있는 에이전트가 필요하다면 강력한 선택입니다.
고려해볼 만한 다른 도구