응답 장황함, 에이전트 내레이션, 작업 범위 설정, 하위 에이전트 위임, 자체 수정, 사고 비활성화 시 출력 아티팩트를 다루는 Claude Opus 5의 동작 차이와 프롬프트 패턴입니다.
모범 사례 프롬프트 엔지니어링
응답 장황함, 에이전트 내레이션, 작업 범위 설정, 하위 에이전트 위임, 자체 수정, 사고 비활성화 시 출력 아티팩트를 다루는 Claude Opus 5의 동작 차이와 프롬프트 패턴입니다.
이 가이드에서는 Claude Opus 5에 특화된 프롬프트 패턴을 다룹니다. 모델의 기능 및 API 변경 사항은 Claude Opus 5의 새로운 기능을 참조하세요. 현재 모든 Claude 모델에 적용되는 기법은 프롬프트 작성 모범 사례를 참조하세요.
Claude Opus 5는 복잡한 에이전트형 코딩 및 엔터프라이즈 작업을 위해 구축되었으며, 특히 장기 에이전트형 작업에 강점이 있습니다. 기존 Claude Opus 4.8 프롬프트에서도 별도 조정 없이 우수한 성능을 발휘합니다. 다음 패턴은 가장 자주 조정이 필요한 동작을 다룹니다.
Claude Opus 4.8에서 마이그레이션할 때의 API 변경 사항(기본적으로 사고가 활성화되고, 사고 비활성화는 high 노력 수준으로 제한됨)은 마이그레이션 가이드를 참조하세요.
Claude Opus 4.8과 비교했을 때, 프롬프트 작성과 가장 관련 있는 개선 사항은 다음과 같습니다.
low 및 medium 노력 수준은 더 높은 설정에 비해 토큰과 지연 시간은 일부만 사용하면서 강력한 품질을 제공합니다. 기본값(high)으로 시작한 뒤 평가 결과에 따라 조정하세요. 품질이 유지되는 곳에서는 토큰 비용과 응답 시간을 제어하는 주된 수단으로 low와 medium을 적극 활용하고, 까다로운 코딩 및 에이전트형 작업에는 xhigh로 높이세요. 이전 모델의 노력 기본값을 그대로 가져왔다면 자체 평가에서 노력 수준 전반을 다시 측정하세요. 전체 권장 사항은 노력을 참조하세요.Claude Opus 5의 기본 사용자 대상 응답은 이전 Opus 모델보다 더 깁니다. 노력 매개변수는 모델이 말하는 양이 아니라 얼마나 사고하는지를 제어합니다. 노력 수준을 낮추면 사고량은 줄일 수 있지만, 표시되는 응답이 안정적으로 짧아지지는 않습니다. 응답 길이를 제어하려면 명시적으로 요청하세요.
짧고 간결한 지시가 효과적입니다. 예를 들어, 사용자 대상 다중 턴 제품의 경우:
긴 시스템 프롬프트에서는 프롬프트 끝부분에 가까운 곳에 짧은 알림을 함께 배치하세요.
Claude Opus 5는 에이전트형 작업 중에 쉽게 내레이션합니다. 곧 수행할 작업을 알리는 경향이 있고, 에이전트형 세션에서 메시지당 출력도 이전 모델보다 더 긴 경우가 많습니다. 작업 중 사용자와 어떻게 소통할지에 대한 명시적 안내가 도움이 됩니다. 내레이션을 줄이려면 원하는 주기와 형식을 설명하세요.
내레이션을 늘리거나 스타일을 변경하려면 반대 방향에서도 같은 수단이 적용됩니다. 업데이트가 어떤 모습이어야 하는지 명시적으로 설명하고 예시를 제공하세요. 원하지 않는 것을 지시하는 것보다 원하는 소통 스타일의 긍정적 예시가 더 효과적인 경향이 있습니다.
대화의 장황함과는 별개로, Claude Opus 5가 디스크에 작성하는 파일(보고서, Markdown 문서, 요약)은 이전 모델보다 더 긴 경우가 많습니다. 제품에 Claude가 작성한 문서가 포함된다면, 명시적인 길이 기준을 추가하세요.
Claude Opus 5는 지시하지 않아도 자체 작업을 검증합니다. 프롬프트에 명시적인 검증 지시(“사소하지 않은 모든 작업에 최종 검증 단계를 포함하세요”, “검증을 위해 하위 에이전트를 사용하세요”)가 있다면 제거하세요. 이러한 지시는 Claude Opus 5에서 과도한 검증을 유발하며, 제거하면 품질 저하 없이 낭비되는 토큰을 줄일 수 있습니다. 별도의 검증 단계를 추가하는 기존 하니스 스캐폴딩에도 동일하게 적용됩니다.
Claude Opus 5는 작업 범위를 확장하여 요청하지 않은 단계를 추가하거나 작업이 무엇이어야 하는지 자체 판단을 적용할 수도 있습니다. 범위가 좁은 작업에서는 범위를 명시적으로 제한하세요.
Claude Opus 5는 이전 모델보다 하위 에이전트에 더 쉽게 위임합니다. 진정으로 독립적이고 규모가 있는 작업 흐름에서는 위임이 효과적이지만, 작은 작업에 적용하면 비용과 시간이 증가합니다. 하니스가 하위 에이전트를 지원한다면 어떤 시나리오에서 위임할 가치가 있는지에 대한 명시적 지침을 제공하거나, 실행할 수 있는 에이전트 수에 결정론적 상한을 설정하세요. 예를 들면 다음과 같습니다.
Claude Opus 5는 프롬프트 없이도 자신의 실수를 잘 포착하고 수정합니다. 이미 수행하는 재확인을 지시하지 마세요(“답변을 다시 확인하세요”, “응답하기 전에 다시 검증하세요”). 검증 지시와 마찬가지로, 이러한 지시는 모델 자체 동작과 중첩되어 결과를 개선하지 않고 비용만 증가시킵니다.
또한 이 모델은 이전 모델보다 앞서 한 진술에 대한 수정을 더 자주 내레이션하며, 이는 사용자 대상 제품에서 바람직하지 않을 수 있습니다. 중요한 수정에만 수정 내레이션을 제한하려면 다음과 같이 하세요.
Claude Opus 5는 기본적으로 사고가 활성화된 상태로 실행되며, 사고는 노력 수준이 high 이하일 때만 비활성화할 수 있습니다. 마이그레이션 가이드를 참조하세요. 사고를 비활성화하면 모델의 표시 출력에 두 가지 아티팩트가 간헐적으로 나타날 수 있습니다. 두 아티팩트 모두의 주된 완화 방법은 사고를 비활성화하는 대신 사고를 활성화한 상태로 유지하고 더 낮은 노력 수준으로 토큰 비용을 제어하는 것입니다. 대부분의 작업에서 low 노력 수준으로 사고를 활성화하면, 비슷한 비용에서 사고를 비활성화하는 것보다 더 나은 성능을 보입니다.
텍스트로 나타나는 도구 호출. 사고를 비활성화하면 모델이 구조화된 tool_use 블록을 내보내는 대신 사용자 대상 텍스트에 도구 호출을 간헐적으로 작성합니다. 턴은 정상적으로 완료되지만 호출은 실행되지 않으며, 에이전트형 루프에서는 유출된 텍스트가 대화 기록에 남아 이후 턴에도 영향을 미칩니다. 이는 검색과 같이 도구 사용이 많은 워크로드에서 가장 흔합니다.
출력의 내부 XML 태그. 사고를 비활성화하면 모델이 표시 응답에 <thinking> 태그나 기타 내부 XML 태그를 내보낼 수 있습니다. 시스템 프롬프트에 모델에게 사고하지 않거나 추론하지 않도록 지시하는 규칙이 있다면 제거하세요. 그러한 종류의 지시는 태그 유출을 증가시킵니다.
사고를 반드시 비활성화해야 하는 통합의 경우, 하나의 결합된 지시로 두 아티팩트를 모두 완화할 수 있습니다. 도구 호출 전에 말할 수 있는 명시적 권한, 적합한 도구가 없을 때 호출을 강제하지 않는 대안, 내부 태그를 금지하는 일반 규칙을 모델에 제공합니다.
사고 태그를 이름으로 직접 언급하는 지시는 일반적인 형태보다 효과가 떨어지므로, 구체적으로 이름을 언급하지 마세요.
이 페이지가 도움이 되었나요?