단위 9 / 10

올바른 모델 선택: 의사결정나무 및 모델 포트폴리오

이득:

  • 모델 선택을 7가지 핵심 질문이 포함된 구조화된 의사 결정 트리로 전환
  • 의사결정나무를 실제 비즈니스 시나리오에 적용하여 모델을 제안하는 능력
  • 단일 모델에 의존하지 않고 모델 포트폴리오 구축의 장점과 부담 평가

우리는 제공자, 암시적/명시적 가중치, 컨텍스트, 다중 양식, 비용, 계층 및 데이터 주권이라는 8개 단위에 걸쳐 조각을 수집했습니다. 이제 이러한 조각들을 단일 결정 메커니즘으로 결합할 때입니다. 이 단원의 목적은 "어떤 모델인가?"라는 질문에 대답하는 것입니다. 더 이상 직관으로 질문에 답할 수 없고 구조화된 의사 결정 트리를 사용하면 됩니다. 또한 성숙한 조직이 단지 하나의 모델이 아닌 모델 포트폴리오에 관심을 갖는 이유도 알게 될 것입니다. 단원이 완료되면 의사결정 트리를 실제 비즈니스 시나리오에 적용하고 자신만의 포트폴리오 초안을 작성할 수 있습니다.

7가지 질문 결정 트리

모델 선택을 7가지 질문으로 줄일 수 있습니다. 이러한 질문에 순서대로 대답하면 거의 자동으로 올바른 후보자를 찾을 수 있습니다.

  1. 데이터가 민감한가요? 개인/기밀 데이터를 처리하는 경우 → 데이터 주권(명확한 가중치, 지역, 보존 0)이 먼저 결정됩니다. 그렇지 않으면 유연성이 향상됩니다.
  2. 작업이 얼마나 어려운가요? 단순/강력함 → 가벼운 수준. 복잡/다단계 → 강한 단계 + 추론.
  3. 볼륨이 얼마나 되나요? 볼륨이 매우 높음 → 속도와 비용이 우선시되고 가벼운 범위로 기울어집니다. 소량 → 품질에 투자할 수 있습니다.
  4. 문서/컨텍스트의 크기는 얼마나 됩니까? 긴 문서 → 넓은 컨텍스트 창이 필수입니다. 짧은 텍스트 → 작은 창이면 충분합니다.
  5. 영상/음향이 있나요? 가능한 경우 → 다중 모드 모델 필수. 그렇지 않으면 텍스트 모델로 충분합니다.
  6. 예산 민감도란 무엇입니까? 높으면 → 단계 최적화, 캐시, 배치; 어쩌면 오픈 웨이트 일 수도 있습니다. 낮은 경우 → 품질 우선.
  7. 팀과 인프라는 어떤가요? 기술팀이 없으면 → 폐쇄형 웨이트, 인터페이스 준비. 강한 팀이 있는 경우 → 오픈 웨이트 옵션이 테이블 위에 있습니다.
팁: 이 7가지 질문에 답하면 일반적으로 후보 모델 풀이 1~2개 모델로 좁아집니다. 의사결정 트리의 목적은 하나의 "정답"을 강요하는 것이 아니라 옵션을 신속하게 제거하고 약간의 파일럿을 통해 나머지 옵션을 더 쉽게 테스트할 수 있도록 하는 것입니다.

의사결정나무를 테이블에 넣기

질문

답변 → 리디렉션

데이터가 민감한가요?

예 → 보관 전 중량/지역/제로 오픈

그 일이 어려운가요?

예 → 강함 + 추리 / 아니오 → 온화함

볼륨이 높은가요?

있음 → 속도 및 비용 우선(경량)

문서가 크나요?

예 → 더 넓은 맥락

비주얼이 있나요?

예 → 다중 모드 필수

예산이 제한되어 있나요?

예 → 최적화 + 아마도 오픈 웨이트

기술팀이 있나요?

없음 → 폐쇄/준비 인터페이스

이 테이블은 체크리스트처럼 작동합니다. 각 행을 선택하고 결과 프로필을 조합합니다. 예를 들어, "데이터 민감성 + 작업 어려움 + 적은 양 + 기술 팀 사용 가능" 프로필은 자체 서버에서 실행되는 강력한 개방형 모델로 안내할 가능성이 높습니다.

단일 모델이 아닌 포트폴리오

경험이 풍부한 기관은 단일 모델로 모든 작업을 수행하는 것이 가장 저렴하지도 않고 가장 좋은 방법도 아니라는 것을 잠시 후에 깨닫게 됩니다. 대신 작업에 따라 다양한 모델을 사용하여 모델 포트폴리오를 구축합니다. 논리는 간단합니다.

  • 단순하고 부피가 큰 작업 → 가볍고 저렴한 모델.
  • 복잡하고 중요한 작업 → 강력한 모델.
  • 기밀 데이터 처리 작업 → 가중치/지역 모델 공개.
  • 시각적 작품 → 다중모달 모델.

포트폴리오 접근 방식에는 두 가지 주요 이점이 있습니다. 첫 번째는 비용 최적화입니다. 각 작업은 필요한 만큼 강력한 모델을 통해 수행되며 추가 비용을 지불하지 않습니다. 둘째, 제공자 독립성: 단일 제공자에게 의존하지 않습니다. 누군가 가격을 인상하거나, 정책을 변경하거나, 서비스를 중단하는 경우 대안이 준비되어 있습니다. 이를 "공급업체 종속 방지"라고 합니다.

주의: 포트폴리오 접근 방식은 무료가 아닙니다. 여러 모델을 관리 및 모니터링하고 일관된 품질을 보장하면 오버헤드가 추가됩니다. 소규모 팀인 경우 균형 잡힌 단일 모델로 시작하고 비즈니스가 성숙해짐에 따라 포트폴리오로 이동하는 것이 더 현명한 경우가 많습니다. 필요보다 일찍 포트폴리오를 구축하면 경영상의 혼란이 생길 ​​수 있다.

포트폴리오 예시

다음은 중간 규모 서비스 회사가 구축할 수 있는 샘플 포트폴리오입니다.

사업 유형

샘플 작업

선택한 모델 유형

왜?

대용량 분류

댓글/티켓 태깅

약간 떨어져

저렴하고 빠르며 충분합니다

일반 콘텐츠 제작

이메일, 초안 설명

균형이 잡혀있다

좋은 균형

복잡한 분석

계약 리스크 검토

강력 꺼짐(더 넓은 맥락)

정확성이 중요함

기밀 데이터 처리

금융/환자 데이터 분석

오픈 웨이트(자체 서버)

데이터가 안 나가요

시각적 처리

송장/사진 판독

다중 모드

시각적 요구 사항

이 표는 "어떤 모델을 사용하십니까?"라는 한 문장 질문을 바탕으로 작성되었습니다. 이는 해당 질문이 실제로 잘못된 질문임을 보여줍니다. 정답은 "어떤 직업에 어떤 모델이요?" 입니다.

세 가지 현실적인 사례: 의사결정나무 적용

사례 1 — 소규모 법률 회사. 5명으로 구성된 사무실에서 계약을 요약하려고 합니다. 의사결정 트리: 데이터에 민감함(예, 그러나 명시적인 동의 및 계약이 있으면 관리 가능) → 작업 어려움(예) → 볼륨 낮음(월 최대 100) → 문서가 큼(예, 40페이지 이상) → 이미지 없음 → 예산 중간 → 기술 팀 없음. 결과: 보존 계약이 없는 기성 인터페이스에서 대규모 컨텍스트의 강력하고 폐쇄형 가중치 모델을 활용합니다. 볼륨이 낮아서 강력한 무대의 비용을 감당할 수 있습니다.

사례 2 - 전자상거래 운영. 20명으로 구성된 팀에는 제품 설명(많은 양), 고객 리뷰 분류(매우 많은 양), 송장 이미지에서 데이터 추출(중간 양, 시각적)의 세 가지 작업이 있습니다. 단일 모델 대신 포트폴리오: 명세서에 대한 균형 잡힌 모델, 설명에 대한 가벼운 모델, 송장에 대한 다중 모드 모델. 따라서 각 직업에 대한 적절한 비용과 재능이 떨어집니다. 총 비용은 강력한 모델이 모든 작업을 수행하도록 했을 경우의 비용의 약 1/3로 줄어듭니다.

사례 3 — 공공 기관. 공공기관에서는 시민 지원서를 요약하고 싶어하지만 해당 데이터는 개인 데이터이므로 해외로 유출할 수 없습니다. 의사결정 트리는 첫 번째 질문에서 충돌합니다. 데이터는 민감하고 주권은 필수입니다. → 명시적인 가중치/지역 모델이 우선입니다. 기술팀이 있기 때문에 자체 인프라에서 개방형 가중치 모델을 실행합니다. 다른 질문(난이도, 양)은 어떤 계층을 선택할지 세부적으로 조정합니다.

약한 프롬프트 / 강한 프롬프트

약한 프롬프트:

어떤 모델을 추천하시나요?

강력한 프롬프트:

귀하의 역할: AI 솔루션 설계자. 나는 내 업무에 대해 다음 7가지 질문에 대답했습니다. 1) 데이터가 민감한가요?: [ANSWER]2) 작업 난이도: [ANSWER]3) 볼륨: [ANSWER]4) 문서 크기: [ANSWER]5) 시각/오디오: [ANSWER]6) 예산 민감도: [ANSWER]7) 기술 팀: [ANSWER]작업: 이러한 답변(단계, 가중치 유형, 컨텍스트, 다중 양식)을 기반으로 후보 모델 유형의 범위를 좁힙니다. 구체적인 후보 2명을 추천해주세요. 그런 다음 이 문제를 단일 모델로 해결해야 할지, 아니면 2~3개 모델로 구성된 포트폴리오로 해결해야 할지 정당화하세요.

강력한 프롬프트는 의사결정 트리의 답변을 모델에 직접 전달합니다. 따라서 모델은 추측을 하지 않고 실제 프로필에 따라 범위를 좁힙니다.

복사 가능한 템플릿

1. 의사결정 트리 실행:

내 직업을 정의하겠습니다: [설명]. 나에게 맞는 7가지 의사결정 질문(데이터 민감도, 업무 난이도, 용량, 문서 크기, 이미지, 예산, 팀)을 순서대로 물어보고, 각 답변 후 후보 풀을 좁혀 최종적으로 2가지 모델 유형을 추천합니다.

2. 포트폴리오 개요:

나는 다음과 같은 직업을 가지고 있습니다: [JOB LIST]. 직무별 의사결정트리를 적용하고, 적절한 모델 유형을 매칭하여 포트폴리오 테이블(직무/모델 유형/타당성)을 생성합니다. 포트폴리오의 관리 부담을 한 문장으로 평가해보세요.

3. 단일 모델 또는 포트폴리오:

내 팀 규모 [NUM], 내 업무 다양성 [낮음/보통/높음], 내 월별 AI 예산[RANGE]. 단일 균형 모델로 시작해야 할까요, 아니면 즉시 포트폴리오로 넘어갈까요? 장단점을 비교하고 단계별 경로를 제안해보세요.

4. 중독 위험 평가:

현재 우리는 단일 제공자 [PROVIDER]에 의존하고 있습니다. 이러한 의존성(가격, 정책, 중단)의 위험은 무엇입니까? 위험을 줄이기 위해 어떤 보조 공급자를 백업으로 준비해야 합니까? 전환을 더 쉽게 만들 수 있는 3가지 조치를 제안하세요.

일반적인 실수

  • 직관에 의한 선택: "좋을 것 같아서" 의사결정 트리를 건너뛰고 모델을 선택합니다. 나중에 비호환성이 발생합니다.
  • 데이터 문제는 마지막으로 남겨둡니다. 민감한 데이터에서는 주권 문제가 먼저입니다. 마지막에 넣으면 잘못된 모델에 고정됩니다.
  • 모든 작업을 단일 모델에 위임: 단일 모델에서 다양한 난이도와 양의 작업을 수행함으로써 품질이나 예산이 손실됩니다.
  • 포트폴리오를 너무 일찍 설정: 소규모 팀으로 3~4개의 모델을 관리하려고 시도하여 불필요한 복잡성을 만듭니다.
  • 의존성을 전혀 생각하지 않음: 단일 공급자에 전적으로 의존하고 가격/정책 변경에 대한 대안이 없습니다.

요약하면

  • 모델 선택은 7가지 질문(데이터, 과제, 볼륨, 컨텍스트, 시각적 개체, 예산, 팀)으로 요약될 수 있습니다. 이러한 질문은 후보자 풀을 빠르게 좁힙니다.
  • 민감한 데이터에서는 주권 문제가 먼저 나오고 다른 결정도 내려집니다.
  • 단일 모델이 아닌 성숙한 조직은 작업에 따라 다양한 모델의 포트폴리오를 구축합니다. 이는 비용을 최적화하고 종속성을 줄입니다.
  • 포트폴리오에는 관리 오버헤드가 있습니다. 소규모 팀은 균형 잡힌 단일 모델로 시작하여 점차적으로 움직여야 합니다.

응용과제

이전 단원에서 작성한 모든 메모를 함께 가져옵니다(프로필 필요, 가중치 선호도, 토큰/비용 추정, 계층 진단, 데이터 맵 필요). 이 단원의 패턴 1(의사결정 트리 실행)을 사용하여 비즈니스에 대한 7가지 질문에 답하고 두 가지 후보 모델 유형에 도달합니다. 두 가지 이상의 작업 유형이 있는 경우 템플릿 2(포트폴리오 개요)를 사용하여 포트폴리오 테이블을 만듭니다. 이 초안은 최종 단위의 평가 및 검증 연구에 대한 입력이 될 것입니다.

체크리스트

  • [ ] 7가지 의사결정 질문을 순서대로 적용함으로써 후보자 풀을 좁힐 수 있습니다.
  • [ ] 민감한 데이터에 있어서 주권 문제가 왜 먼저 나오는지 알고 있습니다.
  • [ ] 의사결정트리를 실제 비즈니스 시나리오에 적용하고 모델을 제안할 수 있습니다.
  • [ ] 모델 포트폴리오의 장점과 관리 부담을 평가할 수 있습니다.
  • [ ] 나는 단일 공급자에 대한 의존의 위험과 이를 줄이는 방법을 알고 있습니다.