본문 바로가기

업무 자동화 · 도구 검증 · 서비스 운영

반복 업무를 줄이는 방법,
직접 시험하고 기록합니다.

예약 명단 정리부터 알림 자동화, 앱 운영까지.
원본 예제와 확인표, 실험 결과를 함께 나눕니다.

첫 번째 실험 · 예약 명단

이름이 같으면
같은 예약일까요?

B102 · 방문자B9월 10일
B103 · 방문자B9월 11일

다른 예약입니다. 둘 다 남겨야 합니다.

가상 명단 12행으로 확인한 결과 →
AI 뉴스·업데이트

딥시크 V4.1 Flash 공개, 9월 14일 기존 Pro API도 새 모델로 연결됩니다

by 코딩히어로 2026. 9. 12.
300x250
반응형

딥시크 API를 붙여 둔 서비스라면 2026년 9월 14일이 먼저 확인할 날짜입니다. 코드에서 모델 이름을 그대로 두어도 요청을 처리하는 모델이 바뀌기 때문입니다. 이 글은 DeepSeek이 2026년 9월 10일 공개한 V4.1 Flash의 발표 내용, 기존 API의 전환 일정, 전환 전에 확인할 항목을 정리한 것입니다.

V4.1 Flash는 공식 발표 기준 552B 규모의 MoE 모델이며, 이미지와 텍스트를 함께 처리하는 멀티모달 모델입니다. API에서는 deepseek-flash라는 이름으로 호출합니다. 근거는 DeepSeek 공식 발표와 공식 모델 카드입니다.

deepseek-v4-pro 호출이 9월 14일 04:00 UTC에 V4.1 Flash로 연결되고, 전환 전 기록과 전환 후 대조 2단계로 결과를 확인하는 흐름도

이전과 달라진 점 한눈에 보기

발표문과 모델 카드에서 확인한 항목만 표로 정리했습니다. 비교 수치가 공개되지 않은 칸은 그대로 표시했습니다.

항목 이전(V4 계열) 이후(V4.1 Flash) 확인 출처
API 모델 이름 deepseek-v4-pro, deepseek-v4-flash, deepseek-v4-flash-vision-exp deepseek-flash 공식 발표
이미지 이해 별도 실험 모델 이름으로 분리 모델이 기본으로 멀티모달 처리 공식 발표, 모델 카드
모델 구조 발표문에 비교 수치 없음 552B MoE, 인코더 20층과 디코더 20층의 비대칭 구조 모델 카드
토큰당 활성 파라미터 발표문에 비교 수치 없음 입력 처리 8B, 출력 생성 16B 공식 발표, 모델 카드
전문가 구성 발표문에 비교 수치 없음 공유 전문가 1개와 라우팅 전문가 384개, 토큰당 6개 사용 모델 카드
KV 캐시 사용량 이전 세대 기준 HBM 4분의 1, SSD 8분의 1 공식 발표
최대 컨텍스트 발표문에 비교 수치 없음 최대 100만 토큰 모델 카드
가중치 공개 해당 없음 MIT 라이선스로 공개 모델 카드

전환 일정은 9월 14일 오후 1시입니다

이번 발표에서 날짜가 붙은 항목은 두 가지입니다. 하나는 새 요금이 적용되는 시점이고, 다른 하나는 기존 Pro 요청이 새 모델로 연결되는 시점입니다. 공식 발표는 두 시점을 UTC로 적었기 때문에 한국 시간으로 바꿔 두면 일정을 잡기 쉽습니다.

시점(UTC) 한국 시간 바뀌는 내용
2026년 9월 10일 04:00 9월 10일 오후 1시 V4.1 Flash 요금 적용 시작
2026년 9월 14일 04:00 9월 14일 오후 1시 deepseek-v4-pro 요청이 V4.1 Flash로 연결
그 이후 별도 공지 시점까지 V4.1 Pro가 나올 때까지 이 연결 유지

요금 체계에서 발표문이 밝힌 내용은 혼잡 시간대와 비혼잡 시간대 구분이 계속된다는 점, 그리고 비혼잡 시간대 요금이 혼잡 시간대의 50%라는 점입니다. 단가 숫자는 발표 페이지에 이미지로 실려 있어 이 글에서는 옮기지 않았습니다. 정확한 금액은 공식 가격 안내 화면에서 직접 보셔야 합니다.

업무에서 중요해지는 지점 두 가지

첫째는 이미 운영 중인 자동화 흐름입니다. 사내 문서를 요약해 표로 만드는 작업을 deepseek-v4-pro로 돌리고 있었다면, 9월 14일 이후에는 같은 코드가 다른 모델의 응답을 받습니다. 응답 길이나 항목 순서가 달라지면 뒤에 붙은 파서가 먼저 흔들립니다. 코드를 고치지 않아도 결과가 달라질 수 있는 구간이라 점검 대상이 됩니다.

둘째는 이미지가 섞인 요청입니다. 그동안 텍스트 요청과 이미지 요청을 다른 모델 이름으로 나눠 두었다면, 멀티모달을 기본 지원하는 모델에서는 그 분기를 한 갈래로 합칠 여지가 생깁니다. 다만 합치기 전에 같은 이미지로 같은 질문을 던져 응답 형식을 비교해 보는 편이 안전합니다. AI 응답을 업무에 넣기 전 확인 순서는 AI 답변의 숫자와 출처를 확인하는 3단계에 정리해 두었습니다.

국내에서 지금 쓸 수 있나요

API 자체는 공개돼 있고 계정이 있으면 모델 이름을 바꿔 호출할 수 있습니다. 다만 지역별 제공 제한이나 한국어 응답 품질에 관한 별도 안내는 이번 발표문에서 확인하지 못했습니다. 확인하지 못한 항목을 확인된 것처럼 적으면 도입 판단이 흔들리므로, 이 부분은 미확인으로 남겨 두는 편이 정확합니다.

가중치가 MIT 라이선스로 공개됐다는 점과 내 장비에서 바로 돌릴 수 있다는 점은 다른 이야기입니다. 552B 규모의 MoE 모델이라 자체 운영에는 상응하는 장비와 추론 환경이 필요합니다. 모델 카드는 권장 샘플링 값으로 temperature 1.0, top_p 0.95 또는 1.0, 최대 출력 토큰 256K 이상을 적어 두었습니다. 사내 데이터를 외부 API로 보낼 수 있는지도 조직 규정에서 먼저 확인할 항목입니다.

전환 전후를 비교하는 요청 한 세트

전환 결과를 말로 판단하면 매번 기준이 달라집니다. 같은 입력과 같은 요청문을 파일로 저장해 두고, 전환 전과 후에 한 번씩 돌려 결과를 나란히 두는 방법이 단순합니다. 아래 입력은 예시용으로 만든 중립 데이터입니다.

[사내 공지 원문]
제목: 9월 정기 점검 안내
작성: 운영팀 담당자A
대상: 사내 결재 시스템 전체 사용자
일시: 9월 20일 일요일 02:00부터 06:00까지
내용: 점검 시간 동안 결재 상신과 승인이 중단됩니다.
예외: 모바일 조회는 유지되며 알림은 지연될 수 있습니다.
담당: 운영팀 담당자B, support@example.com
요청: 부서별 공지 게시판에 9월 18일까지 게시 바랍니다.
비고: 점검이 조기 종료되면 별도 공지합니다.

요청문에는 출력 형식을 고정하는 문장을 넣습니다. 형식이 고정돼야 전환 전후의 차이가 내용 차이인지 형식 차이인지 구분됩니다.

위 공지 원문만 사용해 표 한 개를 만들어 주세요.
열은 항목, 값, 원문 근거 줄 세 개로 고정합니다.
항목은 제목, 대상, 점검 시작, 점검 종료, 중단되는 기능, 유지되는 기능, 문의처, 게시 기한 순서로 고정합니다.
값은 원문 표현을 그대로 옮기고 요약하지 마세요.
원문에 없는 항목은 값 칸에 확인 필요라고 적어 주세요.
표 외의 설명 문장은 쓰지 마세요.

아래는 이 요청문을 바탕으로 직접 구성한 기대 결과입니다. 실제 모델 응답을 측정한 결과가 아니라, 무엇을 맞다고 볼지 미리 정해 둔 채점 기준입니다.

항목 값 원문 근거 줄
제목 9월 정기 점검 안내 제목 줄
대상 사내 결재 시스템 전체 사용자 대상 줄
점검 시작 9월 20일 일요일 02:00 일시 줄
점검 종료 9월 20일 06:00 일시 줄
중단되는 기능 결재 상신과 승인 내용 줄
유지되는 기능 모바일 조회, 알림은 지연 가능 예외 줄
문의처 운영팀 담당자B, support@example.com 담당 줄
게시 기한 9월 18일 요청 줄

전환 뒤 같은 요청을 다시 돌려 이 표와 대조하면 됩니다. 값이 요약되거나 확인 필요가 사라졌다면 응답 형식이 바뀐 신호입니다.

쓰기 전에 확인할 점

  • 코드와 설정 파일에서 호출 중인 모델 이름을 전부 찾아 목록으로 만듭니다.
  • 이미지 요청과 텍스트 요청이 서로 다른 이름을 쓰고 있는지 확인합니다.
  • 자주 쓰는 요청 세 가지를 입력과 요청문까지 파일로 저장해 둡니다.
  • 전환 전에 한 번 돌려 응답 원문과 사용량, 소요 시간을 기록합니다.
  • 사용량 경보와 예산 한도를 계정 화면에서 다시 확인합니다.
  • 사내 데이터를 외부 API로 보낼 수 있는지 조직 규정으로 확인합니다.

모델 발표 소식을 업무 기준으로 읽는 방식은 새 모델을 업무에 적용하기 전에 확인할 세 가지에서도 같은 순서로 다뤘습니다.

자주 묻는 질문

모델 이름을 바꾸지 않으면 예전 모델이 계속 쓰이나요

그렇지 않습니다. 공식 발표는 2026년 9월 14일 04:00 UTC부터 deepseek-v4-pro 요청을 V4.1 Flash로 연결한다고 적었습니다. 기존 deepseek-v4-flash와 deepseek-v4-flash-vision-exp 이름도 호환을 위해 한시적으로 새 모델에 연결됩니다. 이름을 그대로 두는 것은 전환을 미루는 방법이 아닙니다.

KV 캐시가 줄면 요금도 그만큼 줄어드나요

발표된 HBM 4분의 1과 SSD 8분의 1은 메모리와 저장 공간 사용량에 관한 수치입니다. 요금은 입력과 출력 토큰 수, 캐시 적중 여부, 사용 시간대에 따라 따로 계산됩니다. 같은 비율로 요금이 줄어든다고 읽으면 예산 계산이 어긋납니다.

가중치가 공개됐으니 사내 서버에서 돌리면 되나요

공개 라이선스는 MIT이지만 규모가 552B인 MoE 모델입니다. 실제 운영에는 추론 장비와 서빙 환경 구성이 필요하고, API 이용과는 비용 구조가 다릅니다. 필요한 사양은 모델 카드의 추론 안내에서 먼저 확인하는 것이 순서입니다.

자료 확인일은 2026년 9월 15일입니다. 이 글은 공식 발표와 모델 카드를 다시 열어 정리한 뉴스 해설이며, 성능과 메모리 수치를 직접 측정한 결과가 아닙니다. 발표 페이지의 가격표와 벤치마크 그래프는 이미지로 제공돼 수치를 옮기지 않았습니다.

300x250
반응형

댓글