2026.09.15 / MODEL SERVER

VisionEye · Model Server

YOLO26n을 메모리에 올린 로컬 서버에 이미지를 전송했습니다. 실제 검출 응답을 확인하고, 추론 프로세스를 멈추거나 종료해 자동 복구를 검사했습니다.

정상 추론 요청
20 / 20

생성 영상 3개 프레임 · 순차 요청

HTTP 응답 p95
116.4 ms

초기화 제외 · n=20

종료 후 응답 복구
3.29 s

종료 요청부터 다음 추론 성공까지

실제 추론 장치
CPU

FP32 · 2 threads · batch 1

01 / SYSTEM

서버 구조

  1. 01HTTP · Bearer token
  2. 02동시 추론 1개 · 대기열 0
  3. 03YOLO26n · CPU worker
  4. 04검출 좌표 · 응답 기록

HTTP 서버와 모델 프로세스를 분리했습니다. 모델 로드와 워밍업을 마친 뒤 준비 상태가 되고, 실패하면 기존 프로세스와 연결을 정리한 후 새 세대로 교체합니다.

02 / INFERENCE

실제 응답

생성 영상 · 실제 응답 좌표 · 개인정보 가림 아님

선택한 요청

{
  "type": "result",
  "request_id": 2,
  "detections": [
    {
      "xyxy": [
        220.27630615234375,
        391.68316650390625,
        325.22369384765625,
        602.9668579101562
      ],
      "confidence": 0.8701023459434509,
      "class_id": 0
    },
    {
      "xyxy": [
        869.9039916992188,
        361.748779296875,
        962.1455688476562,
        580.7520751953125
      ],
      "confidence": 0.8581218719482422,
      "class_id": 0
    },
    {
      "xyxy": [
        468.11492919921875,
        232.8916015625,
        535.650146484375,
        410.51953125
      ],
      "confidence": 0.8497844338417053,
      "class_id": 0
    },
    {
      "xyxy": [
        555.414794921875,
        208.18496704101562,
        630.7957763671875,
        393.5848388671875
      ],
      "confidence": 0.8456692099571228,
      "class_id": 0
    },
    {
      "xyxy": [
        656.106201171875,
        273.41302490234375,
        721.9979248046875,
        458.52911376953125
      ],
      "confidence": 0.8320407867431641,
      "class_id": 0
    },
    {
      "xyxy": [
        777.20263671875,
        370.71307373046875,
        871.499267578125,
        600.5599975585938
      ],
      "confidence": 0.8298223614692688,
      "class_id": 0
    },
    {
      "xyxy": [
        114.68441772460938,
        374.2510986328125,
        220.70620727539062,
        586.3094482421875
      ],
      "confidence": 0.7722750306129456,
      "class_id": 0
    },
    {
      "xyxy": [
        744.9744262695312,
        0,
        774.9558715820312,
        55.1549072265625
      ],
      "confidence": 0.575564444065094,
      "class_id": 0
    }
  ],
  "width": 1280,
  "height": 720,
  "inference_ms": 89.661,
  "torch_threads": 2,
  "image_sha256": "e22ecbd82c9ac69d8f82a9819fe0ca256409160bca0237df6659204284c30ad1",
  "generation": 1,
  "model_sha256": "9b09cc8bf347f0fc8a5f7657480587f25db09b34bf33b0652110fb03a8ad4fef",
  "device": "cpu"
}

20개 순차 요청의 HTTP 응답 시간

01 → 20p50 93.6 ms / p95 116.4 ms

작은 기능 검증 표본입니다. 운영 처리량이나 정확도 수치로 해석하지 않습니다.

03 / RECOVERY

오류와 복구

복구 후 실제 응답

검증HTTP동작
인증 누락401추론 전에 거부
잘못된 이미지 / 요청 크기 초과400 / 413입력 검증
동시 요청 제한429의도적으로 멈춘 worker에 추가 요청
시간 초과504기존 worker 종료 → 새 연결·모델 로드
프로세스 종료503 → 200자동 재시작 후 실제 추론 성공
04 / EVIDENCE

실행 환경과 범위

고정한 설정

Python 3.12.14
PyTorch 2.11.0+cu128
Ultralytics 8.4.150
CPU · imgsz 640 · rect false · conf 0.1
Model SHA256
9b09cc8bf347f0fc8a5f7657480587f25db09b34bf33b0652110fb03a8ad4fef

AI 생성 영상에서 추출한 3개 프레임으로 검증했습니다. 실제 CCTV, 추적 세션 API, GPU·LLM 서빙, 장시간 운용, HTTP 서버·호스트 장애 복구와 모델 버전 롤백은 포함하지 않습니다. PyTorch는 기존 CUDA 빌드이지만 실제 모델 장치와 실행 스레드는 CPU / 2개로 확인했습니다.

서버 검증은 완료 후 종료했습니다. 이 웹페이지는 저장된 실행 기록을 보여주며 모델을 실행하지 않습니다.