VisionEye · Model Server
YOLO26n을 메모리에 올린 로컬 서버에 이미지를 전송했습니다. 실제 검출 응답을 확인하고, 추론 프로세스를 멈추거나 종료해 자동 복구를 검사했습니다.
- 정상 추론 요청
- 20 / 20
- HTTP 응답 p95
- 116.4 ms
- 종료 후 응답 복구
- 3.29 s
- 실제 추론 장치
- CPU
생성 영상 3개 프레임 · 순차 요청
초기화 제외 · n=20
종료 요청부터 다음 추론 성공까지
FP32 · 2 threads · batch 1
서버 구조
- 01HTTP · Bearer token
- 02동시 추론 1개 · 대기열 0
- 03YOLO26n · CPU worker
- 04검출 좌표 · 응답 기록
HTTP 서버와 모델 프로세스를 분리했습니다. 모델 로드와 워밍업을 마친 뒤 준비 상태가 되고, 실패하면 기존 프로세스와 연결을 정리한 후 새 세대로 교체합니다.
실제 응답
생성 영상 · 실제 응답 좌표 · 개인정보 가림 아님
선택한 요청
{
"type": "result",
"request_id": 2,
"detections": [
{
"xyxy": [
220.27630615234375,
391.68316650390625,
325.22369384765625,
602.9668579101562
],
"confidence": 0.8701023459434509,
"class_id": 0
},
{
"xyxy": [
869.9039916992188,
361.748779296875,
962.1455688476562,
580.7520751953125
],
"confidence": 0.8581218719482422,
"class_id": 0
},
{
"xyxy": [
468.11492919921875,
232.8916015625,
535.650146484375,
410.51953125
],
"confidence": 0.8497844338417053,
"class_id": 0
},
{
"xyxy": [
555.414794921875,
208.18496704101562,
630.7957763671875,
393.5848388671875
],
"confidence": 0.8456692099571228,
"class_id": 0
},
{
"xyxy": [
656.106201171875,
273.41302490234375,
721.9979248046875,
458.52911376953125
],
"confidence": 0.8320407867431641,
"class_id": 0
},
{
"xyxy": [
777.20263671875,
370.71307373046875,
871.499267578125,
600.5599975585938
],
"confidence": 0.8298223614692688,
"class_id": 0
},
{
"xyxy": [
114.68441772460938,
374.2510986328125,
220.70620727539062,
586.3094482421875
],
"confidence": 0.7722750306129456,
"class_id": 0
},
{
"xyxy": [
744.9744262695312,
0,
774.9558715820312,
55.1549072265625
],
"confidence": 0.575564444065094,
"class_id": 0
}
],
"width": 1280,
"height": 720,
"inference_ms": 89.661,
"torch_threads": 2,
"image_sha256": "e22ecbd82c9ac69d8f82a9819fe0ca256409160bca0237df6659204284c30ad1",
"generation": 1,
"model_sha256": "9b09cc8bf347f0fc8a5f7657480587f25db09b34bf33b0652110fb03a8ad4fef",
"device": "cpu"
}20개 순차 요청의 HTTP 응답 시간
작은 기능 검증 표본입니다. 운영 처리량이나 정확도 수치로 해석하지 않습니다.
오류와 복구
복구 후 실제 응답
| 검증 | HTTP | 동작 |
|---|---|---|
| 인증 누락 | 401 | 추론 전에 거부 |
| 잘못된 이미지 / 요청 크기 초과 | 400 / 413 | 입력 검증 |
| 동시 요청 제한 | 429 | 의도적으로 멈춘 worker에 추가 요청 |
| 시간 초과 | 504 | 기존 worker 종료 → 새 연결·모델 로드 |
| 프로세스 종료 | 503 → 200 | 자동 재시작 후 실제 추론 성공 |
실행 환경과 범위
고정한 설정
Python 3.12.14
PyTorch 2.11.0+cu128
Ultralytics 8.4.150
CPU · imgsz 640 · rect false · conf 0.1
Model SHA256
9b09cc8bf347f0fc8a5f7657480587f25db09b34bf33b0652110fb03a8ad4fef
AI 생성 영상에서 추출한 3개 프레임으로 검증했습니다. 실제 CCTV, 추적 세션 API, GPU·LLM 서빙, 장시간 운용, HTTP 서버·호스트 장애 복구와 모델 버전 롤백은 포함하지 않습니다. PyTorch는 기존 CUDA 빌드이지만 실제 모델 장치와 실행 스레드는 CPU / 2개로 확인했습니다.
서버 검증은 완료 후 종료했습니다. 이 웹페이지는 저장된 실행 기록을 보여주며 모델을 실행하지 않습니다.
서버 검증은 완료 후 종료했습니다. 이 웹페이지는 저장된 실행 기록을 보여주며 모델을 실행하지 않습니다.