- 移除Ollama相关配置和回退机制,统一使用SGLang作为视觉模型提供商 - 添加IMAGE_ANALYSIS类型支持,允许对多张图片进行分析 - 实现视频分析的详细输出模式,支持紧凑和详细两种结果格式 - 更新环境变量配置,添加VIDEO_MODEL_FRAME_LIMIT和MAX_IMAGE_BYTES - 修改compose配置文件中的上下文长度和内存分配参数 - 重构视频采样逻辑,限制单次请求帧数以优化显存使用 - 更新API接口文档,添加mediaUrls参数和详细输出选项说明 - 添加图像分析相关的依赖库opencv-python-headless - 实现结构化JSON响应格式验证和重试机制
12 lines
360 B
Plaintext
12 lines
360 B
Plaintext
API_KEY=replace-with-a-strong-random-token
|
|
MEDIA_TIMEOUT_SECONDS=120
|
|
SGLANG_FAST_BASE_URL=http://192.168.28.10:14081/v1
|
|
SGLANG_ACCURATE_BASE_URL=http://192.168.28.10:14082/v1
|
|
SGLANG_API_KEY=
|
|
SGLANG_TIMEOUT_SECONDS=600
|
|
MAX_AUDIO_BYTES=104857600
|
|
MAX_VIDEO_BYTES=2147483648
|
|
VIDEO_SAMPLING_FRAME_LIMIT=100
|
|
VIDEO_MODEL_FRAME_LIMIT=30
|
|
MAX_VIDEO_CONTEXT_TOKENS=65536
|