- 移除Ollama相关配置和回退机制,统一使用SGLang作为视觉模型提供商 - 添加IMAGE_ANALYSIS类型支持,允许对多张图片进行分析 - 实现视频分析的详细输出模式,支持紧凑和详细两种结果格式 - 更新环境变量配置,添加VIDEO_MODEL_FRAME_LIMIT和MAX_IMAGE_BYTES - 修改compose配置文件中的上下文长度和内存分配参数 - 重构视频采样逻辑,限制单次请求帧数以优化显存使用 - 更新API接口文档,添加mediaUrls参数和详细输出选项说明 - 添加图像分析相关的依赖库opencv-python-headless - 实现结构化JSON响应格式验证和重试机制
9 lines
169 B
Plaintext
9 lines
169 B
Plaintext
fastapi==0.116.1
|
|
httpx==0.28.1
|
|
numpy==2.2.6
|
|
opencv-python-headless==4.12.0.88
|
|
pydantic-settings==2.10.1
|
|
python-multipart==0.0.20
|
|
scipy==1.15.3
|
|
uvicorn[standard]==0.35.0
|