- 移除Ollama相关配置和回退机制,统一使用SGLang作为视觉模型提供商 - 添加IMAGE_ANALYSIS类型支持,允许对多张图片进行分析 - 实现视频分析的详细输出模式,支持紧凑和详细两种结果格式 - 更新环境变量配置,添加VIDEO_MODEL_FRAME_LIMIT和MAX_IMAGE_BYTES - 修改compose配置文件中的上下文长度和内存分配参数 - 重构视频采样逻辑,限制单次请求帧数以优化显存使用 - 更新API接口文档,添加mediaUrls参数和详细输出选项说明 - 添加图像分析相关的依赖库opencv-python-headless - 实现结构化JSON响应格式验证和重试机制
37 lines
919 B
JSON
37 lines
919 B
JSON
{
|
|
"code": "aima.power_video.v1",
|
|
"name": "爱玛测试视频分析",
|
|
"analysisType": "VIDEO_ANALYSIS",
|
|
"promptFile": "prompt.txt",
|
|
"think": false,
|
|
"temperature": 0.1,
|
|
"strategies": {
|
|
"fast": {
|
|
"provider": "sglang",
|
|
"model": "Qwen/Qwen3.8-27B-FP8",
|
|
"sampleFps": 1.0,
|
|
"maxWidth": 896,
|
|
"maxOutputTokens": 512,
|
|
"compactMaxOutputTokens": 256,
|
|
"detailedMaxOutputTokens": 1024,
|
|
"numCtx": 16384,
|
|
"emptyResponseRetries": 1,
|
|
"maxRetryOutputTokens": 4096,
|
|
"keepAlive": "30m"
|
|
},
|
|
"accurate": {
|
|
"provider": "sglang",
|
|
"model": "Qwen/Qwen3.8-27B",
|
|
"sampleFps": 3.0,
|
|
"maxWidth": 1120,
|
|
"maxOutputTokens": 768,
|
|
"compactMaxOutputTokens": 384,
|
|
"detailedMaxOutputTokens": 1536,
|
|
"numCtx": 32768,
|
|
"emptyResponseRetries": 2,
|
|
"maxRetryOutputTokens": 8192,
|
|
"keepAlive": "30m"
|
|
}
|
|
}
|
|
}
|