- 集成Qwen3.8-27B-FP8快速模型和Qwen3.8-27B精确模型作为SGLang服务 - 添加SGLang API配置选项(SGLANG_FAST_BASE_URL、SGLANG_ACCURATE_BASE_URL等) - 实现音频分类中的决策聚合算法(topK、nearestWeight、labelMaxDistance) - 添加视频采样帧限制(VIDEO_SAMPLING_FRAME_LIMIT)和上下文token限制 - 更新健康检查以监控SGLang服务状态 - 实现视频分析的双模式决策策略(快速+精确) - 添加音频参考文件导入工具(import_audio_references.py) - 扩展音频分类标签支持FIND_VEHICLE_HORN类别 - 优化视频分析的帧采样策略,始终包含视频尾部帧 - 添加决策策略参数(tuning、decisionPolicy)支持 - 更新配置类以支持新的SGLang和视频参数 - 修改compose配置以支持Qwen3.8模型部署 - 更新音频分类测试用例验证聚合逻辑 - 重构视频测试以支持SGLang API格式和决策策略
26 lines
595 B
JSON
26 lines
595 B
JSON
{
|
|
"code": "aima.power_state.v1",
|
|
"name": "爱玛车辆声音类型检测",
|
|
"analysisType": "AUDIO_CLASSIFICATION",
|
|
"minimumReferencesPerLabel": 3,
|
|
"maximumAudioSeconds": 30,
|
|
"labelNames": {
|
|
"POWER_ON": "开机",
|
|
"POWER_OFF": "关机",
|
|
"ARMED": "设防",
|
|
"DISARMED": "解防",
|
|
"FIND_VEHICLE_HORN": "鸣笛寻车",
|
|
"UNKNOWN": "其他声音"
|
|
},
|
|
"decision": {
|
|
"maxDistance": 0.45,
|
|
"minDistanceMargin": 0.015,
|
|
"topK": 3,
|
|
"nearestWeight": 0.6,
|
|
"labelMaxDistance": {
|
|
"FIND_VEHICLE_HORN": 0.35
|
|
},
|
|
"unknownLabel": "UNKNOWN"
|
|
}
|
|
}
|