多模态 Agent 协同流:如何设计一套能自我纠错的任务拆解方案 图文混合输入最容易让 Agent“看起来会做,实际做错”。一张财报截图里,数字可能因为分辨率、表格线或单位标注而被误读;配套文字又可能限定了统计口径、时间范围或对比对象。若系统把识别、计算、判断和生成... AI智能# 图像识别# 多模态 5小时前000