AI 拾光
互联网信息服务算法公示
算法名称
AI拾光图像理解文本生成算法
算法基本原理
本算法属于生成合成类中的文本生成。系统接收用户已上传的照片或视频抽帧,经缩放等预处理后,输入本地部署的开源多模态视觉语言模型 Qwen2.5-VL。模型依据视觉特征与中文提示词,输出该图像的中文场景描述及画面文字;在幻灯片场景,再依据已有描述与人名标注生成一句中文旁白。输出为自然语言文本,不生成新的图像或音视频。
算法运行机制
用户通过互联网网站或微信小程序将照片、视频上传至「AI 拾光」云相册。服务端在内容安全检查通过并入库后,按项目配置将图像理解任务分发至本地推理节点。节点调用 Qwen2.5-VL 生成文本,经敏感词过滤后写入数据库,并在照片详情、检索与幻灯片界面展示。展示时附加「AI生成」显性标识及溯源编号。全流程在备案主体控制的服务器与本地 GPU 节点完成,不调用境外生成式服务接口,也不通过公有云大模型 API 传输用户照片。
算法应用场景
应用于「AI 拾光」智能相册:班级、家庭等用户查看已上传照片时的中文内容说明、以文搜图,以及幻灯片播放时的中文旁白。不应用于新闻信息生成、不应用于人脸替换或图像伪造、不应用于开放域智能对话。
算法目的意图
帮助用户理解、检索和展示其已上传的照片内容,提高相册整理与浏览效率。生成内容仅作为辅助说明,不替代用户对事实的判断;平台通过输入审核、结果审核、标识与投诉渠道防范违法违规和误导风险。
展示形态
互联网网站(https://photo.earthg.cn、https://photo999.cn)、微信小程序「AI 拾光」。