调用 AI 识别图片内容,输出文字描述,支持自定义识别需求
这是浏览器端运行的 AI 图片内容识别工具,能帮你把图片里的场景、物体、人物、文字转换成文字描述,支持自定义提问要求。
基于开源大语言视觉模型运行,所有计算在你的浏览器本地完成,无需上传图片到第三方服务器,即可得到识别结果。
支持单张最大 10MB 的图片。图片体积过大可能导致识别速度变慢,建议压缩后再上传识别。
可以识别图片中的文字,你可以在需求框明确说明要提取全部文字,AI会优先输出文字内容。
速度取决于你的设备性能和网速。模型首次使用需要下载资源,等待时间会比后续使用更长。
你可以调整自定义需求的描述,更明确说明你要识别的内容,重新发起识别就能得到更符合需求的结果。