酝酿多年的计划终于因为AI的发展实现了!从剑盾时期就想要做一个能够检索自己截图的站点,可惜当时OCR的成本太高,准确度又太低。到了2026年,有了VLM(Visual Langurage Model)视觉语言大模型,OCR的准确度就突飞猛进了,价格也压得很低,于是就有今天这个项目。通过把过去几年的NS截图进行OCR,随后再匹配宝可梦语料进行整理分类的工作。
感谢ABCboy大佬整理开源了宝可梦语料库的站点。
目前的匹配率还有待提升,不过已经基本可用了。还有一部分的OCR结果会把背景中的世界观文字给识别成英文,后续会手动调整。
站内的详情页也设置了勘误汇报的按钮,可以试试!投稿功能还在制作中,有进度的话会第一时间发布。
感谢助力宝可梦友会的建设!


