PDF 与图片文字提取
从图片或 PDF 文档中识别并提取文字内容,支持多种图片格式和 PDF 文件,自动判断是否包含文字并保留原始格式输出结构化结果;当用户需要从图片或 PDF 提取文字、进行 OCR 识别、处理含文字的文档或转换为可编辑文本时使用 先判断 PDF 是否含可提取文本;无文本层或图片输入时再进行 OCR,并按页面与段落组织识别结果。 1. 上传 PDF 或图片并说明是否需要保留分页。 Skill 优先提取文本层,必要时调用 OCR。 按原顺序整理标题、段落和表格文字。 对低置信度结果进行人工复核。