专利专业信息抽取
从专利全文附图、文本及相关数据中抽取可结构化使用的专业信息,服务化学结构、生物序列等专利信息识别与整理场景。
- 版本
- v0.1.0
- 能力
- 1 个工具
- 用户
- 408
- 企业
- 1
- 最近更新
- 2026.07.17
关于
从专利全文附图、文本及相关数据中抽取可结构化使用的专业信息,服务化学结构、生物序列等专利信息识别与整理场景。
可用能力
1 个可调用工具
输入 · 输出
- 输入
- offset, limit, pn
参数
offset零基偏移量,例如设为“5”,表示跳过专利全文附图的前5张附图,从第6张图片开始处理,默认为0即不跳过。
limit单次调用处理的最大附图数量。
pn专利公开号,例如US20250019377A1。
这个 Server 从专利数据中抽取可结构化使用的专业信息。当前版本支持根据专利公开号,分页识别该专利全文附图中的化学结构式,并返回对应的 SMILES 结果, 后续会支持生物序列识别抽取。
- 当你需要从某件专利的全文附图中批量提取化学结构式 SMILES 时 - 当一件专利包含大量附图,需要分页处理并逐批获取结果时 - 当下游任务需要结构化的 SMILES 数据用于检索、分析、比对或整理时 - 不适用于从非专利图片、非化学结构式图片或用户上传图片中识别结构式
- 专利公开号 `pn`,例如 `US20250019377A1` - 可选的分页参数 `offset`,表示从第几张附图开始处理,默认 `0` - 可选的分页参数 `limit`,表示本次最多处理多少张附图,默认 `20`,最大 `50`
- 专利基本处理信息,包括 `pn`、`patent_id`、`total_figures`、`offset`、`limit`、`processed_figures`、`next_offset` 和 `failed_count` - 每个识别结果包含附图 ID、图块序号、图块坐标、SMILES 结果以及错误信息 - 如果还有后续附图未处理,会返回 `next_offset`,可用于继续分页调用
1. "帮我提取 US20250019377A1 这件专利全文附图中的化学结构式 SMILES" 2. "从 offset 0 开始,每次处理 20 张附图,提取这件专利的 SMILES" 3. "继续处理上一批结果后的 next_offset,获取后续 SMILES 结果"
- 当前版本仅支持根据专利公开号抽取化学结构式 SMILES - 识别范围来自专利全文附图,不包含权利要求、说明书正文中的纯文本结构信息 - 单次调用最多处理 50 张附图;大型专利需要根据 `next_offset` 多次分页调用; - 个别图块可能因图片质量、非结构式内容或 OCSR 识别失败返回错误信息 - 服务所需的数据访问、图片签名和识别服务凭据由后端环境配置,用户无需提供内部 Token
帮我提取 US20250019377A1 这件专利全文附图中的化学结构式 SMILES
从 offset 0 开始,每次处理 20 张附图,提取这件专利的 SMILES
继续处理上一批结果后的 next_offset,获取后续 SMILES 结果