上传文档
将一份或多份 DOC、DOCX 文档拖入上传区,系统自动校验文件格式并排入待处理队列。
上传一份或多份 DOC、DOCX 文档,即可自动排队并批量提取。处理进度与 Agent 日志全程可见,结果支持搜索筛选及 JSON、CSV 导出。
科研和业务文档格式多样、信息分散,人工整理耗时且容易遗漏,难以直接进入后续检索、分析和知识复用环节。

DocEx 面向生物医药研发场景,自动识别 Word 文档中的多肽氨基酸序列,提取分子、靶点、实验与成药性信息,降低人工整理成本,让科研资料能够进入后续检索、分析和数据管理流程。
跟随实际操作,了解从 Word 文档上传、智能提取到标准化数据交付的完整流程。
从上传到提取再到查看结果,操作只需三步。文件自动排队,处理状态和 Agent 日志全程可见,无需人工盯守或干预中间过程。
将一份或多份 DOC、DOCX 文档拖入上传区,系统自动校验文件格式并排入待处理队列。
点击“开始批量提取”后,多个文件会自动排队、逐个处理,每个文件独立跟踪状态,全程无需人工干预。8 段进度条逐格推进,日志区实时显示 Agent 正在执行的命令,处理过程清晰透明。
结果以中文字段名的结构化表格呈现,支持关键字即时搜索和指标筛选。每条记录可一键复制标准 JSON,也可导出中文无乱码的 CSV,或合并 JSON 批量留存。
{
"sequence": "ACDEFGHIK...",
"molecularWeight": 1248.46,
"target": { "uniprotId": "P12345" },
"activity": { "value": 18.6, "unit": "nM" },
"source": { "document": "report.docx" }
}氨基酸序列、分子量、等电点、疏水性、净电荷等
靶点名称、编码基因、物种、UniProt ID、PDB 路径等
活性数值、单位、实验条件、阳性标签、置信度等
ADMET、类药性规则、类药性评分、合成可及性、毒性预警等
疾病名称、本体 ID、本体来源、关联证据等
通路节点名称、节点类型、关系类型等
文献标题、摘要、DOI、专利号、全文路径等
数据来源、获取时间、过期时间、源 URL、校验和、命中次数等
支持 Linux 或 Windows 服务端 Docker 部署,采用 Node.js、Nginx 与 SQLite 运行,客户端通过 Chrome、Edge、Firefox 等现代浏览器访问。