经管研究知识网络观测台
变量、数据源与测度方法的关系地图
知识网络
Hot Var
数据工具
⌕
×
Hot Var
近 3 日经管变量与具体研究方法 · LLM 识别标题 · 可切换热门与冷门榜
热门
冷门
正在读取公众号更新状态
近期文章
原文链接
正在同步文章
热门变量
重复次数降序
正在计算热度
热门方法
重复次数降序
正在计算热度
变量-数据源关系图谱
变量
0
数据源
0
关系
0
结构化数据明细
显示
0
总计
0
上传我的数据
时间范围
变量名
期刊名
制作方法/步骤
支持赞赏
微信赞赏 / 积分兑换
暂无匹配数据
选择数据任务
填写参数后开始运行
文本词频计算
专利匹配
LLM多模态
待分析文本
*
支持中文文本,建议不少于 100 字
停用词表
使用内置中文停用词表
不使用停用词
返回词条数量
Top 20
Top 50
Top 100
开始计算
正在读取服务器状态
—
第 1 步 · 先确认 IPC 分类表
后续步骤会按顺序出现
客户表如何变成可复核的专利结果
1. 客户原始表
正向:C10L5/4*
排除:C10L5/44
→
2. 官方全集验证
只从 ipc_pdf_first_column.csv 取合法 IPC;无 * 完全相等,有 * 才展开。
→
3. 逐项专利判断
/44:正向命中且排除命中,排除优先;/42:正向命中且未排除,保留。
→
4. 完整 IPC 审计
保存正向规则、排除规则、有效 IPC、被排除 IPC、结论和原因。
→
5. 宽口径派生
整理完成后再生成 IPC4:C10L;IPC3:C10。
→
结果表
匹配结果与审计表分开下载,Demo 先复核,再决定是否全量。
您常举的 H01L31/08* 规则也遵循同一规则:只有官方 CSV 中确实存在的 H01L31/08 下位代码才会展开;H01L31/08(无 *)只命中同名代码。
你现在准备好了哪一种 IPC 分类号表?
官网原始分类表需要先按示例文件整理;最终规则文件可以直接从本步骤下方的入口上传。
还没有分类号表
例如识别绿色专利,请先从 WIPO 官方 IPC Green Inventory 下载绿色技术分类清单,再按示例整理。
有官网原始表,尚未清洗
我已准备好按示例格式整理的 .xlsx,需要系统校验、展开区间并清理。
已有最终整理好的规则文件
我有一行一个 IPC 的 .csv/.txt,可直接进入后续匹配设置。
请根据研究目标从对应官方来源准备 IPC 分类表
绿色专利可从 WIPO IPC Green Inventory 准备分类清单;人工智能专利可先参考 WIPO Technology Trends: Artificial Intelligence 的分类方法,或采用研究指定的文献口径。下载后只保留分类号列,并按示例文件保存为 .xlsx。
绿色专利:WIPO IPC Green Inventory
AI 专利:WIPO Technology Trends
打开 WIPO IPCPUB
打开 WIPO IPC 下载说明
下载本地整理示例
上传已按示例整理的官网原始表(.xlsx)
下载示例文件
支持一列 IPC、混合区间和省略前缀;not_included / 排除 工作表会在逐项匹配专利时执行,排除优先;最大 8 MB。
校验并清洗 IPC 表
上传最终整理好的 IPC 规则
下载示例文件
一行一个 IPC;系统会先检查格式,再进入下一步。
需要把规则加工成哪种匹配口径?
完整 IPC / * 通配规则默认不扩大;只有规则末尾写出 * 才按官方全集展开。IPC4 和 IPC3 是整理完成后的独立宽口径。
完整 IPC / * 通配规则
无 * 必须完全相等;末尾 * 才按官方 IPC 全集展开,例如 C10L5/4*。
加工成前四位
按 IPC 小类匹配,例如 G06F。
加工成前三位
按 IPC 大类匹配,例如 G06,覆盖最宽。
专利记录使用哪一列 IPC?
默认研究口径通常使用全部分类号;只有需要核心技术口径时选主分类号。
全部分类号
拆分一项专利的所有 IPC,只要一项命中就保留。
主分类号
只使用专利的核心主分类号,口径更严格。
上市公司按哪一种申请人归属?
第一申请人更严格;共同申请人会让一项专利可能归属于多家公司。
第一申请人
只使用排名第 1 的申请人。
共同申请人
拆分全部共同申请人后逐个匹配。
先跑 Demo 还是直接跑全量?
建议先用底库前 1,000 行核对命中规则、IPC 字段和公司归属,再决定是否全量。
先运行 Demo
固定处理底库前 1,000 行,仅用于验证流程。
运行全量
遍历上市公司全量专利,耗时更长。
设置已齐,可以制作专利数据
请最后核对摘要,再点击运行。文件选择和最终提交始终由你确认。
运行专利匹配
LLM多模态信息结构化提取与情感分析
视频、音频、图像和文本共用一套字段与情感配置;当前视频任务使用项目内 FFmpeg、FunASR VAD 和结构化分析流水线。
输入模态
视频(已接入完整流程)
音频(已接入项目流程)
图像(已接入项目流程)
文本/表格(已接入项目流程)
对应说明:
视频 PDF
·
音频 PDF
·
图像 PDF
·
文本 PDF
演示样例
下载后可直接上传
示例视频 1 · 城市与活动场景
约 82 秒
示例视频 2 · 多场景串联
约 121 秒
示例音频 1 · 访谈演示
60 秒
示例音频 2 · 延长访谈演示
120 秒
真人脸部样本 1 · 灰度肖像
48×48 JPG
真人脸部样本 2 · 灰度肖像
48×48 JPG
上市公司经营范围 1 · 宁德时代
CSV
上市公司经营范围 2 · 比亚迪
CSV
模型服务 API Key(SK)
*
仅用于本次任务,不写入日志和结果文件;请通过 HTTPS 页面提交。
结构化字段(可选)
字段名和解释之间用冒号;不同字段之间用分号或换行。结果表只保留字段名,解释用于指导 Qwen 提取。留空:不生成 structured_results.csv。
情感选项(可选)
留空:按文本项目固定七维情绪模型提取;填写“无”:跳过情绪模型且不生成情绪结果;其他文字不会改变本地模型的固定标签体系。
文本分段设置(仅文本/表格生效)
按标点符号分段
优先在句号、问号、感叹号、分号和换行处切开,再按最大字符数合并。
每段最长字符数
分段后最多组合多少个字符;范围 50–20000。超长单句会按字符硬切,最后再整合回原文行。
上传视频文件(用于测试,结果免费下载)
*
仅上传一个视频文件用于测试,处理结果免费下载
上传视频文件夹(批量处理,结果需解锁)
选择文件夹
未选择文件夹
文件夹内的视频会批量处理;结果需微信赞赏或贡献资料后下载
强制重新处理
忽略已有检查点,重新执行全部阶段
上传并开始分析
运行结果
等待任务
↗
结果会显示在这里
选择左侧任务并开始运行
获取资料
关闭
账户与积分
登录
注册新账户
用户名
密码
已有账户?输入用户名和密码后直接登录。
登录
退出登录
关闭
爱思
爱思操作中