草莓科研服务网——中国专业社科交流平台

 找回密码
 立即注册
建议用户用微信快捷登录

快捷登录

查看: 139|回复: 0

2025-2004年上市公司绿色算法创新数据、算法专利授权量、算法专利占比

[复制链接]
发表于 4 小时前 | 显示全部楼层 |阅读模式
1、资料名称:2025-2004年上市公司绿色算法创新数据、算法专利授权量、算法专利占比、算法发明专利申请量、算法发明专利授权量、城市算法专利授权量、lnalgo

2、测算方式:
参考蒋伟杰、齐晨扬、陈琦(2026)的研究做法,采用"关键词粗筛+语义精筛"两阶段方法识别绿色专利中的算法专利:先以关键词表从绿色专利摘要中过滤出与数据处理、算法、方法相关的候选专利,再用
MacBERT 大语言模型( bge-small-zh-v1.5)将专利摘要与预定主题文本"应用在某个领域的数据处理、分析、利用的算法或方法"向量化,计算余弦相似度并以阈值0.61(与文献设定一致)识别算法专利。识别出的算法专利按申请号去重后,加总到企业-年份与城市-年份层面,输出6个核心指标,其中 lnalgo 为文献核心解释变量(城市算法专利授权量取自然对数,加1避免取0处无定义)。

我们多做了几个变量,如下图所示,包括核心变量或者稳健性检验及过程变量,数据全流程公开,每个原始数据及过程都清晰可查(非主观编造),大家可以做核心变量或者稳健性检验,多个数据更加容易显著!

3、资料范围:
1468家企业,4550个观测值,年份跨度2004-2025年。
具体数据分布情况如下方描述性统计。
包括原始数据、计算代码(真实代码,可以向期刊公布,每一步都可以复现和做重复实验)、完整的复现说明(教大家一步步复现,做法过程全部公开,无数据黑箱,并且对复现过程常见问题做了解答)及最终结果(最终结果格式是excel电子表格格式,非常方便大家导入到自己数据里面),大家可以验证一下确保准确性!

此大语言模型的运行时间在50多个小时以上,大家可以自行试试用真正的大语言模型做,而不是做了个表面。这个资料是用真正大语言模型一步步做的,大家可以复现和做重复实验!

4、参考文献:
蒋伟杰,齐晨扬,陈琦.算法创新与企业全要素生产率提升——来自专利文本的经验证据[J].数量经济技术经济研究,2026(5):30-53.

此数据为科研课题组自用数据,根据真实的绿色专利名称文本数据一步步做出来的,每一步都可以复现和做重复实验,非仅仅只有一堆文件胡编乱造(根据参考文献瞎编结果根本就没有研究价值,不能反映真正的绿色算法创新水平,实证围绕着错的结果根本就毫无意义浪费大家时间),真正的原创一手认真整理数据,数据处理较为复杂大家可以自行试试。



本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有帐号? 建议用 立即注册

x
您需要登录后才可以回帖 登录 | 立即注册 建议用 立即注册

本版积分规则

回帖奖励

[详情]

  • * 每天自己主题被回复3次可获得额外5论坛币奖励。
  • * 每天回复他人主题5次可获得额外8论坛币的奖励。
  • * 奖励每天都可领取,一定要多参与论坛讨论哦。
  • * 同一主题的重复回复不计。
  • 草莓科研服务网——中国专业社科交流平台 ( 津ICP备2023000499号 )|网站地图

    GMT+8, 2026-8-18 13:07 , Processed in 0.112460 second(s), 51 queries .

    Copyright © caomeikeyan

    快速回复 返回顶部 返回列表