tushare

📊 中文语义驱动的A股数据研究引擎

中文自然语言驱动的A股金融数据研究工具,支持行情、财报、资金流、板块、宏观等多维数据获取与分析,需Tushare Token认证

收藏
62.8k
安装
15.6k
版本
1.1.19
CLS 安全性认证2026-07-12
点击查看完整报告 >

使用说明

核心用法

Tushare数据研究技能是一个面向中文自然语言的金融数据分析工具,核心任务是将口语化的投资研究请求转化为可执行的数据工作流。主要覆盖九大场景:

| 场景类型 | 典型请求 | 核心接口 |
|---------|---------|---------|
| 行情趋势 | "看看这只股票最近怎么样" | `daily`/`pro_bar`/`daily_basic` |
| 财务质量 | "查财报趋势" | `income`/`fina_indicator`/`cashflow` |
| 对比筛选 | "谁更强/筛高ROE" | 多标的并行拉取+指标排序 |
| 板块主题 | "最近哪个板块最强" | `sw_daily`/`ths_index`/`index_classify` |
| 资金流 | "北向资金在买什么" | `moneyflow_hsgt`/`hsgt_top10`/`moneyflow` |
| 公告新闻 | "有什么催化消息" | `anns_d`/`news`/`research_report` |
| 宏观数据 | "CPI/PMI怎么看" | `cn_cpi`/`cn_pmi`/`cn_m` |
| 数据导出 | "导出CSV供回测" | 分段拉取+标准化输出 |
| 综合简报 | "快速研究一下XX" | 多维度聚合生成结论 |

关键设计原则:先理解用户意图,再选择接口组合;默认20-60个交易日时间窗;输出结构为"一句话结论+关键指标+数据范围+风险点",而非原始字段堆砌。

显著优点

  • 中文语义理解优先:自动将"最近""强不强""资金关注"等模糊表达映射为量化口径
  • 智能任务路由:9大类工作流模板覆盖80%常见研究场景,无需用户记忆接口名
  • 工程化取数策略:长区间自动分段、批量标的并行+节流、失败分段记录与部分成功交付
  • 数据质量保障:内置schema校验、去重、空结果归因(区分非交易日/未上市/无权限)
  • 可复用输出:CSV/Parquet导出附带元信息(接口、参数、拉取时间、缺失情况)

潜在局限

  • 依赖Tushare权限体系:高阶接口(分钟线、实时行情、逐笔资金流)需积分/付费权限,权限不足时明确告知而非伪造数据
  • 非实时交易决策工具:数据有延迟,不支持毫秒级决策,不替代投资顾问
  • 无交易执行能力:仅限研究分析,不接券商交易API
  • 中文标的解析歧义:重名股票/基金需用户澄清(如"茅台"默认600519.SH但需确认)
  • 宏观与跨市场数据覆盖有限:港股美股数据品种少于A股

适合人群

  • 个人投资者进行日常投研与标的筛选
  • 量化研究员获取标准化清洗数据
  • 财经内容生产者快速生成数据支撑
  • 需要批量导出历史行情/财务数据的策略开发者

常规风险

| 风险类型 | 说明 | 缓释措施 |
|---------|------|---------|
| Token泄露 | `TUSHARE_TOKEN`为敏感凭证 | 环境变量存储,日志脱敏 |
| 数据延迟 | 行情数据非实时,存在15分钟至T+1延迟 | 输出明确标注数据时间与延迟 |
| 过度拟合 | 导出数据用于回测可能产生未来函数 | 元信息标注报告期对齐方式 |
| 权限误判 | 用户可能因积分不足无法获取承诺数据 | 前置权限检查+分段降级策略 |
| 归因错误 | 资金流与股价相关性≠因果性 | 输出限制"联动解释"而非因果断言 |

安全解读

核心功能

Tushare-data是一款面向中文自然语言的金融数据研究工具,核心能力在于将模糊的投资研究请求(如"看看这只股票最近怎么样""帮我查财报趋势")转化为可执行的数据获取、清洗、对比与导出流程。

显著优点

1. 自然语言优先设计
不同于传统API工具需要记忆接口名和参数,该skill深度理解中文投资语境:将"最近"自动映射为20个交易日,"财报"解释为最近8个季度,"强不强"拆解为走势+相对强弱+活跃度多维指标。大幅降低专业数据工具的使用门槛。

2. 全场景数据覆盖
涵盖10大任务类型:单标/多标行情分析、财务质量快照、估值筛选、北向/主力/龙虎榜资金追踪、板块轮动分析、公告新闻事件梳理、宏观数据(CPI/PPI/PMI等)、以及CSV/Parquet数据导出。单点工具即可支撑从日常看盘到深度研究的完整 workflow。

3. 工程化数据治理
内置分段拉取、增量更新、断点续跑、缓存复用机制,避免一次性请求大数据量导致的超时或限流。输出规范包含元信息记录(接口名、请求时间、数据行数、失败分段),确保研究可追溯、结果可复现。

4. 输出形态智能适配
根据任务复杂度自动选择交付形式:小结果用Markdown摘要+表格,中等规模输出CSV,大规模/回测场景生成Parquet,复杂流程附带可复用Python脚本。避免"只给原始字段表"的低价值交付。

潜在局限

  • 权限依赖:核心功能依赖Tushare官方账号及积分体系,高阶接口(实时分钟线、龙虎榜明细等)需付费权限
  • 非实时交易支持:明确声明不适用于毫秒级交易决策场景,数据存在分钟级延迟
  • 无内置回测引擎:仅提供数据准备能力,策略回测需配合外部框架(如Backtrader、vn.py)
  • 中国市场聚焦:虽支持港股/美股基础数据,但深度分析能力明显偏向A股生态

适合人群

  • 主观投资者:需要快速生成个股/板块研究简报,替代手工Excel整理
  • 量化研究者:需要规范化的数据获取管道,支撑因子挖掘和模型训练
  • 财经内容创作者:需要批量导出行情/财务数据,支撑可视化内容生产
  • 金融机构实习生/分析师:需要标准化的数据工作流模板,快速上手研究任务

常规风险

  • 数据权限不足时可能返回空结果,需理解"非交易日/未上市/无权限"与"接口故障"的区别
  • 自然语言理解存在歧义,复杂比较任务建议主动确认口径(如PE-TTM vs PE-LYR)
  • 导出数据需自行合规管理,避免泄露含敏感信息的财务数据集
  • 研究摘要不构成投资建议,需区分"数据呈现"与"投资判断"的边界

tushare 内容

references文件夹
scripts文件夹
手动下载zip · 24.0 kB
数据接口.mdtext/markdown
请选择文件