chinese-poetry-api:近 40 万首古诗词,开箱即用的接口服务

介绍开源项目 chinese-poetry-api:基于 chinese-poetry 数据集,提供近 40 万首唐诗、宋词、元曲等诗词的 REST/GraphQL 接口,支持检索、随机、简繁切换与 Docker 部署,适合小程序、机器人和学习类应用快速接入。

做古诗小程序、每日一句机器人、语文学习工具时,最劝退的往往不是前端,而是数据:诗词要去哪找、怎么清洗、简繁怎么转、检索怎么做。

chinese-poetry-api 把这件事收成一套可部署的 API:基于开源 chinese-poetry 数据集,用 Go 提供服务,REST 与 GraphQL 双接口,Docker 一键拉起,调用方专心产品逻辑即可。

GitHub:https://github.com/palemoky/chinese-poetry-api
在线演示(项目 README 所示):https://poetry.palemoky.com

里面有什么?

公开说明里,体量约在 三十余万到近四十万首 量级(随数据库版本微调),覆盖常见品类,例如:

  • 唐诗(含绝句、律诗、乐府等)
  • 宋词、五代词
  • 元曲
  • 诗经、楚辞
  • 以及其他整理条目

并支持按 朝代、作者、类型 等维度筛选,以及 全文搜索、随机一首、简繁切换(如 lang=zh-Hans / zh-Hant)。

对开发者友好的一点是:性能取向明确(Go、并发),简繁转换也做了工程化优化,适合作为内部微服务或学习项目后端。

能解决谁的痛?

场景

价值

古诗/诗词类小程序

免自建爬虫与脏数据清洗

飞书/Telegram/微信机器人

随机一首、按作者查询很直接

教育与背诵工具

按体裁、作者组卷、抽查

网站「每日诗」组件

定时拉随机接口即可

学 API / Docker 的练手

中文语料 + 清晰 REST 示例

怎么跑起来(示意)

README 提供的典型方式是 Docker 一键启动,例如:

docker run -d -p 1279:1279 palemoky/chinese-poetry-api:latest

容器可自动处理数据库下载(以当前文档为准)。本地即可请求统计、列表、随机等接口,例如按朝代、作者分页查询。

也可用源码自行编译部署;需要 GraphQL 的同学按仓库文档启用对应端点。

使用时注意

  1. 数据来源与版权态度
    古诗词文本多为公有领域,但整理版数据集与项目代码仍有各自许可证,商用前读 LICENSE 与上游 chinese-poetry 说明。
  2. 文本校勘
    大规模整理难免异文、讹字;教学或出版级场景建议对照权威校本。
  3. 公共实例的稳定性
    演示站适合试用;正式产品建议自托管,避免受他人服务可用性影响。
  4. 不要当「唯一知识库」
    API 提供检索与结构化字段;赏析、注释、翻译仍需你自己的内容层或模型层。

小结

chinese-poetry-api 的价值很朴素:把「近 40 万首诗怎么变成可查询服务」这件事做完了。

对想给产品加一点文化气质、又不想先当半年数据工程师的人来说,这是省时间的基础设施。克隆、Docker、调接口——剩下的,是你的产品想讲什么样的「诗」。

No comments yet