做古诗小程序、每日一句机器人、语文学习工具时,最劝退的往往不是前端,而是数据:诗词要去哪找、怎么清洗、简繁怎么转、检索怎么做。
chinese-poetry-api 把这件事收成一套可部署的 API:基于开源 chinese-poetry 数据集,用 Go 提供服务,REST 与 GraphQL 双接口,Docker 一键拉起,调用方专心产品逻辑即可。
GitHub:https://github.com/palemoky/chinese-poetry-api
在线演示(项目 README 所示):https://poetry.palemoky.com
里面有什么?
公开说明里,体量约在 三十余万到近四十万首 量级(随数据库版本微调),覆盖常见品类,例如:
- 唐诗(含绝句、律诗、乐府等)
- 宋词、五代词
- 元曲
- 诗经、楚辞
- 以及其他整理条目
并支持按 朝代、作者、类型 等维度筛选,以及 全文搜索、随机一首、简繁切换(如 lang=zh-Hans / zh-Hant)。
对开发者友好的一点是:性能取向明确(Go、并发),简繁转换也做了工程化优化,适合作为内部微服务或学习项目后端。
能解决谁的痛?
场景 | 价值 |
古诗/诗词类小程序 | 免自建爬虫与脏数据清洗 |
飞书/Telegram/微信机器人 | 随机一首、按作者查询很直接 |
教育与背诵工具 | 按体裁、作者组卷、抽查 |
网站「每日诗」组件 | 定时拉随机接口即可 |
学 API / Docker 的练手 | 中文语料 + 清晰 REST 示例 |
怎么跑起来(示意)
README 提供的典型方式是 Docker 一键启动,例如:
docker run -d -p 1279:1279 palemoky/chinese-poetry-api:latest
容器可自动处理数据库下载(以当前文档为准)。本地即可请求统计、列表、随机等接口,例如按朝代、作者分页查询。
也可用源码自行编译部署;需要 GraphQL 的同学按仓库文档启用对应端点。
使用时注意
- 数据来源与版权态度
古诗词文本多为公有领域,但整理版数据集与项目代码仍有各自许可证,商用前读 LICENSE 与上游 chinese-poetry 说明。 - 文本校勘
大规模整理难免异文、讹字;教学或出版级场景建议对照权威校本。 - 公共实例的稳定性
演示站适合试用;正式产品建议自托管,避免受他人服务可用性影响。 - 不要当「唯一知识库」
API 提供检索与结构化字段;赏析、注释、翻译仍需你自己的内容层或模型层。
小结
chinese-poetry-api 的价值很朴素:把「近 40 万首诗怎么变成可查询服务」这件事做完了。
对想给产品加一点文化气质、又不想先当半年数据工程师的人来说,这是省时间的基础设施。克隆、Docker、调接口——剩下的,是你的产品想讲什么样的「诗」。




No comments yet