docs: 新增「信息获取」分类,添加 30 个开源项目

新增一级分类「信息获取」,包含以下子分类:
- RSS 生成与聚合 (4 个项目)
- RSS + AI 增强 (4 个项目)
- 综合信息聚合平台 (4 个项目)
- AI 新闻聚合 (4 个项目)
- 爬虫与抓取框架 (5 个项目)
- 其他信息工具 (9 个项目)

涵盖 RSSHub、Folo、BestBlogs、crawl4ai、firecrawl 等热门项目。

Co-Authored-By: Claude Opus 4.6 <noreply@anthropic.com>
This commit is contained in:
Claude Code
2026-03-11 10:29:41 +08:00
parent bdeb33aa91
commit 6e34279565
+56
View File
@@ -16,6 +16,13 @@ Awesome GitHub Repo 会收集整理 GitHub 上高质量、有趣的开源项目
- [AI Agent](#ai-agent)
- [AI Skills](#ai-skills)
- [AI 工具](#ai工具)
- 信息获取
- [RSS 生成与聚合](#rss-生成与聚合)
- [RSS + AI 增强](#rss--ai-增强)
- [综合信息聚合平台](#综合信息聚合平台)
- [AI 新闻聚合](#ai-新闻聚合)
- [爬虫与抓取框架](#爬虫与抓取框架)
- [其他信息工具](#其他信息工具)
- 好玩项目
- [黑科技](#黑科技)
- [沙雕项目](#沙雕项目)
@@ -110,6 +117,55 @@ Awesome GitHub Repo 会收集整理 GitHub 上高质量、有趣的开源项目
- [Vibe Vibe](https://github.com/datawhalechina/vibe-vibe) - Datawhale 出品的 Vibe 编程教程,系统讲解 AI 辅助编程的方法论和实践,适合开发者入门学习。
- [Personal AI Infrastructure](https://github.com/danielmiessler/Personal_AI_Infrastructure) - 个人 AI 基础设施搭建完整指南,涵盖本地部署 LLM、向量数据库、Agent 框架等组件的选型和配置。
## 信息获取
### RSS 生成与聚合
- [RSSHub](https://github.com/DIYgod/RSSHub) - 万物皆可 RSS 的路由生成器,为上千网站内容生成 RSS 源,是 RSS 生态的基础设施。
- [FreshRSS](https://github.com/FreshRSS/FreshRSS) - 自托管 RSS 订阅聚合器,支持多用户、WebSub、XPath 抓全文、Google Reader 兼容 API。
- [garss](https://github.com/zhaoolee/garss) - 用 GitHub Actions 采集 RSS,生成无广告的"头版头条"信息流页。
- [News-Agent](https://github.com/zskfree/News-Agent) - 自动化新闻聚合和 RSS 订阅源生成器,基于 GitHub Actions 定时运行,多分类新闻汇总。
### RSS + AI 增强
- [RSSbrew](https://github.com/yinan-c/RSSbrew) - 自托管 RSS 工具:多源聚合 + 自定义过滤 + AI 摘要 + 日/周 Digest。
- [Precis](https://github.com/leozqin/precis) - 可扩展的自托管 RSS 阅读器,使用 LLM 对多源信息做摘要和综合分析,支持 Ollama / OpenAI 等。
- [RSS-AIGC](https://github.com/GongLingRui/rss-aigc) - 现代 RSS 订阅与 AI 内容加工平台,支持 Hacker News / GitHub / ArXiv 等源聚合与 AI 处理。
- [AutoContents](https://github.com/comeonzhj/AutoContents) - 基于 RSS 的 AI 资讯聚合、内容创作与 Agent 自动化工具,支持 RSSHub、翻译、三类自动推送等。
### 综合信息聚合平台
- [Folo](https://github.com/RSSNext/Folo) - 27.8K Star 的信息聚合神器,把各种来源(文章、视频、动态等)集中在一个时间线,支持 AI 翻译和总结,可创建和分享订阅清单。
- [BestBlogs](https://github.com/ginobefun/BestBlogs) - 汇集顶级编程、AI、产品、科技文章,使用大语言模型摘要评分辅助阅读,基于 Dify Workflow 构建,支持 200+ RSS 订阅源。
- [Mimir](https://github.com/cctv2206/mimir-opensource) - AI 驱动的信息聚合与分发系统,支持 Twitter 实时监控、RSS 订阅、网页抓取、市场数据等,通过 Telegram / 飞书 / Webhook 分发。
- [TrendRadar](https://github.com/sansan0/TrendRadar) - 多平台热点聚合 + RSS 订阅 + 关键词筛选的 AI 舆情与趋势监控系统,支持多渠道推送(微信/飞书/钉钉/Telegram/邮件等),支持 MCP 对话接入。
### AI 新闻聚合
- [Scira](https://github.com/zaidmukaddam/scira) - AI 驱动的轻量级搜索引擎,像"智能调度员"一样把搜索请求转发给各种 AI 模型和搜索工具,汇总整理结果。
- [ai-news-aggregator](https://github.com/SuYxh/ai-news-aggregator) - 自动聚合 80+ AI/科技资讯源,支持 RSS 导入、关键词过滤、双语标题翻译,每 2 小时由 GitHub Actions 自动更新。
- [auto-news](https://github.com/finaldie/auto-news) - 个人新闻聚合器,从 Tweets / RSS / YouTube / Web 文章 / Reddit 等多源拉取,通过 ChatGPT / Gemini / Ollama+LangChain 做总结、过滤和每周回顾。
- [newshub](https://github.com/Varshithvhegde/newshub) - AI 驱动的新闻聚合与摘要平台,React + TypeScript + Node.js + Redis,使用 Google Gemini 和向量搜索做语义检索与个性化推荐。
### 爬虫与抓取框架
- [crawl4ai](https://github.com/unclecode/crawl4ai) - LLM 友好的通用 Web Crawler & Scraper,主打大规模、低成本的网页抓取,为 AI 应用提供数据。
- [firecrawl](https://github.com/firecrawl/firecrawl) - "把网站变成 LLM-ready 数据"的 API,支持 Scrape / Search / Browse / Crawl / Map / Batch 等操作。
- [Scrapegraph-ai](https://github.com/ScrapeGraphAI/Scrapegraph-ai) - 使用 LLM + 有向图逻辑构建抓取 pipeline 的 Python 库,支持单页、多页、搜索结果抓取。
- [Scrapling](https://github.com/D4Vinci/Scrapling) - 自适应 Web 抓取框架,支持 spider 框架、动态加载(Playwright)、反 bot、代理轮换、AI 集成。
- [Scrapy](https://github.com/scrapy/scrapy) - Python 经典高性能爬虫框架,用于从网站提取结构化数据,是爬虫领域的事实标准。
### 其他信息工具
- [feedstore-3.0](https://github.com/MagicCube/feedstore-3.0) - 集 RSS 聚合服务端、Web 客户端和 iOS 客户端为一体的私人阅读解决方案。
- [my_rss_reader](https://github.com/being1943/my_rss_reader) - 利用 GitHub Actions 把订阅的 RSS 每日更新推送到邮箱。
- [SecurityRSS](https://github.com/arch3rPro/SecurityRSS) - 安全资讯 RSS 订阅源集合(OPML 格式),便于导入任意 RSS 阅读器。
- [top-rss-list](https://github.com/weekend-project-space/top-rss-list) - 订阅人数较多的优质 RSS 源列表(中文区为主)。
- [Flambo](https://github.com/plouc/flambo) - Node.js 构建的内容聚合平台,支持以"Groups / Collections / Sources"组织 RSS 等数据源。
- [WebAggregator](https://github.com/Tencent/WebAggregator) - 腾讯开源的 Web 信息聚合框架,包含 QA 构建引擎、查询轨迹和模型,高度可定制的数据采集与聚合。
- [OpenScraper](https://github.com/entrepreneur-interet-general/OpenScraper) - 极简、带 Web 界面的通用 Web 抓取工具,面向低技术门槛的用户。
- [snapscrape](https://github.com/jyothepro/snapscrape) - 把网页转换为 Markdown 的抓取工具,支持 LLM 过滤与 API。
## 好玩项目
### 黑科技