我用 AI,做了一个能抓小红书公开数据、还能接入AI自动分析选题的软件

前段时间,我给自己定了一个小目标:做一个能采集小红书公开搜索结果的小工具。

一开始想法很简单,就是输入关键词,让程序打开浏览器,抓一下当前搜索页里能看到的公开笔记信息。比如标题、作者、点赞这些。

后面我又想,既然都抓到数据了,那是不是还可以顺手让 AI 帮我分析一下,看看哪些内容更容易火,顺便给我出几个选题方向?

于是,这个项目就慢慢从一个“小脚本”,长成了一个真正能用的软件。

最后做出来的成品,大概是这样:

  • • 可以输入关键词抓取小红书搜索结果页的公开数据
  • • 可以手动登录,登录状态还能保存
  • • 可以自己手动往下翻页,再点按钮继续抓
  • • 可以导出成表格(自己还可以按点赞数量自动排序)
  • • 还能接 DeepSeek,自动分析内容方向,给出 10 个选题和文案参考

说实话,做完以后我自己都有点感慨:

以前这种东西,我可能想一想就算了。现在有 AI 帮忙,真的会让人更敢、更想动手。

这个项目一开始,并没有那么顺

最早的时候,我以为这就是个“写点代码”的事。

结果真做起来才发现,开发里最不缺的就是“本来以为”。

比如程序刚开始跑,就先报环境错误(我用的PyCharm)。

不是功能问题,是连基础依赖都没装好。

这个阶段其实挺像做饭前先发现煤气没开、锅也没刷、盐还没买。

你本来想直接下厨,结果先去补厨房。

然后等环境终于搞好了,程序也能打开浏览器了,我又发现另外一个问题:

页面上明明有很多笔记卡片,但有些链接提取出来居然是错的,一点就 404。

原来网页上“你看到的链接”和“程序真正拿到的链接”不是同一个东西。

人眼觉得“这不就在那吗”,程序却拿到一个残缺版本,结果打开就迷路了。

后面只能一点点调整逻辑,让程序尽量拿到真正可用的完整链接(这部分我还在优化)。

这类问题看起来不大,但特别磨人。

后来我发现,最好的办法不是让程序太聪明,而是让人更舒服。

我一开始是想让程序自动往下滚页面、自动加载更多内容的。

但后来越做越觉得,不对。

因为真实使用的时候,反而是人自己控制节奏更舒服。

于是我干脆把逻辑改了:程序先抓当前能看到的内容,你自己在浏览器里往下翻,翻完以后点击“继续”,想停的时候再点“结束”。

这样一下子合理多了。

这也是我这次做项目一个挺深的感受:

很多时候,产品不是“功能越自动越高级”,而是“人用起来越顺越高级”。

自动滚动听起来很厉害,但滚轮滚一下或者按钮点一下继续,反而更符合真实使用习惯,也不容易被风控提醒。

图1,留学部分关键词抓取到的数据,按点赞量排序

后面最让我开心的一步,是把 AI 分析也接进来了

抓数据只是第一步。

真正让我觉得“这个工具开始有意思了”的,是我把 AI 分析能力也加了进去。

现在的逻辑是:

抓完一批数据之后,可以直接交给 DeepSeek,让它帮我看这些内容里有什么共同点,哪些方向更容易吸引人,哪些表达方式更适合做成爆款内容。

最后它会输出一份分析报告,里面包括:

  • • 这批内容的共同特点
  • • 值得继续做的方向
  • • 10 个具体选题
  • • 每个选题怎么切入
  • • 开头怎么写

这一步做完以后,我突然觉得这个工具不只是“抓数据”,而是开始真的对内容创作有帮助了。

以前你做内容选题,很多时候是靠感觉。

现在至少可以先把公开数据抓下来,再让 AI 帮你从里面总结规律。

不一定百分百神准,但至少比拍脑袋靠谱多了。

我还在优化提示词和加一些功能,比如直接创作出适合发布各个平台的内容,推送到草稿保存,后台人工审核即可发布的功能。整个链路就更加高效率了,所谓日更不是梦。

然后我又做了一件很“产品经理”的事:把它改成桌面软件

到这里,其实命令行版已经能用了。

但我很快就意识到一个问题:

如果每次都要输命令、看终端、按回车,那这个东西的受众还是太窄了。

只有会折腾电脑的人才愿意用。

于是我继续往前走了一步,把它做成了带界面的桌面软件。

现在这个软件可以做到:

  • • 点按钮开始抓取
  • • 登录后点“登录完成,继续”
  • • 手动翻页后点“继续翻页采集”
  • • 想停的时候点“结束当前抓取”
  • • 想做分析时,直接选一个数据文件,再点“开始分析”

我自己做教育行业,我最后看了一下分析报告成品,写得非常不错,做IP和原创内容没有选题思路的时候,看看这份报告确实有很多启发,马上就有了新的选题思路,并且都是抓人眼球、验证过会有热度的选题方向。

做到最后,我最大的感受不是“我会写代码了”,而是“AI 真的让开发门槛降了很多”

这次让我最有感触的,不是某一个功能终于做出来了,

而是整个过程里,AI 真的像一个随时在线的搭子。

我遇到问题的时候,不是只能自己闷头查资料、翻报错、一个人卡在那。

而是可以边做边调整,边遇到问题边解决。

链接不对,改。

界面太麻烦,改。

按钮逻辑不顺,改。

想接 AI,接。

想做成桌面版,继续改。

想打包成 exe,再往前走一步。

以前很多类似的想法,停留在“我觉得挺有用,但做起来好像很麻烦”。

现在最大的变化是:你会开始真的去做。

因为 AI 的存在,让很多原本让人望而却步的开发过程,变成了“虽然麻烦,但能推进”。

这个差别特别大。

以前你面对的是一整堵墙。

现在更像是面前有一架梯子。

墙还是那堵墙,但你不会只站在下面看了。

最后成品出来的时候,我其实有点恍惚

因为最开始,它只是一个小想法。

我只是想做个抓数据的小工具。

结果最后,它变成了一个能抓公开数据、能保存登录状态、能手动交互翻页、能导出结果、还能接 AI 出选题分析、甚至还能打包成软件的完整产品。

这种感觉挺奇妙的。

你会发现,有些事不是你做不到,而是以前独自做太费劲,所以干脆不做。

现在多了 AI 这个帮手,很多“本来算了”的事情,突然就有了被做出来的可能。

所以如果你问我,这一整个过程最大的感受是什么?

我会说:

AI 编程最厉害的地方,不只是帮你写代码,而是它让你更敢、更快地开始。

它不是替你完成一切。

它也会出错,也会绕路,也会需要你不断确认和修改。

但它真的会让整个开发过程,从“一个人硬扛”,变成“有人一起往前推”。

而这件事,本身就已经很强了。

如果放在以前,我大概率只会说:

“这个工具挺好,可惜懒得做。”

现在我会说:

“想法有了?那就开干吧。”

因为很多时候,你差的不是能力,

你差的只是一个能陪你把事情推下去的搭子。

而 AI,刚好就是那个搭子。

最成品软件截图(等我把最终功能和界面完善好会开放出来给圈友试用)

最后是软件使用说明:

小红书采集与 AI 分析工具 使用说明

作者:@暮子风

一、软件用途

本工具用于通过真实浏览器访问小红书公开搜索结果页,采集当前页面公开可见的笔记元数据,并支持调用 DeepSeek 生成选题分析报告。

二、主要功能

  1. 1. 输入关键词或读取关键词文件进行采集
  2. 2. 支持手动登录并复用登录状态
  3. 3. 支持手动下滑浏览器后继续采集
  4. 4. 导出 CSV、JSON、截图
  5. 5. 选择已有 JSON 文件进行 AI 分析
  6. 6. 生成爆款选题分析报告

三、使用方法

  1. 1. 打开软件
  2. 2. 输入关键词,或选择关键词文本文件
  3. 3. 点击“开始抓取”
  4. 4. 浏览器打开后,如需登录,请手动完成登录
  5. 5. 登录完成后,返回软件点击“登录完成,继续”
  6. 6. 程序完成一轮采集后,请在浏览器中手动向下滚动加载更多内容
  7. 7. 回到软件点击“继续翻页采集”
  8. 8. 需要结束当前关键词采集时,点击“结束当前抓取”
  9. 9. 采集完成后会导出数据文件
  10. 10. 如需 AI 分析,填写 DeepSeek API Key,选择 JSON 文件后点击“开始分析”

四、按钮说明

  • • 开始抓取:启动浏览器并开始采集
  • • 登录完成,继续:登录后继续执行
  • • 继续翻页采集:手动下滑浏览器后继续采集
  • • 结束当前抓取:结束当前关键词采集并导出
  • • 选择数据文件:选择已有 JSON 数据文件
  • • 开始分析:调用 DeepSeek 生成报告
  • • 查看使用说明:展开或隐藏软件内说明

五、输出目录

  • • CSV / JSON 数据:默认保存在 data 文件夹
  • • 截图:默认保存在 data\\screenshots
  • • AI 分析报告:默认保存在 data\\analysis

六、注意事项

  1. 1. 本工具仅适合个人研究、低频使用
  2. 2. 仅采集公开页面可见数据
  3. 3. 使用过程中仍需人工登录与人工翻页
  4. 4. DeepSeek API Key 需要用户自行填写
  5. 5. 发布时建议保留整个程序目录,不要只单独移动 exe 文件
© 版权声明
THE END
喜欢就支持一下吧
点赞15 分享
muzifeng的头像-环球搭子
评论 抢沙发

请登录后发表评论

    暂无评论内容