花一下午只导出80条评论而它半小时拿全了全部B站评论爬虫BilibiliCommentScraper实测【免费下载链接】BilibiliCommentScraperB站视频评论爬虫 Bilibili完整爬取评论数据包括一级评论、二级评论、昵称、用户ID、发布时间、点赞数项目地址: https://gitcode.com/gh_mirrors/bi/BilibiliCommentScraper晚上九点你盯着浏览器一页页往下滚复制、粘贴、再滚。三个小时后表格里躺着80条评论——而页面上方赫然写着共3287条。回复被折叠楼层关系散成一团谁回复了谁都对不上号。你关掉页面觉得这一晚白干了。这不是技术问题是工具问题。手刷网页永远只能拿到冰山一角而B站评论爬虫BilibiliCommentScraper做的事就是帮你把页面里所有可见的评论搬进CSV包括一级评论和二级评论连昵称、用户ID、发布时间、点赞数都一并保留。一句话说清它的价值它把你手动滚动加复制粘贴的活变成了写一行列表、跑一个命令。就像给评论区装了一台扫描仪——你负责翻页的那部分它全包了。从下载到第一份数据我只用了十分钟我的完整流程是这样的git clone https://gitcode.com/gh_mirrors/bi/BilibiliCommentScraper cd BilibiliCommentScraper pip install selenium beautifulsoup4 webdriver-manager然后把想抓的视频地址写进video_list.txt一行一个https://www.bilibili.com/video/BV17M41117eg https://www.bilibili.com/video/BV1QF411q73H运行python Bilicomment.py它弹出浏览器提示我登录一次。扫码、回车剩下的事不用管了。十分钟后目录里多了两个以视频ID命名的CSV文件。第一次跑就拿到了页面底部最后一条评论——也就是全部可见评论。唯一的手动操作只有那一次登录。登录状态会被存进cookies.pkl下次运行自动带上不用再扫。它替你省下的三样东西省时间。批量抓取是默认能力。十几个视频的评论全部塞进video_list.txt晚上挂机让它跑第二天醒来CSV已经齐了。它用Selenium模拟真实浏览器滚动加载而不是调B站接口所以能拿到接口给不全的页面数据。省力气。程序崩溃、断网、电脑休眠——都没关系。它的进度存在progress.txt里随时中断随时从断点继续写了一半的CSV也不会丢。哪个视频抓失败了会被记进video_errorlist.txt你事后一眼就能看到谁掉队了。防坑。手动复制最大的损失是层级关系。它的CSV里有一列隶属关系明确标注每条评论是一级还是二级二级评论还带被评论者昵称和被评论者ID。谁回复了谁评论树长什么样数据里一清二楚。如果你想再进一步这套工具留了几个可以拧的旋钮都在Bilicomment.py里如果你要抓的是10万评论的热门视频把MAX_SCROLL_COUNT默认45次约对应920条一级评论调小或给max_sub_pages默认150页设个上限。浏览器滚太久会内存崩溃限制滚动次数反而更稳。如果你担心请求太频繁被B站冷处理把固定的time.sleep换成随机延时比如time.sleep(random.uniform(1, 5))节奏更接近真人。如果你要跨视频做整体分析CSV都是UTF-8编码直接用pandas把多个文件读进来合并评论树、点赞分布、时间序列都能接着算。拿到数据之后它意味着什么抓完一个视频你会得到类似这样的表格每一列都能派上用场隶属关系让你重建完整的讨论脉络——高赞的一级评论下挂了多少回复回复质量如何点赞数帮你筛出最有共鸣的评论做舆情或选题时优先看它们发布时间可以画出讨论热度的曲线看视频发布后评论在哪个时段爆发。给UP主做反馈分析、给学生论文攒数据集、给品牌方监测口碑——数据拿到手剩下的是你的分析问题不是采集问题。你大概率会踩的三个坑坑一抓到的数量比页面显示的少。别慌这通常是B站评论数虚标部分评论被隐藏、删除或封禁。判断标准很简单你手动把页面滚到底看到的最后几条和CSV里最后几条一致就说明所有可见评论都抓全了。坑二Excel打开CSV乱码。CSV是UTF-8编码老版Excel直接双击打开容易乱。用数据→从文本/CSV导入编码选UTF-8或者先拿记事本确认内容正常。坑三单元格报错显示$NAME?。有些昵称以-开头比如-GhausterExcel把它当成了公式。导入时把该列设为文本格式或导入后用预处理清洗一下即可。边界说在前面这个工具只抓公开可见的评论不碰任何私密数据。它适合研究、分析和个人学习不适合批量搬运后商用也不建议在短时间内高频猛抓——B站有风控礼貌一点请求间隔留足它反而跑得更久。数据全程留在本地不经过任何第三方服务器。回到开头那晚现在再回到那个复制粘贴到凌晨的场景如果当时你有这个工具3287条评论在半小时内就能全部落盘层级关系、点赞数、时间戳一个不缺。你省下的不是那三个小时而是第二天醒来重做的力气。下一步很轻clone 仓库往video_list.txt里写一行视频地址运行一次扫码登录。你要做的第一件事只是扫一次码。【免费下载链接】BilibiliCommentScraperB站视频评论爬虫 Bilibili完整爬取评论数据包括一级评论、二级评论、昵称、用户ID、发布时间、点赞数项目地址: https://gitcode.com/gh_mirrors/bi/BilibiliCommentScraper创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考