如何批量导出抖音评论TikTokCommentScraper 三步把千条评论变成 Excel【免费下载链接】TikTokCommentScraper项目地址: https://gitcode.com/gh_mirrors/ti/TikTokCommentScraper去年我帮朋友做一次线上抽奖视频发出后评论区一周堆了 900 多条留言。按规则得随机抽人可我翻了一个下午手指酸了不说还发现有人回复别人、有人 好友层级关系完全理不清。手动复制到表格更是不现实900 条要复制到天亮。那一刻我特别想要一个按钮把整片评论区连同谁回复了谁一次性倒出来。后来我找到的答案不是付费工具而是一个开源项目TikTokCommentScraper。它到底是什么能省掉多少事一句话TikTokCommentScraper 是一个开源的抖音评论采集工具用浏览器控制台 两个脚本的组合拳把一、二级评论全部加载出来整理成 CSV 复制到剪贴板再用 Python 转成 Excel 文件。你不需要写爬虫、不需要逆向接口、不需要装数据库打开网页按几下 F12 就能跑完整个流程。对比项手动复制TikTokCommentScraper900 条评论耗时数小时起步2-5 分钟回复层级关系全靠肉眼自动标注父评论点赞数/时间逐个抄自动提取输出格式零散笔记一个 Excel 文件最终生成的Comments_时间戳.xlsx里每条评论自带这些字段编号、昵称、用户 、主页链接、评论文本、发布时间、点赞数、头像链接、是否为二级回复、回复了谁、回复数量以及视频本身的信息作者、发布时间、点赞分享数、简介等。3 分钟跑通第一次采集最快路径只有五步我用倒计时的方式给你排好克隆仓库到本地git clone https://gitcode.com/gh_mirrors/ti/TikTokCommentScraper用 Chrome、Edge 或 Brave 打开目标视频页确认评论区能手动往下滚动然后按F12打开开发者工具的控制台 Tab把采集脚本送进剪贴板Windows 用户直接双击根目录的Copy JavaScript for Developer Console.cmd其他系统执行python src/CopyJavascript.py回到浏览器控制台粘贴、回车。看到CSV copied to clipboard!就说明采集完成双击Extract Comments from Clipboard.cmd或其他系统执行python src/ScrapeTikTokComments.py项目根目录随即多出一个 Excel 文件整套流程里最贴心的一点Windows 用户完全不用装 Python。仓库自带一个约 7MB 的精简版python38环境两个.cmd文件会直接调用它双击即用依赖零安装。如果你在 Linux 或 macOS 上先pip install -r requirements.txt只有pyperclip和openpyxl两个包再手动跑两个 Python 脚本即可。三个真正值钱的能力拆开看1. 模拟滚动把永远加载不完的评论区捞干净抖音评论区是无限滚动的你手动滑到底还会有新内容普通爬虫很难稳定触发加载。脚本的做法很朴素反复把最后一条评论滚进视野强制页面请求下一页然后等待 300ms检查评论数有没有增长。// 只要评论数还在涨就把缓冲重置为 15 轮连续 15 轮没新增才判定加载完成 if (numOfcommentsAftScroll ! numOfcommentsBeforeScroll) { loadingCommentsBuffer 15; } else { loadingCommentsBuffer--; } await new Promise(r setTimeout(r, 300)); // 等 0.3 秒给页面加载留时间这段逻辑的价值在于耐性它不依赖猜一个固定滚动次数而是以评论数是否还在增长作为终止条件网络卡顿或加载变慢时自动延长等待。我当时采一条 2000 多条评论的视频全程约 5 分钟浏览器控制台实时打印已加载第 N 条能看到进度心里就踏实。2. 自动展开回复保住完整的对话层级普通工具只能拿到第一层评论但投票、抽奖、舆情分析往往需要知道谁在回复谁。脚本用 XPath 精确匹配带PReplyAction且文本含 View 的按钮——这么写是为了避开文本为 Hide 的收起按钮——循环点击直到没有新的展开按钮出现。// 所有含 View 的回复按钮逐个点击等 500ms 让回复渲染完成 readMoreDivs[i].click(); await new Promise(r setTimeout(r, 500));真正的技术点在数据整理阶段脚本遍历每条评论通过父元素的 class 判断它是不是二级回复并向前回溯找到对应的父评论昵称。所以 Excel 里会出现三个贴心的列Is 2nd Level Comment是否二级回复、User Replied To回复了谁、Number of Replies这条评论带几条回复。对抽奖场景来说这就是合规抽签的原始凭证。3. 数据真实性自检不被平台虚报的数字骗到抖音自己显示的评论数经常虚高。脚本会同时记录两个数字TikTok 声称的评论总数以及实际渲染出来的评论数并把差值写进表格。采集结束还会在控制台打印一行提示比如Number of magically missing comments (not rendered in the comment section): 64 (you have 2936 of 3000)这个细节很实在——它直接告诉你哪些数据可能缺而不是让你拿到一份看起来完整其实漏了的表格。在我那次 3000 条评论的测试里TikTok 实际只渲染出 2936 条约 2% 的评论因平台限制永远加载不出来这是 TikTok 前端的问题不是脚本的 bug。一次真实的实战复盘我用它采过一个投票视频的评论区全程大约是这样打开视频页确认评论区能滚动后按 F12控制台粘贴脚本回车等待阶段浏览器开始自动滚动二级回复逐个展开期间笔记本风扇声变大——评论超过 1000 条后页面渲染确实会有点卡这是预期内的拿到 CSV复制成功后运行 Python 转换脚本Excel 文件生成验收用筛选功能按是否为二级回复分类再把回复了谁一列拉出来投票统计 5 分钟做完。过程中踩了三个坑都记下来分享给你直接链接页面没有复制链接按钮脚本默认从那个按钮取视频地址所以作者在代码里做了兼容找不到时就改用window.location.href。如果你用的是分享出来的直接链接依然能正常采集。直接链接页面会先滚动到推荐视频列表导致判断没有新评论而提前结束。脚本的补救办法是把评论区容器本身也scrollIntoView一次。如果你的页面卡在这一步可以检查这个兼容逻辑是否生效。弹窗式评论界面不显示分享数脚本会把分享数记为N/A这是设计内的降级不是报错。避坑清单照抄就行安全第一往浏览器控制台粘贴的代码一定要先扫一眼。这份 JS 全文不发起任何网络请求唯一敏感操作是写入剪贴板你可以对照src/ScrapeTikTokComments.js逐一确认再运行。先确认评论区能手动滚动再跑脚本否则脚本可能误判没有新评论而提前收工。别拿 TikTok 显示的评论数当验收标准它偏高是常态以脚本打印的实际渲染数为准。单次建议在 5000 条以内评论越多页面越卡超过这个量分段采。网络状况差时把脚本里的300毫秒等待时间调大避免加载跟不上滚动速度。TikTok 前端改版可能导致选择器失效届时需要更新src/ScrapeTikTokComments.js顶部的 XPath 定义。适合谁用以及下一步如果你是要办抽奖和投票的运营、需要快速汇总用户反馈的内容创作者、做竞品评论分析的市场人员或者单纯想学浏览器控制台采集这门手艺的开发者这个工具都能给你省下大把时间。它的价值边界也很清晰只能采集公开可见的评论区受 TikTok 前端更新影响评论量大时体验会打折扣——但作为零成本的开源方案性价比已经很高了。想深入研究的话建议从两个文件入手src/ScrapeTikTokComments.js是浏览器端采集核心XPath 与滚动逻辑都在里面src/ScrapeTikTokComments.py是数据处理部分值得关注的是它如何清洗剪贴板里的回车符、再用openpyxl落盘 Excel。把这两个脚本读完你基本就能自己动手改字段、加过滤、对接 pandas 做情感分析了。工具只是手段真正值钱的是你对数据的理解。先从一条几十条评论的视频练手跑通流程之后你就能体会把几百上千条评论握在 Excel 里随意筛选的感觉了。【免费下载链接】TikTokCommentScraper项目地址: https://gitcode.com/gh_mirrors/ti/TikTokCommentScraper创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考