Phase 1

浏览器只读接入验证

浏览器只读接入验证

状态:已通过 日期:2026-07-23

本文记录 Phase 1a 对已登录 Chrome 的只读接入验证。它只说明当前环境是否可读取 X 页面,不构成自动化任务已经可用的结论。

结论

当前 Chrome 登录态可读取 X 的关注时间线、已收藏作者主页和主题搜索结果。页面文本、帖子 URL、发布时间、正文、引用关系和部分媒体标记均可提取;搜索页滚动后可继续加载更多帖子。

验证期间没有执行点赞、转发、关注、发消息、修改书签或其他账号写操作。

已验证场景

场景 结果 观察
X 首页与关注时间线 通过 已登录态可见;切换至 Following 后可读取时间线帖子。
帖子结构化字段 通过 可读取原帖 URL/ID、作者、发布时间、正文、引用帖文本和媒体存在标记。
已收藏作者主页 通过 已验证 @tuturetom 的公开资料页和帖子列表可读取。
主题搜索 通过 已验证 AI agents 的 Latest 搜索结果可读取。
无限滚动 通过 主题搜索页滚动一次后,文章节点从 11 增至 21。

当前读取方式

  • 使用已打开 Chrome 的现有登录态。
  • 通过 Apple Events 执行只读页面 JavaScript。
  • 为避免覆盖用户当前页面,验证时只新开 X 标签页。
  • 页面读取不保存 Cookie、Token、密码或浏览器凭证。

尚未验证

  • 连续获取每路 100 条候选时的稳定性与耗时。
  • 登录失效、验证码、限流和页面结构变化时的失败处理。
  • 作者列表与主题搜索词的批量执行策略。
  • 去重、过滤、排序与每日 100 条推荐生成。
  • 定时运行时浏览器可用性和宿主机时区。

进入下一步判断

浏览器只读接入不再是 Phase 1a 的阻塞项,可以进入本地数据模型和候选采集实现。

定时任务仍不创建。只有在手动运行三路候选读取、每日推荐页和 Feedback 闭环稳定后,才验证 Asia/Shanghai 20:00 的调度配置。