查找与保存内容
保存站把“定位内容”“查询归档”和“从洛谷抓取”串成同一条使用路径。理解输入如何被解析,可以减少把 UID 当关键词、把剪贴板当文章等误操作。
首页输入规则
首页按以下顺序识别输入:
- 洛谷文章、剪贴板或用户页面链接;
article:、paste:、user:、uid:或“用户:”前缀;- 纯数字正整数,按用户 UID 打开;
- 八位字母数字串,按文章 ID 打开;
- 其他文本,进入全文搜索。
剪贴板 ID
不带 paste: 的八位 ID 会优先按文章打开。查找剪贴板时建议粘贴完整链接,或使用 paste:ID。
全文搜索
搜索页只检索文章索引,支持:
- 标题、摘要、正文和作者名相关关键词;
uid:123456、author:123456或作者:123456形式的作者 UID;- 文章分类筛选;
- URL 中的
q、authorId、category和page参数,便于分享搜索结果。
结果展示文章标题、摘要、作者、分类和更新时间。软删除文章会同步删除标记,并从普通搜索结果中过滤。
文章分类
当前后端使用八个明确分类:比赛记录、题解、技术、算法、生活、学习、娱乐和闲聊。旧数据或无法识别的值会以未知分类处理。
保存工作流
当文章或剪贴板查询返回 404 时,前端可以创建对应保存模板:
article-save-pipeline:抓取文章,并可继续处理摘要、搜索索引、向量和内容安全任务;paste-save-pipeline:抓取剪贴板,不生成文章摘要、文章向量或文章搜索索引。
同一个目标的活跃工作流会通过去重键复用,避免多位访客反复创建完全相同的任务。
保存过程中的状态
工作流由多个任务组成,常见状态包括等待、运行、完成、失败和过期。前端通过 WebSocket 订阅报告任务;重新连接后会尝试回放终态,因此临时断网不代表后端任务已经丢失。
失败时页面会展示后端归一化后的错误原因,并允许重试。连续重试前,应先判断错误是暂时网络故障还是内容本身不可访问。
文章更新与版本
文章保存时会比较标题和内容。发生变化后:
- 保存新内容;
- 建立新的历史版本;
- 更新渲染结果和内容哈希;
- 按部署配置更新摘要、搜索索引和向量数据。
文章页面的历史版本按版本号展示。切换旧版本只影响当前阅读内容,不会把旧版本写回最新版。
用户主页保存
访问 /user/UID 可以读取已保存的洛谷用户资料。资料过期时,界面可提示刷新;刷新任务会抓取公开用户名、颜色、认证等级、签名、个人介绍和奖项信息。用户资料表用于展示作者,不等同于保存站登录账号表。
不支持或受限制的情况
- 非公开、无效或被源站拦截的内容;
- 需要绕过权限才能访问的内容;
- 不是文章或剪贴板的任意洛谷页面;
- 已软删除且当前用户无管理权限的归档;
- 源站响应结构变化、验证码挑战或依赖服务故障。
保存站提供的是尽力而为的公开内容归档,不承诺任何输入都能成功保存。