news 2026/9/8 2:28:38

思源笔记网页剪藏上手指南:5 步把网页存成知识块

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
思源笔记网页剪藏上手指南:5 步把网页存成知识块

思源笔记网页剪藏上手指南:5 步把网页存成知识块

【免费下载链接】siyuanAn open-source, privacy-first, self-hosted knowledge workspace where humans and AI agents work together 开源、隐私优先、自托管的知识工作空间,让人与智能体在此协作项目地址: https://gitcode.com/GitHub_Trending/si/siyuan

读到一篇长文想存下来,复制粘贴后排版全乱,图片也丢了一半。思源笔记的网页剪藏功能可以把整页内容连同排版、图片和表格一起收进笔记本,并保留指向原网页的回链。本文按真实流程演示:装好扩展、完成首次剪藏,再处理收藏进来的内容。

准备工作:剪藏前的环境清单

开始前,确认手头具备以下三样:

  • 思源笔记主程序:已安装并处于运行状态,剪藏请求最终由它写入工作区;
  • Chromium 内核浏览器:Chrome、Edge 等,用于安装官方浏览器扩展;
  • 同步账号(可选):打算在手机、平板和电脑间共享剪藏内容时,提前登录同一账号。

快速上手:三分钟装好扩展并剪藏第一页网页

  1. 安装浏览器扩展:从官方仓库下载扩展包,在浏览器地址栏输入chrome://extensions/,打开"开发者模式",将扩展包拖进页面即完成安装。
  2. 配置剪藏目标:进入设置 > 编辑器 > 网页剪藏,指定默认笔记本与存放路径。建议使用/剪藏/{{domain}}/{{date}}这类格式,剪藏会按来源域名和日期自动归档。
  3. 选择剪藏格式:在剪藏面板中从完整 HTML、纯文本、Markdown 三种格式里选一种,完整 HTML 最接近原页面的观感。
  4. 执行首次剪藏:打开目标网页,点击工具栏上的思源笔记图标,面板中选择"完整页面",等待 3–5 秒处理完成,浏览器会自动跳到剪藏结果页。
  5. 核对入库结果:在笔记中找到新生成的文档,确认标题、正文与图片完整,且保留了指向源网页的链接。

按场景选择剪藏方式:整页、选区与后台任务

整页剪藏适合需要完整保存的文章、教程和长文。点击工具栏图标后选择"完整页面",数秒后即可入库。💡 页面内容较多时处理时间略长,属正常现象。

选区剪藏适合只取页面局部内容的情况,例如一段引用或某张数据表的说明。用鼠标选中目标内容(支持跨段落),右键选择"思源笔记剪藏"中的"选区内容",可顺手加上标签和备注,确认后完成。

后台剪藏适合一次收藏多个页面的场景。在剪藏面板勾选"后台剪藏"后继续正常浏览,任务在后台排队处理,全部完成后会收到系统通知,不打断当前工作流。

剪藏后的内容处理:去重、拆块与知识关联

去重。重复剪藏同一页面时,思源笔记基于 SimHash 自动检测相似内容,提供跳过、覆盖、另存为三个选项,避免笔记本里堆积重复文档;剪藏文档也支持按域名、日期等维度批量整理。

拆块与标注。剪藏进来的长文档可以拆成独立的知识块:Ctrl+Shift+D拆分块,把长文本分成逻辑段落;选中关键句后按Ctrl+B加粗高亮。

建立关联。在编辑器中输入[[即可插入指向其他文档的链接,把剪藏内容接进已有的知识网络,而不是让它孤立在剪藏文件夹里。

效率对比与常见坑

把网页剪藏与手动复制粘贴放在同一尺度上看:

维度手动复制粘贴思源笔记网页剪藏
排版与图片大量丢失原样保留
原始出处需自己记网址自动带回链
归档方式手动建文件夹按域名、日期自动归档
多端可用仅当前设备云端同步到所有设备
单篇耗时约 10 分钟约 2 分钟

⚠️ 三个高频坑:

  • 剪藏时思源笔记主程序未运行,请求会失败,出发前确认程序开着;
  • 浏览器扩展版本过旧时,部分页面剪藏不完整,定期检查更新;
  • 未在设置 > 编辑器 > 网页剪藏中配置默认路径,剪藏会散落在默认位置,后期整理成本高。

进阶能力:跨设备同步与 AI 分类

跨设备剪藏同步

在手机、平板和电脑上登录同一账号后,剪藏内容随云端同步落到所有设备,路上手机上剪的页面,回到工位接着整理即可。

剪藏内容 AI 自动分类

在设置中开启 AI 分类后,系统会按剪藏内容的主题自动归类,分类规则可按自己的体系调整,省去逐篇打标签的时间。

读后自检

  • 能否独立完成"下载扩展包 → 开发者模式 → 拖拽安装"?
  • 默认剪藏路径是否已按域名和日期设定?
  • 整页、选区、后台三种剪藏分别适合什么场景?
  • 遇到重复剪藏时,知道在哪选择"跳过/覆盖/另存为"?

挑出最近想读的一页网页剪掉试试,格式细节可参考 SY 格式说明。

【免费下载链接】siyuanAn open-source, privacy-first, self-hosted knowledge workspace where humans and AI agents work together 开源、隐私优先、自托管的知识工作空间,让人与智能体在此协作项目地址: https://gitcode.com/GitHub_Trending/si/siyuan

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/4 16:18:47

whisper.cpp 离线语音识别指南:三步跑通第一次转写

whisper.cpp 离线语音识别指南:三步跑通第一次转写 【免费下载链接】whisper.cpp Port of OpenAIs Whisper model in C/C 项目地址: https://gitcode.com/GitHub_Trending/wh/whisper.cpp 会议录音、采访音频想转成文字,又不想把音频发到任何云端…

作者头像 李华
网站建设 2026/9/3 15:26:43

从0到1搭建AI-Native组织:以Skills为核心的可复用LLM能力资产体系

AI-Native 组织的研发体系,核心资产正在从代码仓库转向可组合的 Skills。所谓 AI-Native,不是简单地把大模型接入现有后台,而是把模型调用、检索增强、智能体编排、评测反馈这些能力当作软件系统的原生组成部分来设计。此时最大的问题不是写出…

作者头像 李华
网站建设 2026/9/5 14:41:06

Hermes v2026.8.19更新解读:零Key搜索与Bot协作实战指南

这次我们来看 Hermes 桌面端的一次重要更新。v2026.8.19 版本把两个日常高频需求摆到了前面:零 Key 搜索和Bot 协作。简单说,零 Key 搜索解决的是“要用联网搜索还要单独申请搜索服务 Key”的繁琐问题;Bot 协作解决的是“多个模型、多个角色怎…

作者头像 李华
网站建设 2026/9/6 3:41:00

3分钟跑通 Exo:本地分布式 AI 集群环境配置与安装排错全攻略

3分钟跑通 Exo:本地分布式 AI 集群环境配置与安装排错全攻略 【免费下载链接】exo Run frontier AI locally. 项目地址: https://gitcode.com/GitHub_Trending/exo8/exo exo 把多台本地设备自动组成一个 AI 集群,让单卡装不下的大模型跑起来&…

作者头像 李华
网站建设 2026/9/6 8:59:08

ROS与MATLAB通信与仿真:从话题打通到Gazebo联合仿真

如果你同时在用 ROS 和 MATLAB 做机器人开发,应该对这样的场景不陌生:算法在 MATLAB 里仿真得很漂亮,波形、误差、收敛过程全部符合预期;可一旦要交给真实机器人,或者放进 Gazebo 里的虚拟机器人跑,就得把数…

作者头像 李华