网页中可见的字体文件通常通过CSS引入,例如使用@font-face规则或直接在HTML中引用外部字体文件。要提取这些字体文件,可以按照以下步骤操作:一、查看网页源代码右键点击页面,选择“查看页面源代码”(或按Ctrl+U)。查找与字体相关的代码,如:<linkrel="stylesheet"href="styles.css">或者直接内联的@font-face规则。二、查找CSS中的
时间:2025-08-22 13:15:37 256浏览 收藏
你在学习文章相关的知识吗?本文《如何提取网页可见HTML节点中的字体文件》,主要介绍的内容就涉及到,如果你想提升自己的开发能力,就不要错过这篇文章,大家要知道编程理论基础和实战操作都是不可或缺的哦!
本文旨在提供一种使用JavaScript过滤网页上可见HTML节点的方法,以便提取网页中实际使用的字体文件。通过结合querySelectorAll、offsetWidth、offsetHeight以及window.getComputedStyle等API,我们可以有效地筛选出在页面上实际呈现的元素,并获取它们使用的字体信息,从而避免提取到未实际显示的字体。
在开发诸如提取网页字体文件的Chrome扩展程序时,一个常见的问题是如何排除那些虽然存在于DOM中,但实际上在页面上不可见的元素。例如,某些网站可能会将字体应用于隐藏的元素或仅在特定条件下显示的元素。为了解决这个问题,我们需要一种方法来过滤出网页上可见的HTML节点。
过滤可见节点
一种有效的方法是利用元素的 offsetWidth 和 offsetHeight 属性。如果一个元素的这两个属性都大于0,则可以认为该元素是可见的。我们可以使用 document.querySelectorAll 获取所有子元素,然后使用 filter 方法来筛选出可见的元素。
以下是示例代码:
var childNodes = [].slice.call(document.body.querySelectorAll("*")); var visibleNodes = childNodes.filter(node => node.offsetWidth > 0 && node.offsetHeight > 0);
这段代码首先使用 document.body.querySelectorAll("*") 获取
元素下的所有子元素。然后,使用 [].slice.call 将返回的 NodeList 转换为数组,以便可以使用数组的 filter 方法。filter 方法使用一个回调函数来判断每个元素是否可见,只有 offsetWidth 和 offsetHeight 都大于 0 的元素才会被保留。注意: 这种方法比简单地检查 display: none 等CSS属性更为可靠,因为它可以考虑到元素因各种原因而不可见的情况,例如被其他元素遮挡或超出视口范围。
获取可见元素的字体
在获得可见节点列表后,我们可以使用 window.getComputedStyle 来获取每个元素的字体信息。
以下是示例代码:
var fontFamilies = visibleNodes.map(node => window.getComputedStyle(node).fontFamily).filter(ff => !!ff);
这段代码使用 map 方法将可见节点数组转换为字体家族数组。然后,使用 filter 方法过滤掉空字符串或 null 值,确保只保留有效的字体家族。
去重字体家族
为了获得唯一的字体家族列表,可以使用 Set 数据结构。
以下是示例代码:
var uniqueFamilies = [...new Set(fontFamilies)];
这段代码使用 Set 数据结构来存储唯一的字体家族,然后使用展开运算符 ... 将 Set 转换为数组。
完整示例
以下是一个完整的示例,演示了如何过滤网页上可见的HTML节点并提取唯一的字体家族列表:
var childNodes = [].slice.call(document.body.querySelectorAll("*")); var visibleNodes = childNodes.filter(node => node.offsetWidth > 0 && node.offsetHeight > 0); var fontFamilies = visibleNodes.map(node => window.getComputedStyle(node).fontFamily).filter(ff => !!ff); var uniqueFamilies = [...new Set(fontFamilies)]; console.log(uniqueFamilies);
总结
通过结合 querySelectorAll、offsetWidth、offsetHeight 以及 window.getComputedStyle 等API,我们可以有效地过滤出网页上可见的元素,并获取它们使用的字体信息。这种方法可以帮助我们提取网页中实际使用的字体文件,避免提取到未实际显示的字体,从而提高效率和准确性。在实际应用中,可以根据具体需求进行调整和优化。例如,可以根据特定的CSS选择器来筛选元素,或者使用更复杂的算法来判断元素的可见性。
今天关于《网页中可见的字体文件通常通过CSS引入,例如使用@font-face规则或直接在HTML中引用外部字体文件。要提取这些字体文件,可以按照以下步骤操作:一、查看网页源代码右键点击页面,选择“查看页面源代码”(或按Ctrl+U)。查找与字体相关的代码,如:
-
501 收藏
-
501 收藏
-
501 收藏
-
501 收藏
-
501 收藏
-
179 收藏
-
421 收藏
-
109 收藏
-
216 收藏
-
245 收藏
-
426 收藏
-
141 收藏
-
407 收藏
-
228 收藏
-
267 收藏
-
309 收藏
-
311 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 立即学习 542次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 立即学习 511次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 立即学习 498次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 立即学习 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 立即学习 484次学习