去除字符串中定界符后的所有内容
来源:stackoverflow
时间:2024-02-25 15:33:24 472浏览 收藏
在Golang实战开发的过程中,我们经常会遇到一些这样那样的问题,然后要卡好半天,等问题解决了才发现原来一些细节知识点还是没有掌握好。今天golang学习网就整理分享《去除字符串中定界符后的所有内容》,聊聊,希望可以帮助到正在努力赚钱的你。
问题内容
我正在用 golang 构建一个网络爬虫应用程序。
下载页面的 HTML 后,我将 URL 分离出来。 我看到的 URL 中含有“#s”,例如“en.wikipedia.org/wiki/Race_condition#Computing”。我想删除“#”后面的所有字符,因为这些字符无论如何都会指向同一页面。关于如何做到这一点有什么建议吗?
解决方案
对 luke joshua park 的答案的改进是解析相对于源页面 url 的 url。这会根据页面上可能的相对 url(未指定方案、未指定主机、相对路径)创建绝对 url。另一个改进是检查和处理错误。
func clean(pageurl, linkurl string) (string, error) { p, err := url.parse(pageurl) if err != nil { return "", err } l, err := p.parse(linkurl) if err != nil { return "", err } l.fragment = "" // chop off the fragment return l.string() }
如果您对获取绝对 url 不感兴趣,请砍掉 # 后面的所有内容。这是可行的,因为 url 中 # 的唯一有效使用是片段分隔符。
func clean(linkurl string) string { i := strings.lastindexbyte(linkurl, '#') if i < 0 { return linkurl } return linkurl[:i] }
使用url
包:
u, _ := url.Parse("SOME_URL_HERE") u.Fragment = "" return u.String()
文中关于的知识介绍,希望对你的学习有所帮助!若是受益匪浅,那就动动鼠标收藏这篇《去除字符串中定界符后的所有内容》文章吧,也可关注golang学习网公众号了解相关技术文章。
声明:本文转载于:stackoverflow 如有侵犯,请联系study_golang@163.com删除
相关阅读
更多>
-
502 收藏
-
502 收藏
-
501 收藏
-
501 收藏
-
501 收藏
最新阅读
更多>
-
139 收藏
-
204 收藏
-
325 收藏
-
477 收藏
-
486 收藏
-
439 收藏
课程推荐
更多>
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 立即学习 542次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 立即学习 507次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 立即学习 497次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 立即学习 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 立即学习 484次学习