用python实现的百度新歌榜、热歌榜下载器

首先声明，本工具仅仅为学习之用，不涉及版权问题，因为百度音乐里面的歌曲本身是可以下载的，而且现在百度也提供了”百度音乐播放器”，可以通过这个工具进行批量下载。

我当时做这个工具的时候，百度还没有提供”百度音乐播放器”,而我又想批量下载，所以做了这样的一个下载工具。当然，主要还是为了学习。

工具采用Python2.7.3+PyQt开发。

功能：

1.集中展示百度新歌榜或热歌榜可下载的歌单。

2.支持单个、多个歌曲的下载。

3.可复制歌单中所有的链接内容，方便在迅雷等下载工具中创建下载组。

缺陷：

目前采用单线程，效率不高，UI界面容易假死。

本工具运行流程：

1.模拟用户登录百度。

2.若登录成功，采集并解析页面内容，加载歌单列表。

3.用户点击下载按钮或者批量下载按钮后，下载歌曲。

用python实现的百度新歌榜、热歌榜下载器

使用方法：

1.在配置文件setting.py的最后，配置可登录百度的账号和密码，及百度热歌榜或新歌榜的URL.

username = "your baidu acount"    #配置你的百度账号

password = "your baidu password"  #配置你的百度密码

musiclistUrl = "http://music.baidu.com/top/dayhot"  #   http://music.baidu.com/top/new

2.直接运行mainWindow.py文件即可，如果网速不给力的话可能要等上3、4分钟。

运行后如图：

用python实现的百度新歌榜、热歌榜下载器

用到的知识：

1.首先用到了PyQt的GUI编程，窗体布局及QTableWidget、QProgressBar、QPushButton等控件及控件的重写

2.用到了网络编程的部分内容，利用urllib,urllib2,cookielib请求网页，模拟登录百度。

3.利用HTMLParser解析网页内容，匹配网页元素。

4.利用codecs进行文件的读写。

遇到的问题：

1.编码问题，由于在创建文件时将文件编码设置为UTF-8,当需要向文件写入的内容为中文等非ASCII码内容时，总是提示编码问题。其实，百度音乐的网页全部为UTF-8格式，因此从网页中获取的内容也是UTF-8格式，但是，要讲内容写入UTF-8的文本中，必须将网页内容进行decode(“utf8”)解码为unicode格式，才能正常写入。

检测内容编码，可以用chardet模块的chardet.detect(“内容”)的方法。

另外，HTMLParser解析网页内容过程中，有的下载页面会出现问题，根据提示信息发现还是编码问题，将feed()方法中的内容参数进行decode(“utf8”)后，结果正常。

decode将内容根据参数内容解码为unicode类型，具体要根据所采集的页面的编码。

github下载地址：点这里

用python实现的百度新歌榜、热歌榜下载器的更多相关文章

用python实现的百度音乐下载器-python-pyqt-改进版
之前写过一个用python实现的百度新歌榜.热歌榜下载器的博文,实现了百度新歌.热门歌曲的爬取与下载.但那个采用的是单线程,网络状况一般的情况下,扫描前100首歌的时间大概得到40来秒.而且用Pyqt ...
Python学习-使用Python爬取陈奕迅新歌《我们》网易云热门评论
<后来的我们>上映也有好几天了,一直没有去看,前几天还爆出退票的事件,电影的主题曲由陈奕迅所唱,特地找了主题曲<我们>的MV看了一遍,还是那个感觉.那天偶然间看到Python中 ...
Python爬取网易云热歌榜所有音乐及其热评
获取特定歌曲热评: 首先,我们打开网易云网页版,击排行榜,然后点击左侧云音乐热歌榜,如图: 关于如何抓取指定的歌曲的热评,参考这篇文章,很详细,对小白很友好: 手把手教你用Python爬取网易云40万 ...
Python抓取百度汉字笔画的gif
偶然发现百度汉语里面,有一笔一划的汉字顺序: 觉得这个动态的图片,等以后娃长大了,可以用这个教写字.然后就去找找常用汉字,现代汉语常用字表 .拿到这里面的汉字,做两个数组出来,一共是 ...
Python抓取百度百科数据
前言本文整理自慕课网<Python开发简单爬虫>,将会记录爬取百度百科"python"词条相关页面的整个过程. 抓取策略确定目标:确定抓取哪个网站的哪些页面的哪部分 ...
python—webshell&lowbar;醉清风xf&lowbar;新浪博客
python—webshell_醉清风xf_新浪博客 python—webshell (2012-05-23 09:55:46) 转载▼
Python爬虫之小试牛刀——使用Python抓取百度街景图像
之前用.Net做过一些自动化爬虫程序,听大牛们说使用python来写爬虫更便捷,按捺不住抽空试了一把,使用Python抓取百度街景影像. 这两天,武汉迎来了一个德国总理默克尔这位大人物,又刷了一把武汉 ...
将python工程部署到新服务器(对virtualenv工具进行环境迁移)
将python工程部署到新服务器(对virtualenv工具进行环境迁移) # 从开发的电脑上导出 pip list 到 requirements.txt 文件pip freeze > requ ...
python开发的百度翻译接口
做的一个python版的百度翻译,附代码 #!/usr/bin/env python # -*- coding:utf-8 -*- ''' 爬虫之百度翻译需要的库有 js2py, request ...

随机推荐

python爬虫学习(8) —— 关于4399的一个小Demo
堂弟喜欢各种游戏,在没有网络的情况下,上4399显得很无力. 另外,4399广告好多,,而且加载慢.. 怎么办,,写个爬虫吧,,把4399上的"好玩"游戏爬下来. 1. 分析阶段 ...
【安装MongoDB】CentOS7 下安装NodeJs+Express+MongoDB+Redis
MongoDB,V3.2版本,官网说的很详细,见链接:https://docs.mongodb.com/manual/tutorial/install-mongodb-on-red-hat/ 1.创建 ...
性能测试-ORACLE性能监控
通过lr做性能测试的过程,通过监控Oracle数据库的性能采用的监控工具:PeOny PeOny安装 1. 安装服务端 1) LINUX平台安装解压缩peony3.x.0.x.tar.gz文件,b ...
遍历所有的选中的radio的个数和值
var ID = ""; $('input:radio:checked').each(function (i) { ...
深入理解Linux中内存管理
前一段时间看了<深入理解Linux内核>对其中的内存管理部分花了不少时间,但是还是有很多问题不是很清楚,最近又花了一些时间复习了一下,在这里记录下自己的理解和对Linux中内存管理的一些看 ...
【转】Qt Mode/View
1.view与Widget 在UI中,最常用的就是list/grid/tree了(在Qt中,grid被称为table).尤其是做那些数据库相关的程序,可能每个界面都要用到 list或grid.在Qt中 ...
SVN更改登录用户(转)
一) 原地址:http://www.ixna.net/articles/2606 //证书缓存 $ svn list https://host.example.com/repos/project Er ...
个人信息——头像更换（拍照或相册上传）~ 微信小程序
微信小程序中在用户信息中关于用户头像更换(拍照或相册上传)功能实现. 图像点击触发事件: <image src='{{personImage}}' bindtap='changeAvatar' ...
Shell脚本笔记（四）条件判断
条件判断一.条件测试与比较一)条件测试基础语法下列测试语法中如果测试的表达式成立,条件测试就会结束,并返回0. 1.test条件测试语法:test <测试表达式> 2.中括号条件 ...
Hierarchical softmax(分层softmax)简单描述&period;
最近在做分布式模型实现时,使用到了这个函数. 可以说非常体验非常的好. 速度非常快,效果和softmax差不多. 我们知道softmax在求解的时候,它的时间复杂度和我们的词表总量V一样O(V),是性 ...