首页 > 图书中心 > 教学用书 > 本科研究生 > 经济

Python语言与经济大数据分析-郭峰

Python语言与经济大数据分析

丛书名:新文科·新投资
著(译)者:郭峰
资源下载:
责任编辑:李成军
字       数:783千字
开       本:16 开
印       张:37.75
出版版次:1
出版年份:2024-10-07
书       号:978-7-5642-5032-4/F.5032
纸书定价:98.00元   教师会员可用500积分申请样书

大数据(Big Data)已经成为经济金融活动的重要基础和各学科关注的重点,但传统的数据处理技术和工具不太适用于大数据的情形,新兴的处理技术和工具迫切需要引入学生课堂。Python语言作为处理大数据的最成熟工具,已被广泛应用于学术界和实业当中。本教材的目的是介绍Python语言的基本语法及其在经济大数据分析中的基本应用,侧重于文本分析、数据处理、网络爬虫、数据可视化等代表性的大数据处理技术。通过本课程的学习,希望学生能掌握Python语言的基本语法规则、简单应用和编程常识,为未来进一步深入自助式学习与实践

  • 大数据(Big Data)已经成为经济金融活动的重要基础和各学科关注的重点,但传统的数据处理技术和工具不太适用于大数据的情形,新兴的处理技术和工具迫切需要引入学生课堂。

    Python语言作为处理大数据的最成熟工具,已被广泛应用于学术界和实业当中。

    本教材的目的是介绍Python语言的基本语法及其在经济大数据分析中的基本应用,侧重于文本分析、数据处理、网络爬虫、数据可视化等代表性的大数据处理技术。

    通过本课程的学习,希望学生能掌握Python语言的基本语法规则、简单应用和编程常识,为未来进一步深入自助式学习与实践奠定基础。


    用Python解锁经济大数据,让AI成为你的数据分析搭档。

    这是一本沉淀六年一线教学经验的Python经济数据分析教材,源自上海财经大学面向全国开放的热门在线课程,历经多轮打磨优化。

    全书专为经管领域学习者量身设计,采用「先实操、后理论」的低门槛路径,刻意降低面向对象编程等抽象概念的入门负担,用大量真实科研场景案例,帮读者快速实现从语法入门到经济数据处理的能力跨越。

    全书紧跟AI时代学习趋势,每章设置专属「AI辅助学习」板块,还专门增设大语言模型实操章节,教你善用智能工具提升数据分析效率。

    本书适配高校经管类本硕博学生、相关领域研究者,以及想要快速上手Python的经济数据分析从业者。

  • 第1 章 导论 / 1。
    1.1 经济大数据的内涵与特征 / 1。
    1.2 Python 简介与优势 / 2。
    1.3 软件安装与环境配置 / 4。
    1.4 内容安排与学习建议 / 13。
    第2 章 数据类型与数据结构 / 17。
    2.1 变量赋值 / 17。
    2.2 数据类型 / 21。
    2.3 数据结构 / 30。
    2.4 运算符号 / 44。
    第3 章 语句与函数 / 52。
    3.1 Python 语句基本规则 / 52。
    3.2 判断语句 / 55。
    3.3 循环语句 / 59。
    3.4 函数 / 66。
    3.5 第三方库 / 73。
    3.6 报错与调试 / 76。
    第4 章 本地数据读取 / 81。
    4.1 TXT 文件读取 / 81。
    4.2 CSV 文件读取 / 90。
    4.3 Excel 文件读取 / 95。
    4.4 Word 文件读取 / 99。
    4.5 JSON 文件读取 / 104。
    第5 章 网络数据爬取 / 110。
    5.1 网络爬虫原理 / 110。
    5.2 静态网页爬取 / 117。
    5.3 动态网页爬取 / 131。
    5.4 反爬机制与应对策略 / 141。
    5.5 实战案例: 巨潮资讯网泛ESG 报告目录爬取 / 148。
    第6 章 数值计算基础模块 / 155。
    6.1 NumPy 模块 / 155。
    6.2 Math 模块 / 174。
    6.3 SciPy 模块 / 177。
    6.4 StatsModels 模块 / 181。
    第7 章 Pandas 数据处理入门 / 190。
    7.1 Pandas 数据类型简介 / 190。
    7.2 数据框常用操作 / 200。
    7.3 特殊类型数据处理 / 217。
    7.4 数据预处理 / 236。
    7.5 实战案例: 某电影票房数据清洗 / 249。
    第8 章 Pandas 数据处理进阶 / 258。
    8.1 多级索引与数据重塑 / 258。
    8.2 数据框分组与聚合 / 274。
    8.3 数据框合并与连接 / 290。
    8.4 实战案例: 中国知网数据清洗 / 302。
    第9 章 文本数据处理入门 / 313。
    9.1 词频统计 / 313。
    9.2 正则表达式 / 317。
    9.3 分词 / 330。
    9.4 文本指标计算 / 335。
    9.5 实战案例: 管理层讨论与分析的文本分析 / 338。
    第10 章 文本数据处理进阶 / 348。
    10.1 文本表征方法 / 348。
    10.2 文本情绪分类 / 358。
    10.3 文本主题分类 / 373。
    10.4 文本相似度 / 379。
    10.5 实战案例: 管理层讨论与分析文本特征 / 382。
    第11 章 数据可视化 / 389。
    11.1 Matplotlib 模块 / 389。
    11.2 Seaborn 模块 / 405。
    11.3 Pyecharts 模块 / 415。
    11.4 实战案例: 电商平台用户消费行为可视化 / 426。
    第12 章 地理空间数据处理 / 438。
    12.1 地理空间数据简介 / 438。
    12.2 矢量数据处理 / 441。
    12.3 栅格数据处理 / 455。
    12.4 矢量地图裁剪栅格数据 / 463。
    12.5 实战案例: 城市边界镇与中心镇灯光提取 / 471。
    第13 章 大规模数据处理 / 480。
    13.1 大规模数据处理优化基本原则 / 480。
    13.2 类型优化与局部加载 / 483。
    13.3 计算优化与并行处理 / 496。
    13.4 I/O 优化与数据存储 / 514。
    13.5 实战案例: 分析海量高频交易数据 / 519。
    第14 章 大语言模型数据处理 / 524。
    14.1 大语言模型的简介与应用场景 / 524。
    14.2 大语言模型的输入与输出 / 528。
    14.3 大语言模型数据处理典型任务 / 537。
    14.4 大语言模型的 API 调用 / 542。
    14.5 实战案例: 大语言模型识别文本情绪 / 547。
    第15 章 面向对象编程入门 / 552。
    15.1 面向对象编程简介 / 552。
    15.2 属性与方法 / 557。
    15.3 封装、继承与多态 / 566。
    15.4 面向对象编程视角下的第三方包调用 / 584。
    15.5 实战案例: 构建模块化的微博舆情分析系统 / 591。
    参考文献 / 597
  • 当前, 中国经济社会正经历一场深刻的数字化转型。

    在这一进程中, 海量、多模态 的大数据应运而生, 不仅为我们洞察社会经济运行规律提供了前所未有的机遇, 也对 我们掌握先进的数据处理方法与工具提出了迫切要求。

    在众多数据分析工具中, Python 以其卓越的普适性与强大的生态功能, 已成为大数据分析领域的重要选择。

    本书正是基于这一时代背景, 系统讲解Python 编程基础及其在经济大数据分析中的 实践应用。

    本教材的雏形源于多年的课程建设。

    自2019 年起, 我便在上海财经大学面向本、 硕、博不同层次的学生讲授Python 编程相关课程。

    在学校支持下, 该课程曾以在线形 式在“智慧树”平台面向全国开放, 累计吸引了数千名学员选修。

    多年的教学积累促使 我产生了将讲义整理成册的强烈愿望。

    为此, 我邀请了团队成员郑建东博士与吕斌博 士共同组建编写组。

    两位博士在攻读博士学位期间就曾协助我校订在线课程的讲义, 如今他们均已在各自高校开设Python 相关课程, 具备扎实的专业素养与丰富的教学 经验。

    虽然有强烈的愿望把多年的授课讲义整理成教材, 但真正进入编写阶段后, 才深 切体会到“授课”与“成书”之异。

    教材编写不仅需注重知识体系的系统性与完整性, 更 需兼顾叙述的可读性与学习者的接受度, 而且要考虑到市面上已经有至少十几种 Python 教材。

    因此, 本书的撰写可谓一波三折, 历时数载: 2023 年上半年试写了两 章, 后因事务繁忙一度搁置; 直至2024 年年末重启, 经团队整整一年的全力投入, 这部 厚实的著作方得以完稿。

    在这期间, 学校、学院相关部门和领导, 出版社相关领导都给 予了很大的鼓励和帮助。

    基于编写团队的学科背景, 本书特别针对经济与管理领域的学习者与研究者设 计。

    书中融入了大量来自真实研究工作的操作案例, 旨在帮助读者实现从理论学习到 业务实践的快速转化。

    在编写过程中, 编写组始终秉持“降低门槛、惠及大众”的初衷, 力求以通俗易懂的方式介绍Python 编程知识。

    例如,Python 是典型的面向对象语 言, 但在实际的数据处理任务中, 过度使用类和模块往往会增加初学者的认知负担。

    因此, 我们慎重做出了取舍: 在前面章节尽量避免引入类、对象等抽象的编程范式, 仅 在最后一章作为拓展知识介绍面向对象编程的要点。

    这种“先实操、 后理论”的安排, 源自我们多年的实践和教学总结。

    本书编写的另一个宏大背景是人工智能时代的全面到来。

    Python 是 AI 算法的 核心载体, 而大语言模型(LLM)的发展也深刻改变了编程学习的范式。

    为此, 本书在 编写过程中积极融入人工智能元素。

    例如, 每章设有“AI 辅助学习”的板块, 引导读者 在掌握教材内容的基础上进一步拓展知识边界。

    同时, 本书还专设一章, 简要介绍如 何利用大语言模型直接完成某些数据处理任务。

    善用 AI 工具已成为当代Python 学 习者的必备技能, 这也是本教材区别于传统编程书籍的一大亮点。

    在编写组织上, 全书大纲与各章细目均由编写组三人反复研讨确定, 后由郑建东 博士与吕斌博士分别执笔初稿。

    具体分工如下: 郑建东博士负责第2、5、6、7、8、11、13 及15 章, 共计8 章; 吕斌博士负责第1、3、4、9、10 及14 章, 共计6 章; 我的另一个博士 生曹友斌也参与编写了第12 章的初稿。

    每一章初稿完成后, 均由我逐一进行修改与 完善, 多数章节历经数轮甚至十余轮的修订。

    在最终定稿阶段, 我又对全书进行了两 轮统稿与润色。

    因此, 书中若仍有疏漏或不当之处, 理应由我承担主要责任。

    尽管编写团队为本书倾注了大量心血, 但鉴于认知局限及技术日新月异, 书中难 免存在不足之处。

    我们诚挚欢迎各位读者批评指正, 您的任何意见或建议均可发送 至: guofengsfi@163.com。

    此外, 本教材中的所有代码均以“例n-m”或“实战案例”的 形式存在, 这些代码均是可以实际运行的代码。

    为了方便读者实操, 我们特意将所有 代码都编写在了独立的 Notebook 讲义中, 并附带了演示用数据, 读者可以在我的个 人主页上下载:https://guof1984.icoc.in。


版权所有(C)2025 上海财经大学出版社   沪ICP备12043664号-2  沪公网安备31009102000068号

(署)网出证(沪)字第053号         联系我们 | 法律声明 | 友情链接 | 盗版举报 | 人才招聘