📖 目录下一章 →

第一章 数智分析即技能化

章首:工具越来越多,会干活的人越来越少?

这是一个工具爆炸的时代。打开任何一个软件商店或AI平台,数据分析工具、可视化工具、大模型助手、自动化脚本琳琅满目,几乎每一款都宣称"让普通人也能做数据分析"。企业购置了昂贵的软件套件,个人订阅了一个又一个AI会员,但真正把数据用起来、把分析做出价值的人,却并没有按同样的速度增长。工具的数量在指数级膨胀,而"会用工具解决问题"的能力,依然是稀缺品。

问题出在哪里?出在"工具"与"技能"这两个词被混为一谈。

工具是别人造好的,技能是自己的。拥有一把手术刀,不等于拥有外科手术的能力;订阅了十个AI助手,也不等于拥有了数据分析的能力。工具解决的是"有没有趁手的家伙",技能解决的是"遇到问题能不能组织起一套打法"。过去二十年,数字化建设的重心一直在买工具、装工具、换工具;而今天,真正拉开差距的,是那些能把工具组织成"技能组合"的人和组织。这不是一个修辞问题,而是一个经济学问题:当工具本身成为廉价的通用品,稀缺的就不再是工具,而是使用工具的方法思维。我国数字经济总量从2018年的31.3万亿元增长至2022年的50.2万亿元,占GDP比重超过四成——当数据成为生产要素,把数据加工成决策的能力,就是数字经济时代的核心技能[1]。

本书要交付的,正是这样一套方法:LLM(大模型)+ Agent(智能体)+ Skill(技能)。大模型负责理解与生成,是"大脑";智能体负责拆解任务、调用工具,是"执行长";技能是可复用的能力单元,是"工具箱"。三者组合,构成一条从数据到决策的完整链路——本书称之为"数智分析即技能化"。这套框架不是纸上的理论:本书每一章都绑定实训平台上真实运行的应用,每一节都能在浏览器里亲手验证。

反馈与迭代

🧠 LLM
理解与生成

🤖 Agent
编排与执行

🛠️ Skill
采集·处理·分析·应用

📊 数据到决策

本章作为全书的认知起点,回答五个递进的问题:为什么"从工具到技能"是一次认知跃迁(第一节);大模型为什么是技能时代的通用引擎(第二节);Agent如何让技能从"我会"变成"它能替我干"(第三节);技能为什么可复用、如何设计(第四节);最后,亲手跑通一条完整的Skill链,建立"最小闭环"的体感(第五节)。


第一节 从"工具"到"技能"的认知跃迁

这一节的核心主张:工具是别人的,技能是自己的——工具爆炸时代,真正稀缺的是把工具组织成解决问题的能力。

两种学习路径的分野

学数据分析,传统路径是"一个工具接一个工具":先学Excel,再学SQL,再学Python,再学可视化……每个工具单独学一遍,学完发现换一个工具又要重新开始。工具之间是散的,知识是碎的,遇到新问题仍然不知道从哪下手。

另一种路径只学一套思维框架:数据从哪来(采集)→数据怎么变干净(处理)→数据说明什么(分析)→结论怎么用(应用)。框架不变,工具只是框架每个环节上的"可替换零件"——今天用Excel做采集,明天换API,后天换大模型,环节还是那四个环节,思维还是那套思维。这就像学开车与学修车的区别:前者掌握的是"把车开走"的系统能力,后者掌握的是"每个零件怎么拆装"的局部知识。工具会过时、会被替代,而"数据到决策"的框架不会。

由此引出全书最关键的一次认知跃迁:把"我会用某个工具"升级为"我拥有某个技能"。技能不是工具本身,而是"输入—处理—输出"的稳定能力:输入原始数据,经过一套可复述、可复用、可迁移的处理逻辑,输出可验证的结果。工具可以换,技能不换;工具是别人的,技能是自己的。

数据全流程的三类技能

把"数据到决策"展开,绝大多数数智分析任务都落在四类技能上:采集(数据从哪来——API、文件、数据库、爬虫)、处理(数据怎么变干净——清洗、转换、标准化)、分析(数据说明什么——统计、建模、挖掘)、应用(结论怎么用——看板、报告、决策建议)。四类技能首尾相接,就是一条"Skill链"。

本书的实训主线——数字化转型指数——就是一条真实的Skill链。它从巨潮资讯网逐家下载上市公司年报文本(采集),对年报做词频统计与归一化(处理),用主成分分析(PCA)把多维词频压缩成一维指数(分析),最后把指数做成可视化看板并接入AI解读(应用)。整套数据覆盖5467家上市公司、61410条企业-年份记录、85个行业——这不是虚构的示例数据,而是本书实训平台上真实运行、可在线查询的指数体系。以年报文本构造企业数字化水平的做法,已有系统的学术依据:杨德明与刘泳文(2018)的实证研究表明,企业的数字化实践显著提升了经营业绩——数字化转型的经济效应可被可靠度量,正是这种测度方法得以成立的基础[1]——本书实训正是把这一成熟方法搬上零代码平台。

📡 采集Skill
巨潮资讯网年报文本

🧹 处理Skill
词频统计·归一化

📊 分析Skill
PCA构建指数

📈 应用Skill
指数看板·AI解读

图1-1 数字化转型指数:一条完整的Skill链

在平台上验证

打开实训平台的"数字化转型指数"应用(实训平台应用库 zhenyuonline.cn ,digital-index-api 提供数据服务),输入任意一家上市公司代码,你会看到它历年数字化转型指数的变化曲线;再打开指数看板,能看到行业分布与年度对比。你看到的每一个数字,背后都是"采集→处理→分析→应用"四个环节在自动运转——这就是一条Skill链的活体标本。第一节不必动手搭建,先建立"一个结果背后是一条链"的直觉:看得见的是指数,看不见的是链


第二节 大模型:理解与生成

这一节的核心主张:大模型是技能时代的通用引擎——理解与生成能力,让"人指挥机器"变成"人用语言指挥机器"。

为什么大模型是"通用"的

2017年,Google团队发表《Attention Is All You Need》,提出Transformer架构[2],此后大模型的能力沿着"规模"这条曲线一路爬升:参数量从亿级到万亿级,训练语料从维基百科到整个互联网。大模型与以往AI系统的根本区别在于通用性:过去一个系统只能干一件事(识别猫、翻译句子、下围棋),大模型却能理解任意自然语言指令、生成任意格式的输出——写代码、做分析、总结报告、设计图案,靠的是同一套能力。2022年,Wei等人发现,仅仅在提示中给出"一步一步思考"的示范,就能显著激发大模型的推理能力(思维链,Chain-of-Thought)[3]——"理解"与"生成"这两项能力,成为一切AI应用的地基。

大模型如何驱动数据分析

人用自然语言
提出需求

🧠 大模型
理解需求·组织逻辑

📊 数据操作
查询·计算·分析

🧠 大模型
生成表达

人拿到
结论与报告

图1-2 大模型驱动数据分析:翻译官+协作者

在数智分析里,大模型扮演的不是"计算器",而是"翻译官+协作者"。它把三件过去只有人能做的事自动化了:一是理解需求——你说"看看今年软件行业的表现",它知道你要比较、要趋势、要结论;二是组织逻辑——它能把模糊需求拆成可执行的分析步骤;三是生成表达——把计算结果翻译成一句人能听懂的话,甚至生成一段报告。传统数据分析的瓶颈从来不是算力,而是"业务语言"与"数据语言"之间的翻译成本;大模型的本质,是把这层翻译成本几乎降到了零。

但必须清醒地看到大模型的能力边界。它的知识截止于训练时刻——2023年以后发生的事、实时变化的行情、企业内部的私有数据,它一概不知道;它会一本正经地编造不存在的数字(幻觉);它的推理在复杂多步任务上仍然不稳定。正因为有这些边界,本书才需要后两节的Agent与Skill:大模型负责"想",Agent负责"干",Skill负责"标准动作"——三者各管一段,扬长避短。

在平台上验证

打开本书实训平台的对话助手 Hermes Lite(https://zhenyuonline.cn/hermes-lite/),输入:"查一下数字化转型指数的含义,并用一句话解释。"注意观察:它先检索了平台的知识库(你能看到检索过程提示),再基于检索结果作答——"先查后答"就是大模型与外部数据协作的最小形态,也是第2章要展开的检索增强生成(RAG)的雏形。再输入:"把'学生成绩分析'这个需求拆成三个步骤。"看它如何把模糊需求组织成清晰逻辑。两次对话之后你会发现:大模型本身不会自动产生数据价值,但它是把人的意图转成数据操作的第一道闸门

本书的LLM生态:四类模型各管一段

本书实训平台上的大模型不是一种,而是一个生态,按能力分成四类。通用对话推理型(如DeepSeek与Hermes内置模型)负责理解需求、拆解任务、生成报告——平台的对话助手、AI解读都靠它;规则引擎型(轻量级LLM,如沪深300预测里的策略引擎)负责按既定逻辑执行计算,快而稳,但不会"发挥"也不会"发挥失常";文生图模型(如即梦API)负责把文字需求变成图案——智绘故事工坊、文化衫设计都走这条链;语音合成模型负责把文字变成声音——故事工坊的配音就是它。四类模型对应四种能力,本书第2章会系统对比它们的机制与选型。记住一句话:选模型不是选最聪明的,而是选最合适的——报表解读要的是准确,图案生成要的是创意,各取所需。


第三节 Agent:智能体的起源、方法与选择

这一节的核心主张:Agent让技能从"我会"变成"它能替我干"——人从工具使用者,升级为任务委派者。

一段七十年的溯源

"智能体"不是新词。1950年,图灵在《计算机器与智能》中提出"机器能否思考"之问[4];1995年,Wooldridge与Jennings给出了智能体的经典定义——"处在某个环境中、能感知环境并自主行动以实现目标的系统"[5]。此后三十年,智能体从实验室走向个人助手(Siri、Alexa),再走向今天的LLM智能体。真正的质变发生在2022年前后:Yao等人提出ReAct范式,让大模型在"推理(Reason)"与"行动(Act)"之间交替循环[6]——先想清楚下一步,再调用工具去做,观察结果,再想。从图灵之问到ReAct,机器完成了从"能答"到"能办"的跃迁。

四种工作方法

结果不合理结果合理

思考 Reason
下一步干什么

行动 Act
调用工具执行

观察 Observe
检查结果

继续或结束

图1-3 ReAct循环:思考→行动→观察→再思考

今天的Agent有四种主流工作方法。ReAct:思考→行动→观察→再思考,最基础也最通用;Plan-and-Execute:先把任务拆成计划再逐步执行,适合步骤明确的复杂任务;Reflection:每次行动后自我复盘、修正策略,适合需要迭代优化的任务;多Agent协作:多个Agent分工(串行/并行/主从),把组织分工搬进数字世界。四种方法不是互相替代,而是适用不同任务形态——本书第3章会逐一展开,这里先建立"Agent有方法可循"的认知。

选框架还是选方法?市面上的Agent框架(Hermes Agent、LangChain、AutoGen、Dify等)各有定位:有的强在轻量编排,有的强在多Agent对话,有的强在低代码可视化。本书实训平台选用Hermes Agent,原因很直接:它的Skill体系与本书"LLM+Agent+Skill"的认知框架完全同构——你在书里学到的每一个概念,在Hermes里都能找到对应的实体。框架的选择本质是"能力需求×工程约束"的匹配,没有最好,只有最合适。

在平台上验证:跑通股票估值Agent

打开股票估值工具(https://zhenyuonline.cn/stock-valuation/),输入一只股票代码(如000001)。你会看到它完整走完一条Agent链路:采集行情与财务数据→补齐模型参数→计算DDM与CAPM估值→生成估值卡片与AI解读。注意观察执行过程:它先取数(采集),再计算(处理/分析),最后生成解读(应用)——每一步都看得见,这就是一个"你派我干"的Agent在真实运行。对比一下第一节的数字化转型指数:一个是查指数(一条链),一个是估值(另一条链)——不同的应用,同样的四类技能,同样的Agent编排逻辑。这就是本书反复强调的:学会一套框架,而不是学会一个工具。


第四节 Skill:可复用的能力单元

这一节的核心主张:技能的可复用性决定生产力——一次编写,处处调用,这是把"经验"变成"资产"的关键一步。

什么是Skill

📥 输入
它接收什么

⚙️ 处理
它内部做什么

📤 输出
它产出什么

图1-4 一个Skill的三要素:输入→处理→输出

Skill(技能)是本书框架的第三块积木:一个可复用的能力单元,由三要素构成——输入(它接收什么)、处理(它内部做什么)、输出(它产出什么)。以"评论清洗Skill"为例:输入是原始评论文本,处理是去重、去噪、标准化,输出是干净的评论数据表。三要素说清楚了,这个Skill就可以被任何Agent调用,也可以被任何章节复用——第15章的速卖通评论分析要用它,第16章的过程化考核数据清洗也要用它。

为什么技能是可复用的资产

工具会过期,技能不会;数据会失效,方法不会。一次编写、处处调用,意味着把一次性的劳动沉淀为可复用的资产——这正是"技能化"与"自动化"的分野:自动化是写死一条路,技能化是沉淀一种能力。值得一提的是,连大模型自己也在"技能化":Schick等人2023年的Toolformer研究表明,语言模型能够在"直接回答"与"调用工具后回答"的对比中自发学会使用工具[7]——工具调用正在成为大模型的默认技能。当模型和人都以"技能"为单位组织能力时,"技能"就成了一种通用的能力语言。

在平台上验证:拆解股票估值Skill

回到股票估值工具,用三要素法拆解它:输入(股票代码)、处理(行情获取+模型参数+DDM/CAPM计算)、输出(估值卡片+AI解读)。拆完之后你会看到,这个看起来复杂的应用,本质是三个Skill的串联——采集Skill(取行情)、建模Skill(算估值)、报告Skill(生成解读)。再用同一个拆法去看数字化转型指数应用,你会发现拆出来的还是这三类。换个应用再拆一遍,Skill思维就建立了——这就是本节的验证目标:不要求你写代码,要求你"看任何应用,都能拆出它的Skill链"。


第五节 全流程体验:跑通一条Skill链

这一节的核心主张:从使用者到设计者——亲手跑通一条完整的Skill链,建立"最小闭环"的体感。

最小闭环:四步走完

① 采集
拿到数据

② 处理
让数据可用

③ 分析
算出结论

④ 应用
展示与解读

图1-5 最小闭环:四步走完一条Skill链

理论说得再多,不如亲手跑一遍。一条Skill链的最小闭环只有四步:采集(拿到数据)→处理(让数据可用)→分析(算出结论)→应用(展示与解读)。四步首尾相接,就是一个完整的数智分析任务。

在平台上验证:跑通股票估值工具

打开股票估值工具(https://zhenyuonline.cn/stock-valuation/),选一只股票(如贵州茅台600519)。第一步看数据从哪来(采集:行情与财务数据接口);第二步核对模型参数(处理:无风险利率、贝塔、增长率);第三步对比两个模型的结果(分析:DDM与CAPM的估值差异);第四步验证估值卡片与AI解读(应用:结论是否可解释、可溯源)。四步走完,你就跑通了一条真实运行在公网上的Skill链——不是演示,不是截图,是你亲手操作、亲眼验证的结果。

进阶:再跑另外两条链。打开沪深300预测工具(https://zhenyuonline.cn/hs300-predictor/),看它如何把采集到的成分股数据变成预测结果;打开速卖通评论分析(第15章实训),看评论文本如何变成情感洞察。跑完三条链,你会发现:应用千变万化,链的骨架始终是那四步

值得想一想

同样是"让AI干活",你在Hermes Lite里"说一句话"和在股票估值工具里"点几个按钮",体验的差别是什么?前者是Agent替你干活,后者是你亲手验证Agent怎么干活——从使用者到设计者,这是本章想带你完成的一次身份跃迁。第一章到此为止,但"LLM+Agent+Skill"这套框架才刚刚开始:第2章深入大模型,第3章拆解Agent,第4章修炼Skill化思维,之后每一章都是一个领域的实战——所有章节共享同一个认知框架。


章末小结与追问

本章回答了一个问题:在工具爆炸的数字时代,什么才是稀缺能力?答案是"数智分析即技能化"——用LLM理解与生成、用Agent编排与执行、用Skill沉淀可复用的能力,把"会用工具"升级为"拥有技能"。数字化转型指数、股票估值、沪深300预测,这些真实应用背后是同一条Skill链、同一套认知框架。书读到这里的你,已经从"看热闹"进入了"看门道"。

留三个问题给你想一想:

  1. 工具会过时,技能不会——你日常工作中最值得"技能化"的一个重复性任务是什么?如果把它做成Skill,输入、处理、输出分别是什么?
  2. "大模型负责想、Agent负责干、Skill负责标准动作"——以你熟悉的某个业务为例,三者各管哪一段?边界划在哪里最合适?
  3. 本章的三条Skill链(数字化转型指数、股票估值、沪深300)共享同一套框架——你能找出它们四个环节里"最不一样"的那个环节吗?为什么?

参考文献

  1. [1] 杨德明, 刘泳文. "互联网+"为什么加出了业绩[J]. 中国工业经济, 2018(5).
  2. [2] Vaswani A, Shazeer N, Parmar N, et al. Attention is all you need[C]. Advances in Neural Information Processing Systems 30, 2017.
  3. [3] Wei J, Wang X, Schuurmans D, et al. Chain-of-thought prompting elicits reasoning in large language models[J]. arXiv preprint arXiv:2201.11903, 2022.
  4. [4] Turing A M. Computing machinery and intelligence[J]. Mind, 1950, 59(236): 433-460.
  5. [5] Wooldridge M, Jennings N R. Intelligent agents: Theory and practice[J]. The Knowledge Engineering Review, 1995, 10(2): 115-152.
  6. [6] Yao S, Zhao J, Yu D, et al. ReAct: Synergizing reasoning and acting in language models[C]. International Conference on Learning Representations, 2023.
  7. [7] Schick T, Kwon J, Ziegler J, et al. Toolformer: Language models can teach themselves to use tools[J]. arXiv preprint arXiv:2302.04761, 2023.

数据与平台:本章实训绑定 zhenyuonline.cn 真实应用(Hermes Lite / 股票估值 / 数字化转型指数 / 沪深300预测)。页面渲染图均为平台实测截图。



数据与平台:本章实训绑定 zhenyuonline.cn 真实应用(Hermes Lite / 股票估值 / 数字化转型指数 / 沪深300预测)。页面渲染图均为平台实测截图。