《硬件系统篇》课件_第1页
《硬件系统篇》课件_第2页
《硬件系统篇》课件_第3页
《硬件系统篇》课件_第4页
《硬件系统篇》课件_第5页
已阅读5页,还剩26页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

《硬件系统篇》计算机组成原理与硬件架构全景解析Contents课程目录从全局视角出发,系统掌握计算机硬件五大核心组件的工作原理与协同机制。01计算机系统全局总览02运算器:数据计算的核心引擎03控制器:指令调度与执行中枢04存储器:数据的多级存储体系05输入与输出设备:人机交互通道06总线与接口:系统互联架构CHAPTER01计算机系统全局总览从发展历程到架构思想,建立硬件系统的宏观认知EVOLUTIONOFCOMPUTING计算机发展四代演进计算机从1946年至今经历四次重大技术变革,核心驱动力是基础器件的迭代升级。每一代都实现了体积缩小、功耗降低、性能跃升的历史性突破。ENIAC·1946第一代:电子管时代1946–1950年代后期,以电子管为基础器件,ENIAC使用18000个电子管、占地170平方米代表机型IBM650,运算速度达每秒数千次,主要应用于科学计算与军事领域18,000电子管CDC6600·1964第二代:晶体管时代1950年代中期至1960年代后期,晶体管取代电子管,体积和功耗大幅降低代表机型CDC6600,运算速度达每秒数百万次,可靠性与性价比显著提升数百万次/秒IBM360·1964第三代:集成电路时代1960年代中期至1970年代前期,采用集成电路作为基本器件,实现小型化与系列化IBM360系列成为里程碑产品,首次实现同一系列不同机型间的软件兼容软件兼容ARCHITECTURE冯·诺依曼架构核心思想冯·诺依曼在1945年提出的"存储程序"概念是现代计算机的理论基石。其核心在于将程序指令与数据统一以二进制形式存储于同一存储器中,由运算器按序取指执行,这一思想虽历经70余年技术变迁,至今仍是计算机体系结构的基本原则。01五大组成:计算机由运算器、控制器、存储器、输入设备和输出设备五部分构成,至今仍是硬件教学的标准框架02存储程序:程序与数据统一存放于同一存储器中,指令可像数据一样被读取和修改,实现计算过程自动化控制03二进制编码:所有数据和指令均以二进制代码表示,简化了硬件电路设计,逻辑判断与算术运算统一在同一体系中04指令结构:每条指令由操作码和地址码两部分组成,形成规范化的指令格式05顺序执行:指令按地址顺序存放并由指令计数器追踪,可根据运算结果改变执行顺序,支持条件分支06运算器中心:原始设计以运算器为数据交换枢纽,现代已演变为以存储器为中心的结构以提升吞吐效率Pioneer约翰·冯·诺依曼JohnvonNeumann生卒:1903年12月28日–1957年2月8日国籍:美籍匈牙利裔贡献:1945年提出"存储程序"概念,奠定现代计算机体系结构的理论基础,被誉为"现代计算机之父"存储程序概念提出者·普林斯顿高等研究院SystemArchitecture硬件与软件:计算机系统的双重视角计算机系统可从物理组成与逻辑层次两个维度理解。物理视角关注CPU、内存、外设等实体部件及其互联关系,逻辑视角则将系统划分为从微程序到高级语言的多个抽象层级。硬件提供执行基础,软件赋予功能灵活性,两者的协同定义了计算机的完整能力边界。物理组成视角01核心硬件组件硬件系统包括微处理器(CPU)、内存储器、输入/输出接口、系统总线和外部设备五大实体部件,共同构成计算机的物理基础架构。02部件协同机制各部件通过系统总线互联,CPU负责运算与控制,内存提供临时数据存储,外设实现人机交互,形成完整的数据处理流水线。03性能决定因素物理组成决定性能上限,如CPU主频决定运算速度,内存容量决定并发处理能力,存储带宽影响数据吞吐效率。逻辑层次视角01五层抽象结构逻辑层次从底向上依次为:微程序级→机器语言级→操作系统级→汇编语言级→高级语言级,每层屏蔽下层复杂性。02层间服务机制每一层通过下层提供的服务实现自身功能,上层开发者无需关心底层硬件实现细节,大幅提升软件开发效率与可移植性。03问题定位价值理解层次化结构有助于在系统分析、程序优化和故障排查时快速定位问题所在的抽象层级,是系统工程师的核心思维工具。PerformanceMetrics计算机系统主要性能指标计算机性能由多个相互关联的指标共同决定,而非单一参数。主频、字长、运算速度反映CPU的计算能力,内存容量与带宽决定数据供给效率。主频CPU时钟频率,决定每秒可执行的时钟周期数,当前主流处理器主频在3.0–5.5GHz之间3.0–5.5GHz字长CPU一次处理的二进制位数,64位处理器可处理更大范围数值与更宽的内存地址空间64bit运算速度以MIPS或GFLOPS衡量实际计算吞吐量,反映CPU每秒可完成的指令或浮点运算规模MIPS·GFLOPS内存容量决定系统可同时驻留的程序和数据规模,当前主流配置为16–64GB16–64GB存取周期存储器完成一次完整读/写操作所需时间,周期越短CPU等待越少、效率越高ns级总线宽度系统总线一次可并行传输的数据位数,直接决定各部件间的数据传输带宽上限BANDWIDTHCHAPTER02运算器:数据计算的核心引擎从二进制表示到算术逻辑运算,解析计算能力的底层实现DATAREPRESENTATION计算机中的数据表示方法计算机内部所有信息均以二进制形式存储和处理。数值数据通过原码、反码、补码表示整数,通过IEEE754标准表示浮点数;文字信息通过ASCII、Unicode等编码方案映射为二进制序列。01

整数表示原码直观但加减法不统一,反码为过渡方案,补码将减法转化为加法运算,是现代CPU普遍采用的整数编码方式02

浮点数标准IEEE754定义单精度(32位)和双精度(64位)格式,由符号位、指数偏移值和规格化尾数组成,类似二进制科学计数法03

溢出与精度定点数表示范围有限会发生溢出,浮点数存在精度损失问题,编程时需根据应用场景选择合适的数据类型04

字符编码ASCII用7位编码128个基本字符,Unicode扩展到全球所有文字系统,UTF-8是其最广泛使用的可变长度实现方案集成电路芯片微观结构·数据处理的物理基础ARITHMETICOPERATIONS算术运算:从加法器到统一运算算术运算是运算器的核心功能,所有复杂的数学计算最终都可归结为加法与移位操作的组合。基本运算电路01半加器实现两个一位二进制数相加,输出和与进位;全加器增加低位进位输入,是构建多位加法器的基本模块02行波进位加法器将多个全加器串联,实现n位二进制数加法,但高位需等待低位进位传播,存在延迟累积问题03超前进位加法器通过并行计算各级进位,消除进位传播延迟,显著提升多位加法运算速度运算的统一化实现01利用补码特性,A−B转化为A+(−B)的补码,使ALU只需一套加法电路即可完成加减运算02乘法通过部分积的逐位生成与累加完成,硬件乘法器采用Booth算法或Wallace树优化并行度03除法采用恢复余数法或不恢复余数法,通过迭代减法与移位逐步求得商和余数04算术逻辑单元将加减乘除与逻辑运算电路集成,由操作码控制选择具体运算类型OPERATIONS逻辑运算与移位操作逻辑运算与移位操作是运算器除算术运算外的另一核心功能,在系统控制、数据加密和底层编程中不可或缺。数字电路实验板上的逻辑门电路实物CoreFunctions逻辑运算支持位掩码、状态判断和数据校验;移位运算通过位移实现高效乘除和数据重组,广泛应用于底层系统编程。与运算AND:对应位同时为1结果才为1,常用于位掩码操作以提取或屏蔽特定位段,如从寄存器中读取状态标志位或运算OR:对应位有一个为1结果即为1,常用于将特定位设置为1而不影响其他位,如配置设备控制寄存器非运算NOT与异或XOR:非运算实现按位取反,异或运算在两输入不同时输出1,广泛用于简单加密和数据校验移位运算:逻辑左移一位等价于乘以2,右移等价于除以2;算术右移保留符号位,实现有符号数除法循环移位:将移出的位重新填入另一端,常用于数据编码和哈希算法中的位操作,是密码学基础运算之一CHAPTER03控制器:指令调度与执行中枢解析CPU内部结构,理解指令取指、译码与执行的完整流程HardwareArchitectureCPU内部功能结构解析CPU内部由执行单元(EU)和总线接口单元(BIU)两大核心模块构成。EU负责指令的实际运算执行,BIU负责指令预取与数据传输,两者并行工作实现了取指与执行的流水线化。理解CPU内部结构是掌握指令执行机制和程序性能优化的关键基础。执行单元(EU)01ALU(算术逻辑单元)是运算核心,执行加减乘除算术运算与逻辑运算,运算结果写入目标寄存器并更新标志位ALU02通用寄存器组提供高速暂存空间,如8086的AX/BX/CX/DX等16位寄存器,访问速度远快于内存AX/BX/CX/DX03标志寄存器记录运算状态,如进位标志CF、零标志ZF、溢出标志OF,供条件跳转指令判断程序走向CF/ZF/OF总线接口单元(BIU)01指令队列预取后续指令暂存,8086采用6字节队列实现取指与执行并行化,是流水线技术的早期实践6字节队列02段寄存器(CS/DS/SS/ES)配合偏移地址实现内存分段寻址,支持1MB地址空间的管理与访问1MB地址空间03指令指针IP指向下一条待取指令的偏移地址,每次取指后自动递增,遇到跳转指令时被修改为新地址IP指针InstructionCycle指令执行全流程:取指-译码-执行指令周期由取指、译码、执行三阶段循环构成,BIU按IP地址取指入队,EU译码后协调各部件完成运算,每秒可重复数十亿次。01取指阶段:BIU根据CS:IP段地址和偏移地址从内存读取指令字节,送入指令队列暂存,IP自动递增指向下一条指令地址02译码阶段:EU从指令队列中取出操作码,由指令译码器识别指令类型、寻址方式和目标寄存器,生成微操作控制信号03执行阶段:控制器向ALU、寄存器、内存等部件发出精确控制信号序列,完成数据读取、运算处理和结果回写04时序控制:时钟发生器产生统一时钟信号,确保各阶段在确定的时钟周期边界上同步切换,避免信号竞争与数据错误05流水线优化:现代CPU将指令周期细分为更多级流水段(取指→译码→执行→访存→写回),多指令并行处理提升吞吐率CPU处理器·指令执行的物理载体InstructionSetArchitecture指令系统:CISC与RISC两大流派指令系统是硬件与软件的交界面。CISC以x86为代表,指令丰富但解码复杂;RISC以ARM为代表,精简高效。现代处理器趋向融合。CISC复杂指令集01以Intelx86为代表,指令多达数百条,单条指令可直接完成字符串操作、浮点运算等复杂功能02指令长度可变(1–15字节),寻址方式多样,硬件解码复杂但编程时代码紧凑03现代x86将CISC指令翻译为RISC风格微操作(μops),兼顾软件兼容与执行效率x86·Intel·AMDRISC精简指令集01以ARM、MIPS、RISC-V为代表,指令少且格式固定(通常32位),流水线效率高02强调Load/Store架构,运算仅操作寄存器,访存单独处理,通用寄存器多达32个03广泛用于移动与嵌入式系统,ARM已占全球智能手机处理器99%以上份额ARM·99%+手机市场ASSEMBLYPROGRAMMING汇编语言基本程序设计汇编语言程序设计建立在顺序、分支、循环三种基本控制结构之上。顺序结构适合线性运算,分支结构通过条件跳转实现决策逻辑,循环结构通过跳转回退实现重复操作。三种结构可自由嵌套组合,构成从简单计算到复杂控制的完整程序逻辑体系。I.顺序与分支结构II.循环与中断机制顺序结构指令按地址递增依次执行,适合数据传输和简单算术运算序列,执行效率最高且无跳转开销。LINEAR循环结构LOOP指令或条件跳转实现计数器控制的重复操作,适合数组遍历、数据批量处理等场景。LOOP分支结构CMP比较指令配合条件跳转(JZ/JNZ/JG/JL等)实现if-else逻辑,根据标志位状态选择不同执行路径。JZ/JNZ中断与系统调用硬件或软件中断打破正常执行流程,CPU转入中断服务例程;DOS通过INT21H实现屏幕输出、键盘输入等系统交互。INT21HChapter04存储器:数据的多级存储体系从寄存器到外存,理解速度、容量与成本的层次化平衡策略StorageHierarchy存储器分级管理体系计算机采用多级存储体系来平衡速度、容量和成本的矛盾。从CPU寄存器到高速缓存、主存再到外存,速度逐级递减而容量逐级递增,利用局部性原理以较低成本获得接近最快存储器的整体性能。01寄存器层:位于CPU内部,访问速度最快(约0.3ns),容量仅数十个字节,暂存当前指令的操作数和中间运算结果≈0.3ns02高速缓存层:L1/L2/L3三级Cache使用SRAM技术,速度1-10ns级别,容量KB到MB级,存放CPU近期频繁访问的指令与数据副本1–10ns03主存层:DRAM内存条,速度约50-100ns,容量GB级别,存放正在运行的程序和数据,断电后内容丢失属于易失性存储50–100ns04外存层:HDD和SSD,速度μs到ms级别,容量TB级,断电不丢失属于非易失性存储,是数据的永久仓库μs–ms05局部性原理:时间局部性——被访问数据短期内会再次被访问;空间局部性——相邻地址数据倾向被连续访问,是分级存储的理论基础LocalityPrincipleDDR5内存条·主存层物理实体·DRAM技术MEMORY内存储器:编址、管理与性能指标内存储器通过地址编址实现数据的精确定位,分段管理机制将内存划分为逻辑区域以提高利用效率和安全性。存储器的性能由容量、存取时间、存储周期和带宽四个维度综合衡量,DDR5等新一代内存技术通过提升频率和预取位数持续突破带宽瓶颈。编址与分段管理01线性编址:CPU通过地址总线输出地址信号选中存储单元,32位地址可寻址4GB空间,64位理论可达16EB02分段管理:将内存划分为代码段CS、数据段DS、堆栈段SS等逻辑区域,每段由段基址+段内偏移量定位03段保护机制:各段设置访问权限(读/写/执行),防止程序越界访问其他段的数据,保障系统稳定性和安全性性能指标与技术进展01存取时间与周期:存取时间指从发出请求到数据可用的延迟,存储周期是连续操作的最小间隔,后者通常大于前者02带宽计算:存储器带宽=数据总线宽度÷存储周期,DDR5-6400的理论带宽可达51.2GB/s,较DDR4提升约80%03技术前沿:DDR5引入双子通道架构和片上ECC纠错,LPDDR5X针对移动端优化功耗,HBM高带宽内存满足AI训练需求Hardware·Storage外存储器:HDD与SSD技术对比外存是计算机数据的永久仓库,HDD与SSD代表了两代存储技术路线。HDD凭借大容量低成本优势退守冷数据存储,SSD则以闪存芯片实现数量级的速度跃升成为系统盘主流。HDD与SSD关键技术参数对比技术参数机械硬盘HDD固态硬盘SSD存储介质磁性盘片+机械磁头NAND闪存芯片顺序读写速度100–200MB/s3,500–14,000MB/s随机读写IOPS约100–200约500K–1,000K访问延迟约5–10ms约10–100μs抗震性差(机械部件易损)优(无机械运动部件)单位容量价格约0.02–0.03元/GB约0.3–0.5元/GB主流接口SATAIII(6Gbps)NVMe/PCIe5.0(64Gbps)SSD在速度、延迟、抗震性上全面领先HDD,HDD凭借单位容量价格优势在大容量冷存储场景仍有不可替代性Chapter05输入与输出设备人机交互通道从键盘鼠标到显示器打印机,理解I/O设备的工作原理与数据传送方式INPUTDEVICES常见输入设备:类型与工作原理输入设备将人类操作和外部信息转化为计算机可处理的数字信号。键盘通过矩阵扫描编码按键,鼠标通过光学传感器检测位移,触摸屏通过电容变化定位触点。专业输入设备如扫描仪、传感器和A/D转换器则将图像、声音和物理量数字化,拓展了计算机的感知边界。键盘按键矩阵通过行列扫描检测通断,生成扫描码经USB/蓝牙送入主机,机械键盘以独立轴体提供更精确的手感反馈扫描仪与数码相机通过CCD/CMOS感光元件将光学图像转化为像素矩阵,分辨率和色彩深度决定数字化质量鼠标光学/激光传感器以每秒数千帧拍摄表面纹理变化,通过图像对比计算位移方向和距离,DPI决定定位精度麦克风与音频采集声波振动驱动振膜产生模拟电信号,经A/D转换器以44.1kHz/48kHz采样率转化为数字音频流触摸屏电容式屏幕利用人体导电性改变局部电场来检测触点,支持多点触控,已成为智能手机和平板的标准输入方式工业传感器温度、压力、光照等物理量通过传感器转化为模拟电压/电流信号,由A/D转换器量化为数字值供系统处理基础人机输入设备专业信号采集设备OUTPUTDEVICES输出设备:显示技术与打印技术演进输出设备将计算机处理结果以可视、可触或可听的形式呈现给用户。显示技术从CRT演进到LCD再到OLED,实现了从bulky到轻薄、从低对比到无限对比的质变。打印技术从针式到激光到喷墨再到3D打印,输出维度从平面文字扩展到立体实体,持续拓宽计算机的信息输出边界。OLED显示:每个像素自发光无需背光,实现纯黑和无限对比度,响应时间<0.1ms,已广泛用于高端手机和电视Mini-LED背光:LCD面板搭配数千个独立控光分区,兼顾高亮度>1000nit和局部调光,是当前高端显示器的主流方案激光打印:通过激光束在感光鼓上形成静电潜像,吸附碳粉后转印到纸张并加热定影,适合高速大批量文档输出喷墨打印:压电或热泡驱动微小墨滴精确喷射到纸张表面,高分辨率型号可实现照片级色彩还原3D打印:FDM、SLA、SLS等技术将数字3D模型逐层堆积为物理实体,拓展输出维度至立体OLED显示器·自发光像素·无限对比度DATATRANSFERMETHODSI/O数据传送方式对比I/O数据传送方式按CPU参与度从高到低分为四种:无条件传送、查询传送、中断传送和DMA传送。随着传送方式的升级,CPU从直接参与每次数据传输逐步解放出来,系统整体效率显著提升。基础传送方式UNCONDITIONAL无条件传送CPU直接执行IN/OUT指令读写端口,不检查外设状态,仅适用于LED、拨码开关等始终就绪的简单设备IN/OUTPOLLING查询传送CPU先读取外设状态端口,检测"就绪"标志后才进行数据传送,可靠性高但CPU大量时间浪费在循环等待上状态轮询高效传送方式INTERRUPT中断传送外设准备好后向CPU发送中断请求,CPU暂停当前程序转入中断服务例程处理I/O,完毕后恢复原程序,CPU利用率大幅提升IRQDMADMA传送DMA控制器接管系统总线,数据在内存和外设之间直接传输不经过CPU,传送速率仅受总线和存储器速度限制,适合磁盘读写等大数据量场景总线直传CHANNEL通道控制通道是专用的I/O处理器,可执行通道程序独立完成复杂的I/O操作序列,进一步解放CPU,支持多设备并行管理,实现最高效的I/O处理I/O处理器CHAPTER06总线与接口:系统互联架构解析系统总线的分类与协议,理解I/O接口标准的技术演进SystemBusArchitecture系统总线:分类、功能与仲裁机制系统总线是计算机各部件间信息传输的公共通道,按功能分为数据总线、地址总线和控制总线三类。数据总线宽度决定并行传输能力,地址总线宽度决定最大寻址空间,控制总线协调各部件同步工作。总线仲裁机制解决多设备竞争问题,确保系统有序高效运行。三大功能总线数据总线(DB)16/32/64bit双向传输实际数据信息,宽度通常为16/32/64位,直接决定CPU与内存间单次数据传输量地址总线(AB)2n寻址单向由CPU输出地址信号,宽度n位可寻址2n个存储单元,32位总线最大寻址4GB控制总线(CB)指挥链路传输读写控制、中断请求、DMA请求、时钟同步等信号,是各部件协调工作的指挥链路总线仲裁与扩展总线总线仲裁竞争调度多设备同时请求总线时,通过菊花链优先级、计数器定时查询或独立请求等方式决定使用权归属PCIe总线64GB/s高速串行点对点连接,PCIe5.0单通道4GB/s,x16插槽可达64GB/s双向带宽,是显卡和NVMeSSD的标准接口USB总线40Gbps通用串行总线支持热插拔和即插即用,USB4最高40Gbps,兼容Thunderbolt协议,统一外设连接标准I/OINTERFACESTANDARDSI/O接口标准:从传统到现代的技术演进I/O接口是外设与系统总线间的桥梁,承担信号转换、速度匹配和数据缓冲功能。接口技术从并行IDE/SCSI演进到串行SATA/USB/PCIe,传输速率提升了数百倍。USB和Thunderbolt的融合标志着外设接口正走向统一标准,简化了设备连接并提升了用户体验。接口名称最高传输速率主要特点与应用IDE(PATA)133MB/s并行传输,已淘汰,曾广泛用于硬盘和光驱连接SATAIII600MB/s串行传输,支持热插拔,当前机械硬盘和入门SSD的标准接口USB3.2Gen210Gbps通用接口,支持热插拔和供电,广泛用于键鼠、U盘、移动硬盘USB440Gbps兼容Thunderbolt3协议,统一Type-C接口,支持外接显卡和显示器PCIe5.0x464Gbps高速串行总线,NVMeSSD和显卡的直连通道,绕过SATA带宽瓶颈Thunderbolt440Gbps支持菊花链连接最多6台设备,可同时传输数据、视频和100W供电I/O接口从并行走向串行、从专用走向通用,USB4和Thunderbolt4的融合标志着外设接口标准的统一化趋势PROGRAMMABLETIMER/COUNTER可编程定时器/计数器82538253是可编程定时器/计数器芯片,内含三个独立16位计数器,支持六种工作方式,在交通灯控制、电机调速等场景中提供硬件级别的精确时序保障。Intel8253可编程定时器/计数器芯片实物内部结构:三个独立16位减法计数器(Counter0/1/2),共享控制寄存器,通过地址线选择操作对象

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论