JVM(一) JVM&Java体系架构

221 阅读10分钟

持续创作,加速成长!这是我参与「掘金日新计划 · 10 月更文挑战」的第1天,点击查看活动详情

一、JVM前言

作为Java工程师是否也遇到过这些问题?

  • 运行着的线上系统突然卡死,系统无法访问,甚至直接OOM。
  • 想解决线上JVM GC问题,但却无从下手。
  • 新项目上线,对各种JVM参数设置一脸茫然,直接默认吧然后就GG了。
  • 每次面试之前都要重新背一遍JVM的一些原理概念性的东西,然而面试官却经常问你在实际项目中如何调优VM参数,如何解决GC、OOM等问题,一脸懵逼。

1.png

二、开发人员的"病态"

  • 大部分Java开发人员,除了会在项目中使用到与Java平台相关的各种技术,对于Java技术的核心Java虚拟机了解甚少。
  • 一些有一定工作经验的开发人员,觉得SSM、微服务等上层技术才是重点,基础技术并不重要,这其实是一种本末倒置的“病态”。如果我们把核心类库的API比做数学公式的话,那么Java虚拟机的知识就好比公式的推导过程。
  • 计算机系统体系对我们来说越来越远,在不了解底层实现方式的前提下,通过高级语言很容易编写程序代码,但事实上计算机并不认识高级语言。

2.png

三、架构师要做什么

  • 让系统更快,且避免系统出现瓶颈。
  • 参与现有系统的性能优化、重构,保证平台性能和稳定性。
  • 根据业务场景和需求,决定技术方向,做技术选型。
  • 能够独立架构和设计海量数据下高并发分布式解决方案,满足功能和非功能需求。
  • 解决各类潜在系统风险,核心功能的架构与代码编写。
  • 分析系统瓶颈,解决各种疑难杂症,性能调优等。

四、为什么学习JVM

  • 垃圾收集机制为我们打理了很多繁琐的工作,大大提高了开发的效率,但垃圾收集也不是万能的,懂得JVM内部的内存结构、工作机制,是设计高扩展性应用和诊断运行时问题的基础。
  • C语言需要自己来分配内存和回收内存,Java全部交给JVM进行分配和回收。

五、TIOBE 排行榜

TIOBE 排行榜:www.tiobe.com/tiobe-index…

image.png

六、Java的跨平台性

  • 每个语言都需要转换成字节码文件,最后转换的字节码文件都能通过Java虚拟机进行运行和处理
  • 随着Java7的正式发布,Java虚拟机的设计者们通过JSR-292规范基本实现在Java虚拟机平台上运行非Java语言编写的程序。
  • Java虚拟机根本不关心运行在其内部的程序到底是使用何种编程语言编写的,它只关心“字节码”文件,也就是说Java虚拟机拥有语言无关性。只要其他编程语言的编译结果满足并包含Java虚拟机的内部指令集、符号表以及其他的辅助信息,它就是一个有效的字节码文件,就能够被虚拟机所识别并装载运行。

3.png

七、字节码

  • 我们平时说的Java字节码,指的是用Java语言编译成的字节码。准确的说任何能在Jvm平台上执行的字节码格式都是一样的。所以应该统称为:Jvm字节码
  • 不同的编译器,可以编译出相同的字节码文件,字节码文件也可以在不同的JVM上运行。
  • Java虚拟机与Java语言并没有必然的联系,它只与特定的二进制文件格式——Class文件格式所关联,Class文件中包含了Java虚拟机指令集(或者称为字节码、Bytecodes)和符号表,还有一些其他辅助信息。

4.png

八、虚拟机介绍

1.虚拟机概念

所谓虚拟机(Virtual Machine),就是一台虚拟的计算机。它是一款软件,用来执行一系列虚拟计算机指令。大体上,虚拟机可以分为系统虚拟机程序虚拟机

  • 大名鼎鼎的Virtual Box,VMware就属于系统虚拟机,它们完全是对物理计算机的仿真,提供了一个可运行完整操作系统的软件平台。
  • 程序虚拟机的典型代表就是Java虚拟机,它专门为执行单个计算机程序而设计,在Java虚拟机中执行的指令我们称为Java字节码指令。
  • 无论是系统虚拟机还是程序虚拟机,在上面运行的软件都被限制于虚拟机提供的资源中。

2. Java虚拟机

  • Java虚拟机是一台执行Java字节码的虚拟计算机,它拥有独立的运行机制,其运行的Java字节码也未必由Java语言编译而成。

  • JVM平台的各种语言可以共享Java虚拟机带来的跨平台性、优秀的垃圾回器,以及可靠的即时编译器。

  • Java技术的核心就是Java虚拟机(JVM,Java Virtual Machine),因为所有的Java程序都运行在Java虚拟机内部。

  • Java虚拟机就是二进制字节码的运行环境,负责装载字节码到其内部,解释/编译为对应平台上的机器指令执行。每一条Java指令,Java虚拟机规范中都有详细定义,如怎么取操作数,怎么处理操作数,处理结果放在哪里。

    特点: 1.一次编译,到处运行;2.自动内存管理;3.自动垃圾回收功能。

九、JVM的位置

  • JVM是运行在操作系统之上的,它与硬件没有直接的交互

image.png

  • Java的体系结构

5.png

十、JVM的整体结构

  • HotSpot VM是目前市面上高性能虚拟机的代表作之一。
  • 它采用解释器与即时编译器并存的架构。
  • 在今天,Java程序的运行性能早已脱胎换骨,已经达到了可以和C/C++程序一较高下的地步。
  • 执行引擎包含三部分:解释器即时编译器垃圾回收器

image.png

十一、Java代码执行流程

目前,市面上主流的虚拟机都是采用解释执行和即时编译并存的方式,解释器主要保证响应时间,JIT编译器主要负责程序执行性能。

6.png

十二、JVM架构模型

Java编译器输入的指令流基本上是一种基于栈的指令集架构,另外一种指令集架构则是基于寄存器的指令集架构。具体来说:这两种架构之间的区别:

  • 基于栈式架构的特点
    • 设计和实现更简单,适用于资源受限的系统。
    • 避开了寄存器的分配难题:使用零地址指令方式分配
    • 指令流中的指令大部分是零地址指令,其执行过程依赖于操作栈指令集更小,编译器容易实现
    • 不需要硬件支持,可移植性更好,更好实现跨平台。
  • 基于寄存器架构的特点
    • 典型的应用是x86的二进制指令集:比如传统的PC以及Android的Davlik虚拟机。
    • 指令集架构则完全依赖硬件,与硬件的耦合度高,可移植性差
    • 性能优秀和执行更高效。
    • 花费更少的指令去完成一项操作。
    • 在大部分情况下,基于寄存器架构的指令集往往都以一地址指令、二地址指令和三地址指令为主,而基于栈式架构的指令集却是以零地址指令为主。

1.两种架构的举例

同样执行2+3这种逻辑操作,其指令分别如下:

  • 基于栈的计算流程(以Java虚拟机为例)
iconst_2 //常量2入栈

istore_1

iconst_3 // 常量3入栈

istore_2

iload_1

iload_2

iadd //常量2/3出栈,执行相加

istore_0 // 结果5入栈
  • 基于寄存器的计算流程
mov eax,2 //将eax寄存器的值设为1

add eax,3 //使eax寄存器的值加3

2.反编译字节码文件

/**

* @author juner

* @create 2022-10-01 02:14 上午

*/

public class StackStruTest {

   public static void main(String[] args) {

       int i = 2;

       int j = 3;

       int k = i + j;

   }

}

javap -v StackStruTest.class 反编译得到的指令

public static void main(java.lang.String[]);

   descriptor: ([Ljava/lang/String;)V

   flags: ACC_PUBLIC, ACC_STATIC

   Code:

     stack=2, locals=4, args_size=1

        0: iconst_2  // 将常量 2 压入栈中

        1: istore_1  // 将常量 2 保存至变量 i 中

        2: iconst_3  // 将常量 3 压入栈中

        3: istore_2  // 将常量 3 保存至变量 j 中

        4: iload_1   // 加载变量 i

        5: iload_2   // 加载变量 j

        6: iadd      // 执行累加操作

        7: istore_3  // 加法结果保存在变量 k 中

        8: return

     LineNumberTable:

       line 10: 0

       line 11: 2

       line 12: 4

       line 13: 8

     LocalVariableTable:

       Start  Length  Slot  Name   Signature

           0       9     0  args   [Ljava/lang/String;

           2       7     1     i   I

           4       5     2     j   I

           8       1     3     k   I

}

 3.总结

  • 由于跨平台性的设计,Java的指令都是根据栈来设计的。不同平台CPU架构不同,所以不能设计为基于寄存器的。优点是跨平台,指令集小,编译器容易实现;缺点是性能下降,实现同样的功能需要更多的指令

  • 时至今日,尽管嵌入式平台已经不是Java程序的主流运行平台了(准确来说应该是HotSpot VM的宿主环境已经不局限于嵌入式平台了),那么为什么不将架构更换为基于寄存器的架构呢?

  • 因为基于栈的架构跨平台性好、指令集小,虽然相对于基于寄存器的架构来说,基于栈的架构编译得到的指令更多,执行性能也不如基于寄存器的架构好,但考虑到其跨平台性与移植性,我们还是选用栈的架构。

    栈:跨平台性、指令集小、指令多;执行性能比寄存器差

十三、JVM生命周期

  • 虚拟机的启动
    • Java虚拟机的启动是通过引导类加载器(bootstrap class loader)创建一个初始类(initial class)来完成的,这个类是由虚拟机的具体实现指定的。
  • 虚拟机的执行
    • 一个运行中的Java虚拟机有着一个清晰的任务:执行Java程序
    • 程序开始执行时他才运行,程序结束时他就停止
    • 执行一个所谓的Java程序的时候,真真正正在执行的是一个叫做Java虚拟机的进程
  • 虚拟机的退出
    • 程序正常执行结束
    • 程序在执行过程中遇到了异常或错误而异常终止
    • 由于操作系统用现错误而导致Java虚拟机进程终止
    • 某线程调用Runtime类或System类的exit( )方法,或Runtime类的halt( )方法,并且Java安全管理器也允许这次exit( )或halt( )操作。
    • 除此之外,JNI(Java Native Interface)规范描述了用JNI Invocation API来加载或卸载 Java虚拟机时,Java虚拟机的退出情况。