1、JVM前言
作为Java工程师的你曾被伤害过吗?你是否也遇到过这些问题?
- 运行着的线上系统突然卡死,系统无法访问,甚至直接OOM!
- 想解决线上JVM GC问题,但却无从下手。
- 新项目上线,对各种JVM参数设置一脸茫然,直接默认吧然后就GG了
- 每次面试之前都要重新背一遍JVM的一些原理概念性的东西,然而面试官却经常问你在实际项目中如何调优VM参数,如何解决GC、OOM等问题,一脸懵逼。
计算机系统体系对我们来说越来越远,在不了解底层实现方式的前提下,通过高级语言很容易编写程序代码。但事实上计算机并不认识高级语言,高级语言也是被编译成机器指令传入cpu进行操作的
2、JAVA VS C++
- 垃圾收集机制为我们打理了很多繁琐的工作,大大提高了开发的效率,但是,垃圾收集也不是万能的,懂得JVM内部的内存结构、工作机制,是设计高扩展性应用和诊断运行时问题的基础,也是Java工程师进阶的必备能力。
-
C语言需要自己来分配内存(malloc)和回收内存(free),Java全部交给JVM进行分配和回收。
3、JAVA的跨平台性
- 每个语言都需要转换成字节码文件,最后转换的字节码文件都能通过Java虚拟机进行运行和处理
- 随着Java7的正式发布,Java虚拟机的设计者们通过
JSR-292规范
基本实现在Java虚拟机平台上运行非Java语言编写的程序。 -
Java虚拟机根本不关心运行在其内部的程序到底是使用何种编程语言编写的,它只关心“字节码”文件。也就是说Java虚拟机拥有语言无关性,并不会单纯地与Java语言“终身绑定”,只要其他编程语言的编译结果满足并包含Java虚拟机的内部指令集、符号表以及其他的辅助信息,它就是一个有效的字节码文件,就能够被虚拟机所识别并装载运行。
4、字节码
- 我们平时说的java字节码,指的是用java语言编译成的字节码。准确的说任何能在jvm平台上执行的字节码格式都是一样的。所以应该统称为:
jvm字节码
。 - 不同的编译器,可以编译出相同的字节码文件,字节码文件也可以在不同的JVM上运行。
-
Java虚拟机与Java语言并没有必然的联系,它只与特定的二进制文件格式——Class文件格式所关联,Class文件中包含了Java虚拟机指令集(或者称为字节码、Bytecodes)和符号表,还有一些其他辅助信息。
5、多语言混合编程
-
Java平台上的多语言混合编程正成为主流,通过特定领域的语言去解决特定领域的问题是当前软件开发应对日趋复杂的项目需求的一个方向
。 - 试想一下,在一个项目之中,并行处理用Clojure语言编写,展示层使用JRuby/Rails,中间层则是Java,每个应用层都将使用不同的编程语言来完成,而且,接口对每一层的开发者都是透明的,各种语言之间的交互不存在任何困难,就像使用自己语言的原生API一样方便,因为它们最终都运行在一个虚拟机之上。
- 对这些运行于Java虚拟机之上、Java之外的语言,来自系统级的、底层的支持正在迅速增强,以JSR-292为核心的一系列项目和功能改进(如DaVinci Machine项目、Nashorn引擎、InvokeDynamic指令、java.lang.invoke包等),
推动Java虚拟机从"Java语言的虚拟机"向"多语言虚拟机"的方向发展
。
6、JVM(虚拟机)的介绍
6.1 虚拟机的介绍
- 所谓虚拟机(Virtual Machine),就是一台
虚拟的计算机
。它是一款软件
,用来执行一系列虚拟计算机指令。大体上,虚拟机可以分为系统虚拟机
和程序虚拟机
。
1、大名鼎鼎的Virtual Box,VMware就属于系统虚拟机,它们完全是对物理计算机的仿真,提供了一个可运行完整操作系统的软件平台。
2、 程序虚拟机的典型代表就是Java虚拟机,它专门为执行单个计算机程序而设计,在Java虚拟机中执行的指令我们称为Java字节码指令。 - 无论是系统虚拟机还是程序虚拟机,在上面运行的软件都被限制于虚拟机提供的资源中。
6.2 java虚拟机
- Java虚拟机是一台执行Java字节码的虚拟计算机,它拥有独立的运行机制,其运行的Java字节码也未必由Java语言编译而成。
- JVM平台的各种语言可以共享Java虚拟机带来的跨平台性、优秀的垃圾回器,以及可靠的即时编译器。
- Java技术的核心就是Java虚拟机(JVM,Java Virtual Machine),因为所有的Java程序都运行在Java虚拟机内部。
- Java虚拟机就是二进制字节码的运行环境,负责装载字节码到其内部,解释/编译为对应平台上的机器指令执行。每一条Java指令,Java虚拟机规范中都有详细定义,如怎么取操作数,怎么处理操作数,处理结果放在哪里。
特点
一次编译,到处运行
自动内存管理
自动垃圾回收功能
7 JVM的位置
JVM是运行在系统之上的,它与硬件没有直接的交互
java的体系结构
JDK = JRE + JVM
java文件通过前端编译器javac编译成字节码(.class)文件,再通过java HotSpot解释运行
8 JVM的整体结构
-
HotSpot VM
是目前市面上高性能虚拟机的代表作之一。 - 它采用解释器与即时编译器并存的架构。
- 在今天,Java程序的运行性能早已脱胎换骨,已经达到了可以和C/C++程序一较高下的地步。
- 执行引擎包含三部分:
解释器
,即时编译器
,垃圾回收器
作用
- 类装载器子系统: 将class files文件转换成类,包含三个主要步骤 Loading ,Linking,Initializing
- 运行时数据区:存放Class相关变量并执行
- 执行引擎:将字节码指令转换成机器指令
9 JAVA代码执行流程
10 JVM的架构模型
Java编译器输入的指令流基本上是一种基于栈的指令集架构
,另外一种指令集架构则是基于寄存器的指令集架构
。具体来说:这两种架构之间的区别:
- 基于栈式架构的特点
1、设计和实现更简单,适用于资源受限的系统
2、避开了寄存器的分配难题:使用零地址指令方式分配
3、指令流中的指令大部分是零地址指令,其执行过程依赖于操作栈。指令集更小,编译器容易实现
4、不需要硬件支持,可移植性更好,更好实现跨平台 - 基于寄存器架构的特点
1、典型的应用是x86的二进制指令集:比如传统的PC以及Android的Davlik虚拟机。
2、指令集架构则完全依赖硬件,与硬件的耦合度高,可移植性差
3、性能优秀和执行更高效
4、花费更少的指令去完成一项操作
5、在大部分情况下,基于寄存器架构的指令集往往都以一地址指令、二地址指令和三地址指令为主,而基于栈式架构的指令集却是以零地址指令为主
10.1两种架构的举例
public class Test {
public static void main(String[] args) {
int a = 2;
int b = 3;
int c = a+b;
}
}
执行2+3这种逻辑操作,其指令分别如下:
-
基于栈的计算流程(以Java虚拟机为例)
0:常量2压入操作数栈
1:弹出操作数栈栈顶元素,保存到局部变量表第1个位置
2:常量3压入操作数栈
3:弹出操作数栈栈顶元素,保存到局部变量表第2个位置
4:第1个变量压入操作数栈
5:第2个变量压入操作数栈
6:操作数栈中的前两个int相加,并将结果压入操作数栈顶
7:弹出操作数栈栈顶元素,保存到局部变量表第3个位置
8:返回 - 基于寄存器的计算流程
mov eax,2;
add eax,3;
总结:
由于跨平台性的设计,Java的指令都是根据栈来设计的
。不同平台CPU架构不同,所以不能设计为基于寄存器的。优点是跨平台,指令集小,编译器容易实现,缺点是性能下降,实现同样的功能需要更多的指令
时至今日,尽管嵌入式平台已经不是Java程序的主流运行平台了(准确来说应该是HotSpot VM的宿主环境已经不局限于嵌入式平台了),那么为什么不将架构更换为基于寄存器的架构呢?
因为基于栈的架构跨平台性好、指令集小,虽然相对于基于寄存器的架构来说,基于栈的架构编译得到的指令更多,执行性能也不如基于寄存器的架构好,但考虑到其跨平台性与移植性,我们还是选用栈的架构
11 JVM生命周期
- 虚拟机的启动
Java虚拟机的启动是通过引导类加载器
(bootstrap class loader)创建一个初始类(initial class)来完成的,这个类是由虚拟机的具体实现指定的。 - 虚拟机的执行
1、一个运行中的Java虚拟机有着一个清晰的任务:执行Java程序
2、程序开始执行时他才运行,程序结束时他就停止
3、执行一个所谓的Java程序的时候,真真正正在执行的是一个叫做Java虚拟机的进程
- 虚拟机的退出
1、程序正常执行结束
2、程序在执行过程中遇到了异常或错误而异常终止
3、由于操作系统出现错误而导致Java虚拟机进程终止
4、某线程调用Runtime类或System类的exit( )方法,或Runtime类的halt( )方法,并且Java安全管理器也允许这次exit( )或halt( )操作。
5、除此之外,JNI(Java Native Interface)规范描述了用JNI Invocation API来加载或卸载 Java虚拟机时,Java虚拟机的退出情况。