这篇文章主要介绍如何用joern进行更灵活地分析源码,适用于Joern 1.x版本
Joern提供了一种基于Scala的查询语言。这种方式的好处是自动继承了所有宿主语言的特性。所以我们可以实用scala编程方式去编写joern的脚本。这篇文章将介绍joern查询语言的基础概念,并举例子介绍。
PS:在查询之前,我们需要使用importCpg
或者loadCpg
来导入joern-parse
生成的代码属性图。
importCpg("../output/testcode.bin.zip")
用cpg.all
来查询代码属性图中的所有节点:
cpg.all
$ res2: NodeSteps[StoredNode] = io.shiftleft.semanticcpg.language.NodeSteps@2d2ffced
用cpg.all
输出的结果不是一个列表,而是一个NodeSteps[StoreNode]
的类型,我们可以把这个认为是一个表达式,只在求值的时候生成所有节点。这种方法的好处是我们可以组合表达式,而不需要去计算他。然后我们可以在费力评估之前,进行合法性检查和查询优化,提高效率。
要评估这个表达式,我们可以强行将其转化为列表:
cpg.all.toList.size
这个查询会返回图中所有节点的数目,由于toList
是一个常用操作,作者用.l
来替代toList
,就比如下面这样
cpg.all.l.size
然后每个节点都有一个标签,标签指的是由节点表示的程序构造的类型。要想大致浏览一下图里的label,可以使用下面的查询:
cpg.all.label.toSet.toList.sorted
在这个查询中,表达式cpg.all.label
调用了toSet
的方法。然后这个scala集合再被转换成列表并排序。PS:toList
和sorted
都是scala自带的api接口。
术语Step
是继承了图遍历语言Gremlin,Step
表示在图中走了一步,经常结合函数来组成一个遍历。我们可以认为遍历是表达节点结合的表达式。
对于每个节点标签,相应的类型由查询语言定义,比如节点的方法对应的标签是METHOD
。对于每个节点,都定义了一个starter
来代表所有带这个标签的节点。比如:
cpg.method
另外,可以通过输入cpg.
然后按TAB键来获得一个完整的starter列表。
建议最好采用特定类型的starter来查询,如果用通用的cpg.all
不能确定哪种类型的节点被处理了。使用特定的starter比如.method
可以使用scala的类型系统来在查询之前进行自动补全并检测非法的查询。
对于每个节点,都存储了一个ID。这个ID是一个很长的整数来唯一地表示节点。我们不必用Joern的脚本去提取节点的ID,但是当节点传递给外部工具的时候,尤其是这些外部工具要进行后续的查询时,这个ID可能会派上用场。下面这个查询返回所有文件节点的ID:
cpg.file.id.l
在接收到这个结果之前,外部工具可能会调用第一个文件节点进行后续的查询。如果这样的话,我们可以使用下面的查询:
cpg.id(16).l
需要注意的是,由cpg.id(16)
返回的节点类型在编译时是未知的,因此,cpg.id(16)
的类型是List[Nothing]
。实际上,外部工具通常是知道节点的类型(通过之前的查询得知),比如我们这个例子,ID16
是一个文件类型的节点。所以,一个显式的转换可以把我们带回到类型化的世界:
cpg.id(16).asInstanceOf[NodeSteps[nodes.File]].name.l
最后,cpg.id
同样接收一个节点序列,比如:
cpg.id(Seq(16,14)).l
查询可以分为以下三个步骤:
.l
或者.toSet
下面举一个例子来简单说明。首先看看下面这个查询:
cpg.parameter.evalType(".*char.*")
.method.name(".*parse.*")
.map(x => (x.name, x.start.caller.id.l))
cpg.parameter.evalType(".*char.*")
:表示如何选择初始节点。这里选择参数为*char
类型的节点作为初始节点.method.name(".*parse.*")
:表示怎么遍历图。这里查看是否有可能遍历相关的方法并找到它的名称匹配parse..map(x => (x.name, x.start.caller.id.l))
:表示用map提取你想要的信息。这里返回(name,caller)这两个信息,并使用辅助查询x.start.caller.id.l
来获取caller。运行结果如下:
这里可以在最后加上.l
,就会显示列表,或者加上.toJson |> $outFile
就会变成转换成json文件输出到outFile
文件中去。
文章浏览阅读122次。还是A+BTime Limit: 2000/1000 MS (Java/Others)Memory Limit: 65536/32768 K (Java/Others)Total Submission(s): 24568Accepted Submission(s): 11729Problem Description读入两个小于10000的正整数A和B,计算A+B。...
文章浏览阅读419次。HEADERS:在BASIC的基础上,额外记录了请求和响应的头信息。FULL:记录所有请求和响应的明细,包括头信息、请求体、元数据。BASIC:仅记录请求的方法,URL以及响应状态码和执行时间。NONE:不记录任何日志信息,这是默认值。配置Feign日志有两种方式;方式二:java代码实现。注解中声明则代表某服务。方式一:配置文件方式。_feign 日志设置
文章浏览阅读155次。将容器管理的持久性 Bean 用于面向服务的体系结构本文将介绍如何使用 IBM WebSphere Process Server 对容器管理的持久性 (CMP) Bean的连接和持久性逻辑加以控制,使其可以存储在非关系数据库..._javax.ejb.objectnotfoundexception: no such entity!
文章浏览阅读1.5k次。基础java练习题一、递归实现跳台阶从第一级跳到第n级,有多少种跳法一次可跳一级,也可跳两级。还能跳三级import java.math.BigDecimal;import java.util.Scanner;public class Main{ public static void main(String[]args){ Scanner reader=new Scanner(System.in); while(reader.hasNext()){ _java 递归例题
文章浏览阅读1.5k次,点赞6次,收藏6次。目录1.串应用- 计算一个串的最长的真前后缀题目描述输入输出样例输入样例输出题解2.字符串替换(string)题目描述输入输出样例输入样例输出题解3.可重叠子串 (Ver. I)题目描述输入输出样例输入样例输出题解4.字符串操作(string)题目描述输入输出样例输入样例输出题解1.串应用- 计算一个串的最长的真前后缀题目描述给定一个串,如ABCDAB,则ABCDAB的真前缀有:{ A, AB,ABC, ABCD, ABCDA }ABCDAB的真后缀有:{ B, AB,DAB, CDAB, BCDAB_对存储在string数组内的所有以字符‘a’开始并以字符‘e’结尾的单词做加密处理。
文章浏览阅读68次。西安交通大学/算法设计与问题求解/树与二叉树/MOOC_算法设计与问题求解西安交通大学
文章浏览阅读1.6k次。问题:在Vue项目中出现如下错误提示:[Vue warn]: Computed property "totalPrice" was assigned to but it has no setter. (found in <Anonymous>)代码:<input v-model="totalPrice"/>原因:v-model命令,因Vue 的双向数据绑定原理 , 会自动操作 totalPrice, 对其进行set 操作而 totalPrice 作为计..._computed property "totalprice" was assigned to but it has no setter.
文章浏览阅读60次。十分暴力而简洁的解决方式:读取P和T的位置并自动生成唯一正确答案,将题给测点与之对比,不一样就给我爬!_basic 1003 case 1
文章浏览阅读422次。原标题:详解将Web项目War包部署到Tomcat服务器基本步骤详解将Web项目War包部署到Tomcat服务器基本步骤1 War包War包一般是在进行Web开发时,通常是一个网站Project下的所有源码的集合,里面包含前台HTML/CSS/JS的代码,也包含Java的代码。当开发人员在自己的开发机器上调试所有代码并通过后,为了交给测试人员测试和未来进行产品发布,都需要将开发人员的源码打包成Wa..._/opt/bosssoft/war/medical-web.war/web-inf/web.xml of module medical-web.war.
文章浏览阅读3k次,点赞3次,收藏13次。# -*- coding: utf-8 -*-# 简述:这里有四个数字,分别是:1、2、3、4#提问:能组成多少个互不相同且无重复数字的三位数?各是多少?def f(n):list=[]count=0for i in range(1,n+1):for j in range(1, n+1):for k in range(1, n+1):if i!=j and j!=k and i!=k:list.a..._python求从0到9任意组合成三位数数字不能重复并输出
文章浏览阅读1k次,点赞3次,收藏2次。<el-table-column prop="studentSex" label="性别" :formatter="sex"></el-table-column>然后就在vue的methods中写方法就OK了methods: { sex(row,index){ if(row.studentSex == 1){ return '男'; }else{ return '女'; }..._elementui table 性别
文章浏览阅读1.1k次。java文件操作之移动文件到指定的目录_java中怎么将pro.txt移动到design_mode_code根目录下