function_graph的工作原理是什么,怎么用

function_graph是Linux内核内置的ftrace追踪器之一,能够以图形化方式展示函数调用链和耗时,是性能调优和问题定位的利器。

什么是function_graph?为什么它值得关注

function_graph是ftrace框架下的一个tracer,专门用于记录内核函数的进入和退出事件,它通过缩进和耗时标注,直观呈现函数调用层次和每层执行时间,相比传统的printk或手动打点,function_graph可以在不修改内核代码的情况下,快速摸清代码路径和性能瓶颈。

考研英语“天坑词”function除了“功能;职务”外,你还知道别的意思吗?
加载中
考研英语“天坑词”function除了“功能;职务”外,你还知道别的意思吗?

核心工作原理

function_graph在内核函数入口处插入钩子,记录调用深度和时间戳;在出口处再次记录,计算实际耗时,输出结果中,每一层缩进代表一个函数调用,右侧的数字是该函数执行时间(微秒级),这种机制让开发者一眼看清“时间花在了哪里”。

典型应用场景

  • 内核驱动开发:验证驱动程序的行为是否符合预期,例如检查中断处理函数是否过度占用CPU。
  • 启动优化:分析内核启动阶段各子系统的初始化顺序和耗时,定位拖慢启动的模块。
  • 性能抖动排查:当系统出现偶发卡顿,利用function_graph追踪特定进程的内核调用,寻找异常延迟点。

function_graph怎么用?从配置到实战

前提条件:内核配置

function_graph依赖ftrace支持,大部分发行版默认启用,若需确认,可检查内核配置是否包含CONFIG_FUNCTION_GRAPH_TRACER=y,在/boot/config-$(uname -r)中搜索该选项即可。

启用与基本操作

通过tracefs虚拟文件系统控制,挂载点通常在/sys/kernel/tracing/sys/kernel/debug/tracing,以下命令序列是典型流程:

# 挂载tracefs(如未挂载)
mount -t tracefs nodev /sys/kernel/tracing
# 选择function_graph tracer
echo function_graph > /sys/kernel/tracing/current_tracer
# 开始追踪
echo 1 > /sys/kernel/tracing/tracing_on
# 等待一段时间或复现问题,然后停止
echo 0 > /sys/kernel/tracing/tracing_on
# 查看结果
cat /sys/kernel/tracing/trace

function_graph的工作原理是什么,怎么用

输出示例:

 1)               |  do_sys_open() {
 1)               |    getname() {
 1)   0.910 us    |      kmem_cache_alloc();
 1)   0.210 us    |      __check_object_size();
 1)   2.500 us    |    }
 1)   0.130 us    |    file_open();
 1)   5.200 us    |  }

缩进代表调用深度,右侧数字是函数执行时间,后的空格数表示层级。

进阶技巧:过滤和追踪特定进程

按函数名称过滤

只追踪某个函数及其子调用,避免输出过多:

echo do_sys_open > /sys/kernel/tracing/set_graph_function

按进程过滤

追踪特定PID的调用:

echo 1234 > /sys/kernel/tracing/set_ftrace_pid

排除不关心的函数

使用set_graph_notrace排除一些高频且无价值的函数(如printkspin_lock等),减少噪音。

使用trace-cmd简化操作

trace-cmd是ftrace的前端工具,封装了上述文件操作,更直观:

# 记录function_graph追踪,持续10秒
trace-cmd record -p function_graph -O graph-time -l do_sys_open sleep 10
# 查看结果
trace-cmd report

-l指定只追踪的函数,-O graph-time输出时间信息,这种方式适合自动化脚本和长时间抓取。

function_graph性能分析最佳实践

识别热点函数

在高负载场景下,开启function_graph后,观察哪些函数耗时占比最大,较深的缩进和较大的时间值意味着潜在的优化点,在网络驱动中,若hard_start_xmit函数耗时异常,多数情况下是锁竞争或硬件响应慢。

分析内核态延迟

当用户态程序响应变慢,但CPU使用率不高,问题可能在等待内核资源,可以通过function_graph追踪该进程的内核调用,检查mutex_lockwait_event等函数的等待时间,如果schedule()函数频繁出现且耗时较长,说明进程被频繁切换,需要调整调度策略或减少锁持有时间。

function_graph的工作原理是什么,怎么用

结合trace_hwlat检测硬件干扰

function_graph可以与硬件延迟检测器配合使用,先通过echo hwlat > current_tracer确认硬件是否存在异常中断,再切换回function_graph追踪具体受影响的内核路径,行业共识认为,这种组合排查方式是解决系统抖动问题的高效套路。

function_graph与其他追踪工具有何不同?

与perf对比

  • perf:基于硬件计数器和采样,适合宏观性能统计(如CPU周期、缓存命中率),但函数级调用链信息不如function_graph精细。
  • function_graph:提供完整的调用树和精确时间,适合微观行为分析,但开销较大(所有函数入口出口都插桩),不适合长时间全量开启。

与strace对比

  • strace:追踪用户态系统调用,不深入内核内部。
  • function_graph:追踪内核函数,包括系统调用内部实现,例如do_sys_open内部的路径,两者互补,排查用户态问题用strace,内核态问题用function_graph。

与systemtap对比

  • systemtap:需要编写脚本,动态插桩,灵活性高但学习曲线陡峭。
  • function_graph:无需脚本,简单配置即可使用,适合快速验证和初步定位。

选择建议

  • 快速定位内核函数调用顺序:function_graph
  • 分析CPU热点和硬件事件:perf
  • 追踪用户态系统调用:strace
  • 复杂自定义探针:systemtap

function_graph使用注意事项

性能开销

function_graph在每个内核函数入口和出口插入探测点,会显著增加系统开销,根据内核版本和硬件,整体性能可能下降10%-30%。生产环境建议仅在短时间、低负载下使用,或通过set_graph_notrace排除高频函数

缓冲区溢出

默认的trace buffer较小,长时间追踪可能导致输出被截断,可通过

function_graph的工作原理是什么,怎么用

echo 8192 > /sys/kernel/tracing/buffer_size_kb调整缓冲区大小,8192表示8MB,可根据内存容量适当增大。

内核版本差异

  • 内核版本<3.0:function_graph可能不支持某些架构(如ARM的早期版本)。
  • 内核版本>=4.0:支持更完善的过滤机制和trace-cmd集成。
  • 内核版本>=5.10:引入osnoise追踪器,与function_graph配合可进一步增强实时性分析。

读trace输出时注意时间单位

默认时间单位为微秒(us),但部分内核配置下可能显示为纳秒(ns),可通过echo 0 > /sys/kernel/tracing/trace_options关闭latency-format,确保输出一致。

function_graph是内核开发者手中最直观的调用链分析工具,能快速缩小问题范围,避免盲目加日志,搭配过滤器和trace-cmd,即可在复杂场景中高效定位性能瓶颈。

function_graph常见问题解答

function_graph怎么使用?

/sys/kernel/tracing目录下,先设置current_tracerfunction_graph,然后开启tracing_on,停止后读取trace文件,也可以使用trace-cmd record -p function_graph一键操作,推荐先用set_graph_function指定目标函数,避免输出过多。

function_graph和perf的区别是什么?

function_graph追踪函数调用树和精确时间,适合微观路径分析;perf基于采样,适合宏观性能统计,两者定位不同,function_graph更侧重“谁调用了谁,花了多久”,而perf侧重“什么代码消耗了最多CPU”,排查具体内核函数行为时首选function_graph,分析系统整体性能分布时选perf。

function_graph能追踪用户态吗?

不能,function_graph只追踪内核态函数,包括系统调用内部实现,若需用户态函数调用链,应使用gprof、perf的用户态采样或动态插桩工具(如uprobes),function_graph可以配合set_ftrace_pid追踪特定进程的内核调用,但无法进入用户态代码。

首发原创文章,作者:王坚‌,如若转载,请注明出处:https://idctop.com/article/511629.html

(0)
ftp服务器文件能直接打开吗,怎么打开文件?
上一篇 2026年7月22日 11:49
CDN证书是什么?,怎么免费申请CDN证书
下一篇 2026年7月22日 11:52

相关推荐

  • 服务器与虚拟机管理中,如何实现高效、安全的运维策略?

    服务器和虚拟机的管理是企业IT基础设施高效运行的核心,涉及硬件资源调度、虚拟化平台维护及业务连续性保障,通过系统化管理策略,企业能显著提升资源利用率、降低运维成本并增强系统安全性,服务器管理的关键维度服务器作为物理基础设施,其管理需覆盖硬件监控、性能优化与安全防护三大层面,硬件监控与维护实时监控CPU、内存、磁……

    2026年2月4日
    14830
  • 服务器客户端推送怎么实现?服务端主动推送消息技术方案

    在2026年的实时交互架构中,服务器客户端推送是保障毫秒级数据触达、降低终端功耗与服务器轮询压力的核心通信机制,其技术选型直接决定系统的并发承载力与用户体验,服务器客户端推送的底层逻辑与演进推送机制的代际更迭传统拉取模式已无法适配2026年高频交互场景,从短轮询到长轮询,再到如今的全双工通信,推送技术完成了从……

    2026年4月23日
    6100
  • cdn机器评估难?cdn服务器配置怎么选

    2026年CDN机器评估的核心结论是:不再单纯追求带宽峰值,而是基于“边缘计算节点密度+智能调度算法+国产化硬件适配”的综合能效比,推荐采用混合云架构以平衡成本与稳定性,随着2026年AI大模型推理需求的爆发式增长,传统CDN(内容分发网络)已演变为边缘智能基础设施,企业在进行CDN机器配置选型时,必须从单一的……

    2026年6月17日
    2810
  • 如何搭建cdn服务器,搭建cdn服务器教程

    搭建CDN服务器并非简单的硬件堆砌,而是基于边缘节点分布式架构、智能调度算法与带宽资源优化组合的系统工程,其核心在于通过就近接入降低延迟并提升内容分发效率,在2026年的数字生态中,随着4K/8K视频、云游戏及实时交互应用的普及,用户对毫秒级响应的要求已近乎苛刻,传统中心服务器架构已难以支撑海量并发,构建或接入……

    2026年7月4日
    5300
  • 服务器在财务领域扮演的角色及其具体财务功能是什么?

    服务器在财务上主要负责数据存储、处理与分析,支撑财务系统的稳定运行,并确保财务信息的安全、准确与高效流转,它不仅是财务数字化的基础设施,更是企业财务决策、风险控制和合规管理的核心引擎,下面将从具体职能、技术实现和优化方案等方面展开详细解析,服务器在财务中的核心职能数据集中存储与管理服务器作为财务数据的“中央仓库……

    2026年2月4日
    15900
  • 稀有款熊大模型怎么获得?花了时间研究分享给你

    经过对市场数据的深度挖掘与实物对比,稀有款熊大模型的核心价值已不再局限于单一的玩具属性,而是演变为具备高溢价空间的收藏艺术品,稀缺性、工艺细节差异以及官方认证的完整性,构成了其价值评估的三大核心支柱, 对于收藏者而言,精准识别版本代号、规避市场仿品陷阱,是入局该领域的必备技能,这不仅需要审美的眼光,更需要严谨的……

    2026年4月5日
    9800
  • Highstock CDN怎么用,Highstock引入方式

    使用Highstock CDN是2026年构建高性能金融与工业数据可视化应用的最佳实践,它通过预加载的静态资源加速了图表渲染,显著降低了服务器负载并提升了首屏加载速度,在数字化转型深入发展的当下,数据可视化已成为企业决策的核心基础设施,Highstock作为Highcharts家族中专为时间序列数据设计的组件……

    2026年7月1日
    1410
  • 免费cdn加速推荐哪个好用?免费cdn加速推荐

    2026年免费CDN加速首选推荐为阿里云全站加速、腾讯云CDN及Cloudflare,其中国内业务优先选择阿里云或腾讯云以符合ICP备案要求,跨境或海外业务首选Cloudflare以获得极致性能与安全性,在2026年的互联网基础设施环境中,内容分发网络(CDN)已从单纯的“加速工具”演变为集安全、计算、存储于一……

    2026年7月5日
    33500
  • cdn远程下载失败怎么办?cdn远程下载

    CDN远程下载的核心优势在于通过边缘节点缓存静态资源,显著降低源站负载并提升全球访问速度,2026年主流方案已实现毫秒级响应与智能调度,建议根据业务地域分布选择具备合规资质的服务商,CDN远程下载的技术演进与核心价值在2026年的数字化环境中,远程下载不再仅仅是文件的简单传输,而是涉及数据分发、安全加速与成本优……

    2026年6月7日
    4500
  • 深度了解大模型新闻播报员后有哪些实用总结?大模型新闻播报员实用总结分享

    深度了解大模型新闻播报员后,最核心的结论在于:这项技术并非简单的文本转语音工具,而是内容生产流程的重塑者,它能显著提升新闻生产的时效性与准确性,但前提是使用者必须掌握精准的提示词工程与事实核查机制,只有将大模型的能力限定在可控范围内,才能真正实现降本增效,否则极易陷入“一本正经胡说八道”的风险陷阱,大模型新闻播……

    2026年4月8日
    8300

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注