function_graph的工作原理是什么,怎么用

function_graph是Linux内核内置的ftrace追踪器之一,能够以图形化方式展示函数调用链和耗时,是性能调优和问题定位的利器。

什么是function_graph?为什么它值得关注

function_graph是ftrace框架下的一个tracer,专门用于记录内核函数的进入和退出事件,它通过缩进和耗时标注,直观呈现函数调用层次和每层执行时间,相比传统的printk或手动打点,function_graph可以在不修改内核代码的情况下,快速摸清代码路径和性能瓶颈。

核心工作原理

function_graph在内核函数入口处插入钩子,记录调用深度和时间戳;在出口处再次记录,计算实际耗时,输出结果中,每一层缩进代表一个函数调用,右侧的数字是该函数执行时间(微秒级),这种机制让开发者一眼看清“时间花在了哪里”。

典型应用场景

  • 内核驱动开发:验证驱动程序的行为是否符合预期,例如检查中断处理函数是否过度占用CPU。
  • 启动优化:分析内核启动阶段各子系统的初始化顺序和耗时,定位拖慢启动的模块。
  • 性能抖动排查:当系统出现偶发卡顿,利用function_graph追踪特定进程的内核调用,寻找异常延迟点。

function_graph怎么用?从配置到实战

前提条件:内核配置

function_graph依赖ftrace支持,大部分发行版默认启用,若需确认,可检查内核配置是否包含CONFIG_FUNCTION_GRAPH_TRACER=y,在/boot/config-$(uname -r)中搜索该选项即可。

启用与基本操作

通过tracefs虚拟文件系统控制,挂载点通常在/sys/kernel/tracing/sys/kernel/debug/tracing,以下命令序列是典型流程:

# 挂载tracefs(如未挂载)
mount -t tracefs nodev /sys/kernel/tracing
# 选择function_graph tracer
echo function_graph > /sys/kernel/tracing/current_tracer
# 开始追踪
echo 1 > /sys/kernel/tracing/tracing_on
# 等待一段时间或复现问题,然后停止
echo 0 > /sys/kernel/tracing/tracing_on
# 查看结果
cat /sys/kernel/tracing/trace

function_graph的工作原理是什么,怎么用

输出示例:

 1)               |  do_sys_open() {
 1)               |    getname() {
 1)   0.910 us    |      kmem_cache_alloc();
 1)   0.210 us    |      __check_object_size();
 1)   2.500 us    |    }
 1)   0.130 us    |    file_open();
 1)   5.200 us    |  }

缩进代表调用深度,右侧数字是函数执行时间,后的空格数表示层级。

进阶技巧:过滤和追踪特定进程

按函数名称过滤

只追踪某个函数及其子调用,避免输出过多:

echo do_sys_open > /sys/kernel/tracing/set_graph_function

按进程过滤

追踪特定PID的调用:

echo 1234 > /sys/kernel/tracing/set_ftrace_pid

排除不关心的函数

使用set_graph_notrace排除一些高频且无价值的函数(如printkspin_lock等),减少噪音。

使用trace-cmd简化操作

trace-cmd是ftrace的前端工具,封装了上述文件操作,更直观:

# 记录function_graph追踪,持续10秒
trace-cmd record -p function_graph -O graph-time -l do_sys_open sleep 10
# 查看结果
trace-cmd report

-l指定只追踪的函数,-O graph-time输出时间信息,这种方式适合自动化脚本和长时间抓取。

function_graph性能分析最佳实践

识别热点函数

在高负载场景下,开启function_graph后,观察哪些函数耗时占比最大,较深的缩进和较大的时间值意味着潜在的优化点,在网络驱动中,若hard_start_xmit函数耗时异常,多数情况下是锁竞争或硬件响应慢。

分析内核态延迟

当用户态程序响应变慢,但CPU使用率不高,问题可能在等待内核资源,可以通过function_graph追踪该进程的内核调用,检查mutex_lockwait_event等函数的等待时间,如果schedule()函数频繁出现且耗时较长,说明进程被频繁切换,需要调整调度策略或减少锁持有时间。

function_graph的工作原理是什么,怎么用

结合trace_hwlat检测硬件干扰

function_graph可以与硬件延迟检测器配合使用,先通过echo hwlat > current_tracer确认硬件是否存在异常中断,再切换回function_graph追踪具体受影响的内核路径,行业共识认为,这种组合排查方式是解决系统抖动问题的高效套路。

function_graph与其他追踪工具有何不同?

与perf对比

  • perf:基于硬件计数器和采样,适合宏观性能统计(如CPU周期、缓存命中率),但函数级调用链信息不如function_graph精细。
  • function_graph:提供完整的调用树和精确时间,适合微观行为分析,但开销较大(所有函数入口出口都插桩),不适合长时间全量开启。

与strace对比

  • strace:追踪用户态系统调用,不深入内核内部。
  • function_graph:追踪内核函数,包括系统调用内部实现,例如do_sys_open内部的路径,两者互补,排查用户态问题用strace,内核态问题用function_graph。

与systemtap对比

  • systemtap:需要编写脚本,动态插桩,灵活性高但学习曲线陡峭。
  • function_graph:无需脚本,简单配置即可使用,适合快速验证和初步定位。

选择建议

  • 快速定位内核函数调用顺序:function_graph
  • 分析CPU热点和硬件事件:perf
  • 追踪用户态系统调用:strace
  • 复杂自定义探针:systemtap

function_graph使用注意事项

性能开销

function_graph在每个内核函数入口和出口插入探测点,会显著增加系统开销,根据内核版本和硬件,整体性能可能下降10%-30%。生产环境建议仅在短时间、低负载下使用,或通过set_graph_notrace排除高频函数

缓冲区溢出

默认的trace buffer较小,长时间追踪可能导致输出被截断,可通过

function_graph的工作原理是什么,怎么用

echo 8192 > /sys/kernel/tracing/buffer_size_kb调整缓冲区大小,8192表示8MB,可根据内存容量适当增大。

内核版本差异

  • 内核版本<3.0:function_graph可能不支持某些架构(如ARM的早期版本)。
  • 内核版本>=4.0:支持更完善的过滤机制和trace-cmd集成。
  • 内核版本>=5.10:引入osnoise追踪器,与function_graph配合可进一步增强实时性分析。

读trace输出时注意时间单位

默认时间单位为微秒(us),但部分内核配置下可能显示为纳秒(ns),可通过echo 0 > /sys/kernel/tracing/trace_options关闭latency-format,确保输出一致。

function_graph是内核开发者手中最直观的调用链分析工具,能快速缩小问题范围,避免盲目加日志,搭配过滤器和trace-cmd,即可在复杂场景中高效定位性能瓶颈。

function_graph常见问题解答

function_graph怎么使用?

/sys/kernel/tracing目录下,先设置current_tracerfunction_graph,然后开启tracing_on,停止后读取trace文件,也可以使用trace-cmd record -p function_graph一键操作,推荐先用set_graph_function指定目标函数,避免输出过多。

function_graph和perf的区别是什么?

function_graph追踪函数调用树和精确时间,适合微观路径分析;perf基于采样,适合宏观性能统计,两者定位不同,function_graph更侧重“谁调用了谁,花了多久”,而perf侧重“什么代码消耗了最多CPU”,排查具体内核函数行为时首选function_graph,分析系统整体性能分布时选perf。

function_graph能追踪用户态吗?

不能,function_graph只追踪内核态函数,包括系统调用内部实现,若需用户态函数调用链,应使用gprof、perf的用户态采样或动态插桩工具(如uprobes),function_graph可以配合set_ftrace_pid追踪特定进程的内核调用,但无法进入用户态代码。

首发原创文章,作者:王坚‌,如若转载,请注明出处:https://idctop.com/article/511629.html

(0)
ftp服务器文件能直接打开吗,怎么打开文件?
上一篇 2026年7月22日 11:49
CDN证书是什么?,怎么免费申请CDN证书
下一篇 2026年7月22日 11:52

相关推荐

  • 均衡负载配合cdn效果好吗?cdn加速怎么配置

    均衡负载配合CDN是解决高并发访问瓶颈、提升用户响应速度的最佳架构方案,前者负责将流量均匀分发至多台服务器,后者负责将静态内容缓存至离用户最近的节点,两者协同工作能显著降低源站压力并加速页面加载,在2026年的互联网环境下,单纯依靠增加服务器数量已经无法应对日益复杂的网络请求,用户对于网站打开速度的容忍度极低……

    2026年6月14日
    2800
  • cdn电脑卡顿怎么解决,cdn加速原理

    2026年CDN加速并非单纯“买带宽”,而是基于边缘计算节点与智能调度算法的综合性能优化,核心结论是:对于静态资源占比高、用户分布广的业务,选择具备AI智能预热功能的头部云服务商可降低40%以上延迟并显著节省带宽成本,随着2026年移动互联网进入“万物互联”深水区,CDN(内容分发网络)已从基础的静态资源缓存演……

    2026年6月30日
    1400
  • CDN加速文件访问效果好吗?CDN加速原理是什么

    CDN加速文件访问的核心在于通过分布式节点就近分发内容,显著降低延迟并提升加载速度,这是解决跨地域访问慢、大文件传输瓶颈的最有效方案,在数字化时代,无论是企业官网、电商平台还是内容分发网络,用户等待的每一秒都在消耗耐心,当用户点击一个链接,如果文件加载卡顿,跳出率会瞬间飙升,CDN(内容分发网络)正是为了解决这……

    2026年6月7日
    4600
  • brother 4150cdn打印机怎么连WiFi?兄弟4150cdn连接教程

    Brother 4150cdn并非真实存在的打印机型号,该命名混淆了Brother品牌的激光打印机系列与彩色喷墨/激光系列,目前市场上不存在此确切型号,建议核对具体需求后选择HL-4150CDN(彩色激光)或DCP-L4150CDN(多功能一体机),在2026年的办公设备采购市场中,用户常因型号记忆偏差或网络信……

    2026年5月30日
    5700
  • 阿里云cdn如何配置,阿里云cdn配置教程

    阿里云CDN配置的核心在于完成域名接入、源站验证及缓存规则设定,通过开启HTTPS加速与智能调度,可实现全球节点毫秒级响应,显著降低服务器负载并提升用户访问体验,在2026年,随着Web3.0应用与AI大模型内容的爆发,静态资源分发与动态加速的需求已深度融合,对于企业而言,单纯购买带宽已无法满足业务增长,精细化……

    2026年7月5日
    19800
  • 国内城市云计算是什么意思,具体包含哪些内容?

    国内城市云计算是指以云计算技术为核心支撑,将城市治理、民生服务与产业发展深度融合的新型城市基础设施体系, 它不仅仅是将政府数据存储在云端,而是构建了一个集计算、存储、网络、算法于一体的智慧“数字底座”,通过对城市海量数据的汇聚、分析与智能响应,实现城市治理的科学化、精细化和智能化,这一体系是“新基建”的重要组成……

    2026年2月26日
    16700
  • oss做cdn,oss做cdn加速配置方法

    将对象存储(OSS)作为CDN加速源站,是实现低成本、高并发内容分发的最优解,其核心优势在于利用边缘节点缓存静态资源,显著降低回源带宽成本并提升全球访问速度,在2026年的云原生架构中,单纯依赖传统CDN已难以满足极致性价比与弹性扩展的需求,越来越多的企业选择“OSS + CDN”的组合模式,通过CDN边缘节点……

    2026年6月1日
    3400
  • wp 有cdn插件吗,wordpresscdn插件推荐

    是的,WordPress 拥有大量成熟的 CDN 插件,2026 年主流方案已实现“一键接入”与“智能边缘计算”的深度融合,无需手动配置 DNS 即可显著提升全球访问速度,在 2026 年的数字化基建标准下,网站加载速度不仅是用户体验的核心指标,更是百度 SEO 算法中“页面体验”权重的决定性因素,对于 Wor……

    2026年5月10日
    5500
  • 服务器操作系统更换过程中,会有哪些潜在风险和挑战?

    服务器更换操作系统是一项需要谨慎规划的专业技术操作,它涉及底层架构的变更,直接影响业务的连续性与数据安全,成功的系统迁移不仅能提升性能与安全性,还能更好地适应业务发展需求,本文将系统性地阐述服务器更换操作系统的核心流程、关键风险与专业解决方案, 更换操作系统的核心动因与前期评估在决定更换之前,必须明确目标,并进……

    2026年2月3日
    16850
  • cdn工单怎么提交?cdn工单处理慢

    提交CDN工单并非简单的“点击提交”,而是通过精准定位故障类型、提供完整抓包日志及明确业务影响范围,从而将平均响应时间从默认的24小时压缩至2小时内的标准化运维流程,在2026年,随着全球网络架构向边缘计算深度融合,CDN(内容分发网络)已成为数字基础设施的神经末梢,当业务出现访问延迟、404错误率飙升或HTT……

    2026年6月3日
    3700

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注