讲师中心微信公众号

首页

文章

后端开发 web前端数据库开发工具 php框架常见问题科技 Java 系统教程电脑教程硬件教程手机教程软件教程游戏教程自媒体新闻

专题

后端开发 web前端数据库开发工具 php框架科技 Java 系统教程电脑教程硬件教程手机教程软件教程游戏教程新闻

AI工具

AI 聊天问答 Agent智能体 AI 文本写作 AI 绘画作图 AI 设计工具 AI 视频创作 AI 音频制作 AI 办公学习 AI 编程开发 Prompt指令

学习

大前端后端开发数据库移动端运维开发计算机基础

编程手册

大前端后端开发数据库移动端运维开发计算机基础

下载

js特效网站源码工具下载类库下载网站素材学习资源插件扩展手机游戏

最近更新

0

0

c++代码如何进行性能分析和优化？ (gprof/perf入门)

尼克

发布时间：2026-01-11 12:03:08

|

602人浏览过

|

来源于php中文网

原创

gprof编译必须加-pg且禁用-O2以上优化，因高阶优化会内联函数导致统计失真；perf需-g或--call-graph dwarf开启调用栈采样，二者采样逻辑本质不同：gprof插桩，perf硬件采样。

c++代码如何进行性能分析和优化？ (gprof/perf入门)

gprof 编译时必须加 `-pg`，且不能用 `-O2` 以上优化

gprof 依赖编译器在函数入口/出口插入计数桩（instrumentation），-pg 是强制开关。但高阶优化（如 -O2、-O3）可能内联函数、删减调用栈，导致 gprof 统计失真甚至崩溃。

正确编译命令：g++ -pg -O1 -g main.cpp -o main
错误示范：g++ -pg -O3 main.cpp -o main → 调用图断裂，gprof main 显示大量
-g 不是可选：没有调试信息，gprof 无法把地址映射回函数名

perf record -g 要用 `-g` 或 `--call-graph dwarf` 才能看调用栈

默认 perf record 只采样当前指令指针，看不到函数调用关系。必须显式开启 call graph 支持，否则 perf report 里全是平铺的符号，没法定位热点路径。

推荐命令：perf record -g -e cycles:u ./main（用户态周期采样）
若遇到 failed to parse /proc/kallsyms 或栈展开失败，换用：perf record --call-graph dwarf -e cycles:u ./main
注意：dwarf 模式依赖 -g 编译，且比 fp（frame pointer）模式稍慢，但兼容性更好（尤其启用 -fno-omit-frame-pointer 时）

gprof 输出里 `flat profile` 看耗时，`call graph` 看传播路径

gprof main gmon.out 默认输出两块：上面是各函数自身耗时（self），下面是调用关系（children + called）。别只盯着 % time 最高的函数 —— 它可能只是被频繁调用的“工具函数”，真正瓶颈常藏在 children 时间占比大的父函数里。

无阶未来模型擂台/AI 应用平台

无阶未来模型擂台/AI 应用平台

无阶未来模型擂台/AI 应用平台，一站式模型+应用平台

下载

index % time    self  children    called     name
[2]    92.1    0.00    0.46       1/1           main [2]
               0.46    0.00       1/1           heavy_calculation [3]

heavy_calculation 占了 main 的全部子耗时（0.46s），但它自己 self 是 0.46s → 瓶颈就在它内部
如果某函数 self 很小但 children 很大，说明它只是中转站，得继续往下钻
called 列为 1/1 表示被调用 1 次，第一个数字是实际调用次数（比如 100/1 就是被 main 调了 100 次）

perf report 用 `↑↓←→` 导航，按 `Enter` 进入调用栈，`q` 退出

终端里 perf report 是交互式界面，不是静态文本。很多人直接扫一眼就关掉，其实关键信息藏在展开的调用树里。

立即学习“C++免费学习笔记（深入）”；

高亮某行后按 Enter，会显示该函数的完整调用链（从 main 开始逐层向下）
按 → 可展开汇编视图（需带 -g 和 -g 编译），看到哪条指令最热（比如某次 mov 后卡住，或 div 指令频繁出现）
按 / 可搜索函数名；按 ? 查快捷键 —— 别跳过这步，很多性能拐点靠 → 展开才看得见

gprof 和 perf 的根本差异不在命令行参数，而在采样逻辑：gprof 是插桩（修改代码行为），perf 是硬件事件采样（尽量无侵入）。所以对短生命周期程序、高频系统调用场景，perf 更可靠；而 gprof 在需要精确函数级时间分配时仍有价值 —— 前提是你记得关掉激进优化。

相关文章

如何使用vcpkg的二进制缓存(binary caching)加速c++ CI构建？ (CI/CD优化)

c++的虚函数表(vtable)是如何工作的？ (深入理解多态)

C++中的RVO/NRVO优化是什么？(返回值优化减少拷贝次数)

c++的std::byte类型和char有什么不同？ (原始内存操作)

如何使用C++20 Concepts约束变参模板？ (Variadic Concepts)

数码产品性能查询

数码产品性能查询

该软件包括了市面上所有手机CPU，手机跑分情况，电脑CPU，电脑产品信息等等，方便需要大家查阅数码产品最新情况，了解产品特性，能够进行对比选择最具性价比的商品。

下载

相关标签:

工具栈 ai c++ 热点命令行参数指针栈 pointer 事件

本站声明：本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

上一篇：如何使用c++和ZeroMQ实现进程间通信？ (消息模式) 下一篇：C++中的聚合初始化(Aggregate Initialization)？(直接用花括号初始化结构体)

作者最新文章

Win11怎么修改DNS服务器_Win11加快网页打开速度设置【网络】

2026-01-09 09:27

腾讯文档网页版入口官网腾讯文档网页版直接在线使用

2026-01-09 09:28

猫耳FM登录网页官网广播剧入口

2026-01-09 09:30

网易LOFTER如何置顶作品网易LOFTER文章置顶设置方法【详解】

2026-01-09 09:33

苹果手机桌面小组件怎么添加_iPhone个性化桌面设置【教程】

2026-01-09 09:39

Win11怎么启用隐藏的“磁盘清理”高级选项_Win11彻底删除Windows.old等文件【维护】

2026-01-09 09:44

todesk连接失败是什么原因_todesk连接错误原因与解决方法

2026-01-09 09:45

苹果怎么设置自定义短语_苹果键盘文本替换快捷输入教程【效率】

2026-01-09 09:47

电脑无法打开EXE文件？修复电脑关联程序错误导致的启动失败【教程】

2026-01-09 09:48

苹果测距仪怎么用_苹果手机测量物体长度功能教程【演示】

2026-01-09 09:53

热门AI工具

更多

DeepSeek

DeepSeek

幻方量化公司旗下的开源大模型平台

AI大模型

开放平台

豆包大模型

豆包大模型

字节跳动自主研发的一系列大型语言模型

AI大模型

通义千问

通义千问

阿里巴巴推出的全能AI助手

AI大模型

腾讯元宝

腾讯元宝

腾讯混元平台推出的AI助手

文档处理

Excel 表格

文心一言

文心一言

文心一言是百度开发的AI聊天机器人，通过对话可以生成各种形式的内容。

AI大模型

中文写作

讯飞写作

讯飞写作

基于讯飞星火大模型的AI写作工具，可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

中文写作

写作工具

即梦AI

即梦AI

一站式AI创作平台，免费AI图片和视频生成。

图片拼接

图画生成

ChatGPT

ChatGPT

最最强大的AI聊天机器人程序，ChatGPT不单是聊天机器人，还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

AI大模型

中文写作

智谱清言 - 免费全能的AI助手

智谱清言 - 免费全能的AI助手

智谱清言 - 免费全能的AI助手

AI大模型

PDF 文档

相关专题

更多

堆和栈的区别

堆和栈的区别

堆和栈的区别：1、内存分配方式不同；2、大小不同；3、数据访问方式不同；4、数据的生命周期。本专题为大家提供堆和栈的区别的相关的文章、下载、课程内容，供大家免费下载体验。

386

2023.07.18

堆和栈区别

堆和栈区别

堆(Heap)和栈(Stack)是计算机中两种常见的内存分配机制。它们在内存管理的方式、分配方式以及使用场景上有很大的区别。本文将详细介绍堆和栈的特点、区别以及各自的使用场景。php中文网给大家带来了相关的教程以及文章欢迎大家前来学习阅读。

568

2023.08.10

c++主流开发框架汇总

c++主流开发框架汇总

本专题整合了c++开发框架推荐，阅读专题下面的文章了解更多详细内容。

78

2026.01.09

c++框架学习教程汇总

c++框架学习教程汇总

本专题整合了c++框架学习教程汇总，阅读专题下面的文章了解更多详细内容。

46

2026.01.09

学python好用的网站推荐

学python好用的网站推荐

本专题整合了python学习教程汇总，阅读专题下面的文章了解更多详细内容。

121

2026.01.09

学python网站汇总

学python网站汇总

本专题整合了学python网站汇总，阅读专题下面的文章了解更多详细内容。

11

2026.01.09

python学习网站

python学习网站

本专题整合了python学习相关推荐汇总，阅读专题下面的文章了解更多详细内容。

15

2026.01.09

俄罗斯手机浏览器地址汇总

俄罗斯手机浏览器地址汇总

汇总俄罗斯Yandex手机浏览器官方网址入口，涵盖国际版与俄语版，适配移动端访问，一键直达搜索、地图、新闻等核心服务。

71

2026.01.09

漫蛙稳定版地址大全

漫蛙稳定版地址大全

漫蛙稳定版地址大全汇总最新可用入口，包含漫蛙manwa漫画防走失官网链接，确保用户随时畅读海量正版漫画资源，建议收藏备用，避免因域名变动无法访问。

369

2026.01.09

热门下载

更多

网站特效

/

网站源码

/

网站素材

/

前端模板

相关下载

更多

php商城系统

淘源码商城PHP淘宝查信誉

PHP房产程序[BBWPS]

PHP简约自动发卡平台个人版

ERMEB域名PHP离线网络授权系统

Difeye-敏捷的轻量级PHP框架

大泉州汽车网PHP整站程序

精品课程

更多

相关推荐

/

热门推荐

/

最新课程

React 教程

React 教程

共58课时 | 3.5万人学习

Pandas 教程

Pandas 教程

共15课时 | 0.9万人学习

ASP 教程

ASP 教程

共34课时 | 3.4万人学习

最新文章

更多

c++ Box2D物理引擎怎么用 c++ 2D游戏物理入门【教程】

C++中的const_cast是用来做什么的？(去除变量的const属性)

C++里的decltype关键字是做什么的？（根据表达式推导变量类型）

C++中的std::async和std::thread有什么区别？(更高层的异步任务封装)

如何使用WinDbg预览版调试c++程序？ (时间旅行调试)

C++中的std::bitset如何处理位运算？(方便地进行二进制位管理)

c++的explicit关键字有什么作用？ (防止隐式类型转换)

如何使用CMake为ARM平台交叉编译c++项目？ (Toolchain文件配置)

c++20的std::span是如何做到零开销抽象的？ (视图语义)

c++中的对象切片(slicing)问题是什么？ (多态陷阱)

关于我们免责申明举报中心意见反馈讲师合作广告合作最新更新: php中文网：公益在线php培训，帮助PHP学习者快速成长！; 关注服务号技术交流群

PHP中文网订阅号: 每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号

PHP学习

技术支持

返回顶部