故障排查

故障排查: 实例宕机或变慢

当实例访问不了或变慢时,按顺序要做的检查,从状态和监控图表到重启和内存上限。

按顺序做完这些检查

1. 控制台顶部的实例状态

打开实例的 控制台。顶部在分支名称旁边显示一个实时状态指示器。如果实例没有运行,页面顶部会出现一条琥珀色横幅,写着“实例未运行”。这条横幅还会告诉您是否启用了 自动重启;如果没有启用,您可以在设置中打开它,让实例在故障后自动恢复。

2. 服务器在线吗?

查看 服务器 页面。每张服务器卡片都会显示在线、离线、宕机或性能下降的标记,以及实时的 CPU、内存和磁盘使用率。如果服务器本身宕了,上面的任何实例都不会响应,那是服务器的问题,不是实例的问题。

3. 监控标签页

在控制台中打开 监控 标签页:

  • 如果启用了在线监控,您会看到 30 天在线率、平均响应时间、当前状态和每日在线率条。
  • 两张图表分别显示 Odoo 容器和数据库容器的 CPU 和内存使用率。CPU 持续 100% 或内存一路涨到天花板,就能解释卡顿。
  • 点击图表上的任意一点,可以打开那个时刻前后的容器日志;您也可以拖动缩放、双击复位。在日志面板中,大脑图标会对日志运行 AI 分析,并允许您继续追问。

4. 日志标签页

日志 标签页显示实时的 Odoo 日志,并带有刷新、实时流(自动刷新)和下载按钮。留意反复出现的 traceback、内存不足的消息或崩溃循环。

5. 重启

点击控制台顶部的 重启:

  • 先试 软重启(重启 Odoo 并升级模块)。
  • 如果没用,再用 硬重启(重启 Docker 容器)。

6. 最近的部署

打开 队列 标签页(或队列页面),看看是否有最近的部署或升级任务与这次故障时间吻合。参见 故障排查: 部署失败

如果容器反复挂掉

一个反复停止的容器,尤其是刚启动后或在负载下停止的容器,往往是撞到了内存上限。在 设置的 Odoo 标签页 中检查 内存上限 (MB)(0 表示不限制)以及 PostgreSQL 标签页上对应的字段。调高上限,或者把它设成服务器实际能提供的数值,可以终止崩溃循环。

何时升级处理

如果两种重启之后实例仍然宕着,或者日志里看不出原因,请提交支持工单 (open the article),问题类型设为实例并关联该实例。请包含: 状态指示器和离线横幅显示了什么、日志标签页中相关的那段输出、您在监控中发现的任何图表尖峰,以及最近的队列任务。

仍未解决?在应用中提交工单,或与工程师沟通