全部文档
文档中心工作流常见问题与排查运行与监控

运行与监控

先判断是否正在正常等待人工任务、消息或计时器。存在异常作业时,先看具体错误;只有多个实例普遍无法推进时,才进一步检查调度服务和运行资源。

  • 目标实例是否处于可运行状态,是否仍等待处理人、消息或到达指定时间。

  • 是否有长时间未返回的 Python、接口或数据处理任务。

  • 问题只发生在一条流程,还是同一环境的多个流程都受到影响。

  • 记录最后成功推进时间和异常作业信息,再交由管理员核查。

工作流的异步推进依赖作业执行器。检查执行器是否正常工作、线程是否被长任务占用、是否存在任务排队,以及数据库连接、锁等待和服务资源是否正常。确认瓶颈后再处理;增加线程数不能修复脚本死等、数据库不可用等问题。

当前代码提供以下作业线程池配置,括号内是默认值:

  • EXPORT_DEEPFLOW_JOB_CORE_POOL_SIZE:核心线程数(30)。

  • EXPORT_DEEPFLOW_JOB_MAX_POOL_SIZE:最大线程数(100)。

  • EXPORT_DEEPFLOW_JOB_QUEUE_CAPACITY:队列容量(1000)。

如果环境已经使用这些值,再填写一次相同值不会扩大容量。这组配置也用于同步 Python 调用的线程池,调整时应一并评估脚本并发。需要调整时,应结合机器资源、数据库连接容量和并发量评估,并核对部署版本是否支持这些变量、调整后是否生效。不要只凭旧案例的版本分界或固定数值操作。

恢复后,用一条简单测试流程确认能够推进,再核对原异常实例;恢复调度不代表此前部分完成的业务操作可以直接重做。

  1. 确认当前空间、应用和工作流元素正确,当前应用中已有发布过的工作流。

  2. 检查当前账号的管理员身份与访问权限。普通办理人应先从待办入口查看自己的任务。

  3. 若能看到左侧工作流列表,但实例列表为空,核对所选工作流、查询条件和目标实例的实际状态。

  • 左侧工作流列表也为空:检查 /process/instance/deployed-element/list 请求是否成功及其响应。该接口按当前空间、应用查找已发布工作流的元素信息;返回空列表时,应继续核对发布记录、元素关联和元素信息查询结果。不能只凭空响应判断“工作流元素太多”。

  • 左侧有工作流,实例或任务列表为空:同时检查目标列表请求、查询条件和管理员校验配置。

EXPORT_DEEPFLOW_MONITOR_ADMIN_ENABLE 是相关监控查询的 管理员校验开关,当前默认值为 true:启用时,非管理员的相关查询会返回空结果。设为 false 表示跳过这项管理员校验,不是关闭监控页面;其他访问控制仍需核对。不要为了让页面显示数据而直接关闭管理员校验。

已有管理员账号也查不到数据时,提供接口响应、空间与应用、工作流元素以及发生时间,由技术支持继续核查。当前实现不能支持“元素数量多就一定返回空数据”的结论。

这是一类通用提示,不能仅凭这四个字确定原因。记录触发步骤、时间、实例 ID 和完整响应;结合流程作业信息与对应服务日志定位。若刚升级过环境,还需由管理员核对前后端组件版本和接口是否配套。

回到顶部

咨询热线

400-821-9199