2026-09-07 15:11:33 +08:00
|
|
|
|
package com.gzzn.omms.msgexchange.delivery
|
2026-09-06 16:13:50 +08:00
|
|
|
|
|
2026-09-07 15:11:33 +08:00
|
|
|
|
import com.gzzn.omms.msgexchange.config.PipelineProps
|
|
|
|
|
|
import com.gzzn.omms.msgexchange.domain.ErrorClass
|
|
|
|
|
|
import com.gzzn.omms.msgexchange.domain.EventStatus
|
2026-09-09 17:53:08 +08:00
|
|
|
|
import com.gzzn.omms.msgexchange.domain.EventType
|
2026-09-07 15:11:33 +08:00
|
|
|
|
import com.gzzn.omms.msgexchange.domain.MsgEvent
|
|
|
|
|
|
import com.gzzn.omms.msgexchange.domain.Targets
|
|
|
|
|
|
import com.gzzn.omms.msgexchange.infra.persistence.MsgEventRepository
|
|
|
|
|
|
import com.gzzn.omms.msgexchange.infra.retry.FailureScheduler
|
2026-09-06 16:13:50 +08:00
|
|
|
|
import jakarta.inject.Singleton
|
|
|
|
|
|
import java.time.Duration
|
|
|
|
|
|
import java.time.Instant
|
|
|
|
|
|
|
2026-09-10 11:14:11 +08:00
|
|
|
|
/** 对外投递的出口:同步等 Kafka 确认,语义是至少发一次(可能重复,但不会丢)。以后 ES 投影也从这里加。 */
|
2026-09-06 16:13:50 +08:00
|
|
|
|
interface DeliveryPort {
|
2026-09-10 11:14:11 +08:00
|
|
|
|
/** 发一条变化通知,消息 key 是 FLID(航班实例 ID)。 */
|
2026-09-09 17:53:08 +08:00
|
|
|
|
fun sendKafka(topic: String, key: String, payloadJson: String)
|
2026-09-06 16:13:50 +08:00
|
|
|
|
|
2026-09-10 11:14:11 +08:00
|
|
|
|
/** 发一条完整状态,消息 key 是 FLID。适配层负责把 target 映射成 topic:KAFKA:msg 对应 "msg",KAFKA:schd 对应 "schd"。 */
|
2026-09-09 17:53:08 +08:00
|
|
|
|
fun sendKafkaSchd(topic: String, key: String, payloadJson: String)
|
2026-09-06 16:13:50 +08:00
|
|
|
|
|
2026-09-10 11:14:11 +08:00
|
|
|
|
/** 发一条删除通知:key 是 FLID、value 为空;下游按"整态里这个键没了"理解成删除。 */
|
2026-09-09 17:53:08 +08:00
|
|
|
|
fun sendKafkaNull(topic: String, key: String)
|
2026-09-06 22:12:23 +08:00
|
|
|
|
|
2026-09-10 11:14:11 +08:00
|
|
|
|
/** 给健康检查用的连通性探测;默认返回 true,真实 Kafka 实现要覆写成向 broker 拉一次 metadata 来判断。 */
|
2026-09-06 22:12:23 +08:00
|
|
|
|
fun ping(): Boolean = true
|
2026-09-06 16:13:50 +08:00
|
|
|
|
}
|
|
|
|
|
|
|
|
|
|
|
|
/**
|
2026-09-10 11:14:11 +08:00
|
|
|
|
* 投递调度:把 outbox(待发事件表)里的事件发给下游。
|
|
|
|
|
|
*
|
|
|
|
|
|
* KAFKA_MSG 一条一条按登记顺序发,不插队。KAFKA_SCHD 走 flushSchd 批量发:同一个 FLID 攒了
|
|
|
|
|
|
* 多条未发事件时只发版本号最新的那条,旧的自然作废;删除通知发 value 为空的 tombstone。
|
|
|
|
|
|
* 两个主题之间不保证先后顺序。
|
|
|
|
|
|
*
|
|
|
|
|
|
* 失败处理:队首的重试时间没到就不取;一批里有发送失败,整批重试次数加一并推后退避,
|
|
|
|
|
|
* 次数用尽整批转 DEAD 当死信。见 docs/flight-state.md §5。
|
2026-09-06 16:13:50 +08:00
|
|
|
|
*/
|
|
|
|
|
|
@Singleton
|
|
|
|
|
|
class Dispatcher(
|
|
|
|
|
|
private val msgEvents: MsgEventRepository,
|
|
|
|
|
|
private val port: DeliveryPort,
|
|
|
|
|
|
private val props: PipelineProps,
|
2026-09-06 19:08:02 +08:00
|
|
|
|
private val scheduler: FailureScheduler,
|
2026-09-06 16:13:50 +08:00
|
|
|
|
) {
|
2026-09-06 21:02:27 +08:00
|
|
|
|
private val log = org.slf4j.LoggerFactory.getLogger(Dispatcher::class.java)
|
|
|
|
|
|
|
2026-09-06 16:13:50 +08:00
|
|
|
|
@Volatile
|
|
|
|
|
|
private var running = true
|
|
|
|
|
|
|
2026-09-09 17:53:08 +08:00
|
|
|
|
private var lastFlush: Instant? = null
|
2026-09-06 16:13:50 +08:00
|
|
|
|
|
2026-09-10 11:14:11 +08:00
|
|
|
|
/** 请求停机:置位后 loop 走完当前一轮就退出;真正中断线程由 PipelineLifecycle 负责。 */
|
2026-09-06 20:53:14 +08:00
|
|
|
|
fun stop() {
|
|
|
|
|
|
running = false
|
|
|
|
|
|
}
|
|
|
|
|
|
|
2026-09-06 16:13:50 +08:00
|
|
|
|
fun loop() {
|
|
|
|
|
|
while (running) {
|
2026-09-06 18:19:04 +08:00
|
|
|
|
try {
|
|
|
|
|
|
tick()
|
2026-09-06 19:08:02 +08:00
|
|
|
|
} catch (e: InterruptedException) {
|
|
|
|
|
|
Thread.currentThread().interrupt()
|
|
|
|
|
|
return
|
2026-09-06 18:19:04 +08:00
|
|
|
|
} catch (e: Exception) {
|
|
|
|
|
|
sleepQuietly(props.pipeline.pollInterval)
|
|
|
|
|
|
}
|
2026-09-06 16:13:50 +08:00
|
|
|
|
}
|
|
|
|
|
|
}
|
|
|
|
|
|
|
|
|
|
|
|
internal fun tick() {
|
2026-09-09 17:53:08 +08:00
|
|
|
|
val head = msgEvents.headUnsent(Targets.KAFKA_MSG)
|
|
|
|
|
|
if (head != null && (head.state == EventStatus.SENT || head.nextAttemptAt == null || head.nextAttemptAt <= scheduler.now())) {
|
|
|
|
|
|
deliver(Targets.KAFKA_MSG, head)
|
2026-09-06 16:13:50 +08:00
|
|
|
|
}
|
2026-09-09 17:53:08 +08:00
|
|
|
|
if (flushDue()) flushSchd()
|
|
|
|
|
|
if (running) sleepQuietly(props.pipeline.pollInterval)
|
2026-09-06 16:13:50 +08:00
|
|
|
|
}
|
|
|
|
|
|
|
2026-09-06 18:19:04 +08:00
|
|
|
|
private fun flushDue(): Boolean =
|
2026-09-09 17:53:08 +08:00
|
|
|
|
lastFlush?.let { Duration.between(it, scheduler.now()) >= props.schd.flushPeriod } ?: false
|
2026-09-06 19:08:02 +08:00
|
|
|
|
|
2026-09-09 17:53:08 +08:00
|
|
|
|
private fun deliver(target: String, e: MsgEvent) {
|
|
|
|
|
|
try {
|
|
|
|
|
|
when (target) {
|
|
|
|
|
|
Targets.KAFKA_MSG -> port.sendKafka("msg", e.partitionKey, e.payloadJson)
|
|
|
|
|
|
}
|
|
|
|
|
|
msgEvents.markSent(e.eventId ?: return)
|
|
|
|
|
|
} catch (ex: Exception) {
|
|
|
|
|
|
retryOrDead(e, ex.message ?: ex.javaClass.simpleName)
|
2026-09-06 19:08:02 +08:00
|
|
|
|
}
|
|
|
|
|
|
}
|
2026-09-06 18:19:04 +08:00
|
|
|
|
|
2026-09-10 11:14:11 +08:00
|
|
|
|
/** 批量发 KAFKA_SCHD:每个 FLID 只发版本号最新的那条未发事件,删除通知发空 value。 */
|
2026-09-06 16:13:50 +08:00
|
|
|
|
internal fun flushSchd() {
|
2026-09-09 17:53:08 +08:00
|
|
|
|
val batch = try {
|
|
|
|
|
|
msgEvents.mergePendingSchd(props.schd.flushLimit)
|
|
|
|
|
|
} catch (e: Exception) {
|
|
|
|
|
|
log.warn("mergePendingSchd failed: {}", e.message)
|
|
|
|
|
|
return
|
|
|
|
|
|
}
|
|
|
|
|
|
if (batch.isEmpty()) {
|
2026-09-06 19:08:02 +08:00
|
|
|
|
lastFlush = scheduler.now()
|
2026-09-06 18:19:04 +08:00
|
|
|
|
return
|
|
|
|
|
|
}
|
2026-09-09 17:53:08 +08:00
|
|
|
|
val failures = mutableListOf<MsgEvent>()
|
|
|
|
|
|
for (e in batch) {
|
|
|
|
|
|
try {
|
|
|
|
|
|
when (e.eventType) {
|
|
|
|
|
|
EventType.TOMBSTONE -> port.sendKafkaNull("schd", e.partitionKey)
|
|
|
|
|
|
EventType.UPSERT -> port.sendKafkaSchd("schd", e.partitionKey, e.payloadJson)
|
|
|
|
|
|
}
|
|
|
|
|
|
} catch (ex: Exception) {
|
|
|
|
|
|
failures.add(e)
|
|
|
|
|
|
}
|
2026-09-06 19:08:02 +08:00
|
|
|
|
}
|
2026-09-09 17:53:08 +08:00
|
|
|
|
val sentIds = batch.mapNotNull { it.eventId }.toSet() - failures.mapNotNull { it.eventId }.toSet()
|
|
|
|
|
|
if (sentIds.isNotEmpty()) msgEvents.markAllSent(sentIds.toList())
|
2026-09-10 11:14:11 +08:00
|
|
|
|
// 被更新版本压掉的旧事件也要标成已发,否则它们会一直留在队里:同一个 FLID 只按最新版本输出一次
|
2026-09-09 17:53:08 +08:00
|
|
|
|
val sentVersions = batch.associate { it.partitionKey to it.stateVersion }
|
|
|
|
|
|
runCatching {
|
|
|
|
|
|
while (true) {
|
|
|
|
|
|
val superseded = msgEvents.mergePendingSchd(props.schd.flushLimit)
|
|
|
|
|
|
.filter { sentVersions[it.partitionKey]?.let { v -> it.stateVersion < v } == true }
|
|
|
|
|
|
if (superseded.isEmpty()) break
|
|
|
|
|
|
msgEvents.markAllSent(superseded.mapNotNull { it.eventId })
|
|
|
|
|
|
}
|
|
|
|
|
|
}.onFailure { log.warn("superseded cleanup failed: {}", it.message) }
|
|
|
|
|
|
failures.forEach { retryOrDead(it, it.lastError ?: "send-failed") }
|
2026-09-06 19:08:02 +08:00
|
|
|
|
lastFlush = scheduler.now()
|
2026-09-06 18:19:04 +08:00
|
|
|
|
}
|
|
|
|
|
|
|
2026-09-10 11:14:11 +08:00
|
|
|
|
/** 一条事件发失败之后怎么走:重试次数加一,到上限就标成 DEAD(EXHAUSTED) 留作死信(次数落库便于追查),否则按退避推到下次再发。 */
|
2026-09-09 17:53:08 +08:00
|
|
|
|
private fun retryOrDead(e: MsgEvent, lastError: String) {
|
|
|
|
|
|
val eventId = e.eventId ?: return
|
|
|
|
|
|
val attempts = e.attempts + 1
|
|
|
|
|
|
if (scheduler.exhausted(attempts)) {
|
|
|
|
|
|
msgEvents.markDead(eventId, ErrorClass.EXHAUSTED, lastError, attempts)
|
|
|
|
|
|
} else {
|
|
|
|
|
|
msgEvents.scheduleRetry(eventId, scheduler.nextAttemptAt(attempts), attempts)
|
|
|
|
|
|
}
|
|
|
|
|
|
}
|
|
|
|
|
|
|
2026-09-06 18:19:04 +08:00
|
|
|
|
private fun sleepQuietly(d: Duration) {
|
|
|
|
|
|
if (!d.isNegative && !d.isZero) Thread.sleep(d.toMillis().coerceAtLeast(1))
|
2026-09-06 16:13:50 +08:00
|
|
|
|
}
|
|
|
|
|
|
}
|