Posts
All the articles I've posted.
-
反作弊与 IVT:竞价拦截、近线回灌与结算扣量
Updated:本文从买方工程视角拆解无效流量(IVT)防御体系,探讨 GIVT 与 SIVT 的差异及与 MFA 的边界。文章呈现了从 Pre-bid 拦截、Render 端防伪、近线回灌到结算扣量的四道闸门,分析各渠道作弊画像。结合 OpenRTB 关键字段,对比自建规则与验证厂商的协同分工边界,提供科学的验收指标,助开发者构建高效反作弊架构。
-
VAST、MRAID与端上引擎:广告渲染协议解析
Updated:在程序化广告交易中,竞胜仅仅是广告流转的半场。本文深度剖析创意渲染与打点环节的核心协议,详述 VAST 的 InLine 与 Wrapper 解析链条、四分位及追踪像素打点时机;回顾 VPAID 痛点与 SIMID 安全演进;解析 MRAID 的容器状态机机制;最后梳理端上引擎架构与 OMID 测量口径,全盘排查不计费与对账偏差的根因。
-
推理服务业界落地:从训练产物到推理服务怎么发布
Updated:写给工程师的推理服务落地:换版最小动作是改一个 URI。产物进对象存储,期望状态进 Git,集群对账后拉起 Triton / vLLM 或 CPU 上的 ONNX / PMML;按平台已有能力决定要不要 KServe,对照 LLM、广告深度 CTR 和 CPU 粗排。
-
推理运行时与服务框架选型:运行环境、服务框架、编排平台怎么分层
Updated:写给工程师的推理服务选型:先把「算、接、活」分成运行环境、服务框架、编排平台,再按场景填上常见实现——LLM 对话、广告深度 CTR、轻量打分各走哪一层。变慢时按队列、副本、引擎排查,而不是拿不同层的工具直接比。
-
模型文件格式分类与选择:.pt / SavedModel / ONNX / safetensors / GGUF / TensorRT / PMML 到底怎么选
Updated:写给工程师的模型文件格式选型:权重、计算图、元数据各是什么;只有权重时用 config.json 搭空壳,有图仍可能要 sidecar 做分词和预处理。再按给谁跑选择 checkpoint、safetensors、ONNX、GGUF、TensorRT 或 PMML。