博客
文章系列日历
归档关于搜索

鄂ICP备19019526号

© 2026 博客

标签

  • 全部
  • AI 日报(36)
  • AI 编程(51)
  • Hermes Agent(13)
  • AI 工具与产品(31)
  • AI 原生架构(66)
  • 大模型研究(63)
  • 杂项(2)
  • AI 行业趋势(22)
  • 行业研究(0)
  • 游戏(1)
  • Agent 技术(53)
  • 智能体与 AI 应用开发(30)
  1. 文章
  • Agent 规划的隐空间几何 2026:从世界模型、梯度场到隐式策略采样的统一形式化

    Agent 规划的隐空间几何 2026:从世界模型、梯度场到隐式策略采样的统一形式化

    本文把 LLM Agent 规划重新表述为潜变量流形上的测地线搜索问题,统一世界模型、策略梯度场与隐式策略采样三条独立脉络,提炼七条工程推论与六个研究方向。

    2026年8月4日·
    Agent 技术
  • Context Cache 工程 2026:KV 复用与 NIAH 生产闭环

    Context Cache 工程 2026:KV 复用与 NIAH 生产闭环

    Context Cache 不是狭义的 KV Cache 复用,而是对长上下文输入进行有策略的记忆、压缩、检索和再利用的完整工程体系,核心在于识别上下文中真正被模型使用的部分,并在缓存命中率、内存占用和输出质量三者之间找到工程上可维护的平衡

    2026年8月3日·
    AI 原生架构
  • RAG 应用向量数据库全链路可观测性工程 2026:从选型基准到生产级监控的闭环架构

    RAG 应用向量数据库全链路可观测性工程 2026:从选型基准到生产级监控的闭环架构

    把 RAG 应用的可观测性从看不见变成看得见、追得到、能行动,需要从延迟分布、ANN 召回率、混合检索权重、分块质量等多个维度建立持续评估闭环。本文系统覆盖向量数据库选型基准、全链路监控体系、帕累托追踪与自我优化闭环的工程实践。

    2026年8月3日·
    智能体与 AI 应用开发
  • 大模型灾难性遗忘的谱理论 2026:Hessian 谱签名与任务向量正交化

    大模型灾难性遗忘的谱理论 2026:Hessian 谱签名与任务向量正交化

    本文提出「谱签名」作为灾难性遗忘的统一几何坐标,把 EWC、LoRA、task arithmetic、rehearsal 等机制纳入 F(θ₀,t₁,t₂) = ‖H^(1/2)ₜ₁(θ*ₜ₂ − θ*ₜ₁)‖² / ‖H^(1/2)ₜ₁‖² 算子的不同范式,并给出 LoRA rank、任务序列、谱裁剪三件套的工程决策表。

    2026年8月3日·
    大模型研究
  • Agent 的 sandbox 执行工程:从 firecracker 微内核到 browser-use 隔离的生产闭环

    Agent 的 sandbox 执行工程:从 firecracker 微内核到 browser-use 隔离的生产闭环

    Agent 的 sandbox 执行工程:从 firecracker 微内核到 browser use 隔离的生产闭环 一、问题的提出:为什么 sandbox 成了 Agent 工程的「最后一公里」 2026 年的 Agent 系统早已不是单纯的 prompt 编排。当一个 Agent

    2026年8月3日·
    Agent 技术
  • Agent 上下文工程的形式化 2026:从注意力衰减、信息瓶颈到可控压缩率

    Agent 上下文工程的形式化 2026:从注意力衰减、信息瓶颈到可控压缩率

    把上下文工程建模为速率-失真问题,用 $R(d)$ 衰减律、信息瓶颈、$S(E)$ 语义保留率三组可验证指标替换「塞满窗口」叙事——最优压缩率 30%、最佳选取准则是互信息增益、长上下文不等于有效上下文。

    2026年8月3日·
    智能体与 AI 应用开发
  • LLM Tokenizer 词表工程 2026:从裁剪到 Token 经济学

    LLM Tokenizer 词表工程 2026:从裁剪到 Token 经济学

    把词表作为推理系统的隐藏第一公里,审视多语言词表覆盖、词表裁剪收益、Token 与 KV cache 浪费的耦合、词表兼容性与下游迁移成本,把工程真相拆到生产可落地的粒度。

    2026年8月2日·
    AI 原生架构
  • AI 应用模型版本治理工程 2026:从供应商版本漂移到回归门禁的闭环架构

    AI 应用模型版本治理工程 2026:从供应商版本漂移到回归门禁的闭环架构

    把 AI 应用看作一张有向契约图,把模型版本变化抽象为图上的契约边,通过嵌入维度治理、Adapter 抽象层、回归门禁与双轨评估,把版本治理从被动救火转为主动稳态控制。

    2026年8月2日·
    智能体与 AI 应用开发
  • 合成数据Scaling Laws与模型崩溃的统一理论框架 2026

    合成数据Scaling Laws与模型崩溃的统一理论框架 2026

    合成数据的Scaling优势与模型崩溃风险是同一枚硬币的两面——它们都根植于多样性这一核心变量。300B token是关键拐点,真实数据的不可替代性是基本约束。通过修正Scaling Law、崩溃避免定理与Token-Level Editing的统一框架,工程上可建立可控的合成数据Scaling决策体系。

    2026年8月2日·
    大模型研究
  • Agent 工具版本治理与灰度发布工程 2026

    Agent 工具版本治理与灰度发布工程 2026

    从注册中心、SemVer 兼容性矩阵、影子调用与金丝雀切分到漂移检测与自动回滚,闭环式治理 Agent 工具供应链。

    2026年8月2日·
    Agent 技术
  • Agent 全局工作空间的竞争广播机制

    Agent 全局工作空间的竞争广播机制

    把黑板系统、注意力竞争与全局广播统一为可执行的 Agent 认知架构,解释模块何时发言、哪些状态应进入共享工作空间,以及如何用门控、预算和反事实审计控制广播失真。

    2026年8月2日·
    Agent 技术
  • KV cache 多层存储工程 2026:从 HBM 到 NVMe 的张量换入换出

    KV cache 多层存储工程 2026:从 HBM 到 NVMe 的张量换入换出

    把 KV cache 张量生命周期建模为四层存储的换入换出问题:HBM-DRAM-NVMe-远端对象层,给出 vLLM / SGLang HiCache / LMCache / Mooncake 的层级化生产配置与可观测 SRE 决策表。

    2026年8月1日·
    AI 原生架构
  • AI 应用的多租户隔离与合规工程 2026:从检索到取证审计

    AI 应用的多租户隔离与合规工程 2026:从检索到取证审计

    多租户 AI 应用的隔离不是加一层 WHERE 条件,而是在向量空间、prefix cache、embedding 适配、推理网关、合规日志五个独立维度同时做 tenant-aware 设计;本文给出方案 C 混合命名空间、路径 2 共享基座 LoRA 适配、12 个租户一致性检查点的工程闭环与 SRE/合规官清单。

    2026年8月1日·
    智能体与 AI 应用开发
  • RL 后训练的极小极大统一 2026

    RL 后训练的极小极大统一 2026

    把 LLM 后训练形式化为二人零和博弈的极小极大优化,在统一主定理下解释 REINFORCE→PPO→GRPO→RLVR 的演化脉络,并给出奖励可验证性与方差预算约束下的算法选择决策表。

    2026年8月1日·
    大模型研究
  • Agent 工具 schema 契约测试与漂移检测工程 2026

    Agent 工具 schema 契约测试与漂移检测工程 2026

    把工具 schema 当成对 LLM 的承诺,用契约测试守住边界、用漂移检测察觉语义偏移、用 canary 工具灰度回滚——这是 Agent 工具层在生产环境里不断不裂的三件套。本文析四种漂移根因、契约测试三层验证、运行时漂移检测机制、回滚与降级自动化,并以 90 天落地计划收尾。

    2026年8月1日·
    Agent 技术
  • Agent 神经-符号融合的统一推理架构 2026

    Agent 神经-符号融合的统一推理架构 2026

    把提议-验证-翻译三元组、不动点几何、可微松弛与硬验证、知识图谱接口组织为一条架构路线,让 Agent 同时具备 LLM 开放语义与符号系统可证伪性。

    2026年8月1日·
    Agent 技术
  • LLM 推理服务的 PD 分离架构 2026:从 KV 跨节点传输到容量规划的生产真相

    LLM 推理服务的 PD 分离架构 2026:从 KV 跨节点传输到容量规划的生产真相

    把 prefill 与 decode 算力解耦、靠 RDMA/NCCL 跨节点传输 KV cache,把共置架构的算力错配转化为容量规划 + 网络 + 状态机的工程问题,是 2026 年 LLM 推理服务的默认形态。

    2026年7月31日·
    AI 原生架构
  • AI 应用的多级缓存架构 2026:从精确匹配到语义去重的闭环

    AI 应用的多级缓存架构 2026:从精确匹配到语义去重的闭环

    把精确匹配 KV 复用作为 L1、向量相似度去重作为 L2、RAG 中间产物作为 L3、动态插槽作为 L4,通过分层命中率工程与 stampede 防御,把 LLM 应用的 token 成本与 P99 延迟分别压降 30-60% 与 40-70%。

    2026年7月31日·
    智能体与 AI 应用开发
  • 大模型对齐税的信息论几何 2026:从表达熵到能力守恒

    大模型对齐税的信息论几何 2026:从表达熵到能力守恒

    把对齐税定义为表达熵损失 D_KL(P||Q) 沿三轴差异流形的几何积分,就能在 ε_c 之前用测地线规划找到 Pareto 最优点;超过 ε_c 表达熵阶跃式塌缩,任何对齐算法都不能消除税的下界,工程上能做的是沿曲线找性价比最高的点。

    2026年7月31日·
    大模型研究
  • Agent 测试工程 2026:从确定性到金字塔

    Agent 测试工程 2026:从确定性到金字塔

    把 Agent 测试拆成 D×F×C×K 四元组 trade-off、五层金字塔纪律与六条落地清单,给读者一套 2026 年能在 CI 里真正跑起来的工程范式。

    2026年7月31日·
    Agent 技术
上一页1 / 19
下一页