博客
文章系列日历
归档关于搜索

鄂ICP备19019526号

© 2026 博客

标签

  • 全部
  • AI 日报(36)
  • AI 编程(51)
  • Hermes Agent(13)
  • AI 工具与产品(31)
  • AI 原生架构(61)
  • 大模型研究(58)
  • 杂项(2)
  • AI 行业趋势(22)
  • 行业研究(0)
  • 游戏(1)
  • Agent 技术(45)
  • 智能体与 AI 应用开发(24)
  1. 文章
  • Agent 的 DAG 工作流引擎与分布式任务图调度工程 2026

    Agent 的 DAG 工作流引擎与分布式任务图调度工程 2026

    把 Temporal 持久化状态机、Airflow ETL 遗产、Prefect/Dagster 资产中心、Ray 分布式 actor 四派横比,落地六件套选型决策框架。

    2026年7月30日·
    Agent 技术
  • Agent 任务分解与子目标生成的层次化理论 2026

    Agent 任务分解与子目标生成的层次化理论 2026

    从 HTN 的递归分解、子目标可达性定理到 Plan-and-Execute 的反馈闭合,再到范畴论极限对象的统一视角,本文为长程 Agent 的工程可扩展性建立一个可验证、可学习、可监控的形式化基础。

    2026年7月30日·
    Agent 技术
  • LLM 前缀缓存语义工程 2026:自动缓存与命中率治理的闭环架构

    LLM 前缀缓存语义工程 2026:自动缓存与命中率治理的闭环架构

    把前缀缓存从精确 hash 提升到语义近似、从单请求优化扩展到跨租户治理、从经验调参升级为 SLO 驱动的命中率工程——通过 chunk hashing + 三级 tiering + 语义放大 + 失效模式治理的四阶段闭环,把 LLM 推理的 TCO 推向新水位。

    2026年7月29日·
    AI 原生架构
  • AI 应用的质量护栏与安全工程 2026:四层闭环架构

    AI 应用的质量护栏与安全工程 2026:四层闭环架构

    把离线演化基准、在线因果反馈、运行时分层护栏与红队持续对抗组成并联回路,每层承认不完美、每层为另一层兜底,并以预设剧本与健康度指标维持整个系统的演化。

    2026年7月29日·
    智能体与 AI 应用开发
  • 对抗鲁棒性的形式化:从对抗样本拓扑到特征对齐几何的统一理论 2026

    对抗鲁棒性的形式化:从对抗样本拓扑到特征对齐几何的统一理论 2026

    把对抗鲁棒性重新定义为边界流形的函子结构,统一对抗训练、特征对齐、随机平滑三类方法,给出可证伪猜想与七条工程推论。

    2026年7月29日·
    大模型研究
  • Agent 故障自愈工程 2026:从故障检测到自动化恢复的生产闭环

    Agent 故障自愈工程 2026:从故障检测到自动化恢复的生产闭环

    Agent 故障自愈是生产落地的关键能力——通过分层检测(基础设施/工具/模型层)、状态机驱动的决策机制与多级恢复策略,Agent 系统可在无人工介入下自动应对常见故障,同时通过 Human-in-the-Loop 保障安全边界,实现从原型到生产的高可用跨越。

    2026年7月29日·
    Agent 技术
  • Agent 工具调用选择的学习动力学与不确定性几何

    Agent 工具调用选择的学习动力学与不确定性几何

    把工具选择形式化为分布流形上的动力学系统,刻画训练时熵塌缩相变与推理时不确定性几何,统一探索—利用与置信校准,给出 6 条可执行的工程诊断与可观测性建议。

    2026年7月29日·
    Agent 技术
  • LLM 推理的 NVLink 拓扑感知调度工程 2026:从域内亲和到 TP 决策的真相

    LLM 推理的 NVLink 拓扑感知调度工程 2026:从域内亲和到 TP 决策的真相

    把 NVLink 域内亲和作为调度硬约束、把 PCIe 跨域带宽作为软约束、把 HBM3e 容量作为长约束、把 Tensor Parallel 切分作为可调旋钮,通过拓扑感知调度器把 tensor-parallel、pipeline-parallel、expert-parallel 三轴映射到物理拓扑上,把 LLM 推理的跨节点吞吐推上一个台阶。

    2026年7月28日·
    AI 原生架构
  • AI 应用的灰度发布工程 2026:从 canary 到实验护栏的闭环

    AI 应用的灰度发布工程 2026:从 canary 到实验护栏的闭环

    AI 应用的灰度发布不是传统软件灰度的简单复用,而是一套面向 LLM 输出不确定性、质量多维度、回滚高成本、指标延迟性这四大差异的全新决策闭环——通过 canary + shadow + 三层护栏 + Bayesian Sequential Testing 的组合,把新版本风险暴露控制在 1% 以内。

    2026年7月28日·
    智能体与 AI 应用开发
  • 重整化群视角下的大模型训练动力学 2026

    重整化群视角下的大模型训练动力学 2026

    从凝聚态物理借来 Wilson 的重整化群算子,把预训练粗粒化、SFT/DPO 微扰展开、test-time compute 反向重正化、reward hacking 临界现象串成统一视角,给出七条工程推论与三个待验证猜想。

    2026年7月28日·
    大模型研究
  • Agent 成本归因与计费工程 2026

    Agent 成本归因与计费工程 2026

    把 Agent 的每一条 LLM 调用、工具调用、缓存命中、副作用执行都纳入带租户标签的可计费可观测性图,并打通到 Snowflake/Stripe metering 的产品级闭环,是 Agent 平台从烧钱 demo 走向商业产品的成本工程分水岭。

    2026年7月28日·
    Agent 技术
  • Agent 可解释性电路理论 2026:从注意力归因到行为干预的统一框架

    Agent 可解释性电路理论 2026:从注意力归因到行为干预的统一框架

    把注意力 rollout 定位、激活补丁验证、行为干预证伪的三层归因方法,沉淀为 Agent 生产环境的可观测性基础设施——从单次前向的 mechanistic interpretability 跨越到多步决策链的可干预因果结构。

    2026年7月28日·
    Agent 技术
  • 推测解码的工程真相 2026:从 Draft Model 到生产 KV 复用的全栈拆解

    推测解码的工程真相 2026:从 Draft Model 到生产 KV 复用的全栈拆解

    把 Tree Attention 当作草稿、把 Acceptance Rate 双峰作为调度信号、把 KV Reuse Ratio 作为显存放大器,通过 draft 选型四象限 + 动态 γ/w + 自动 fallback 三件套,把推理加速比从 1.8x 推上 3.0x 同时保持 P99 延迟不爆。

    2026年7月27日·
    AI 原生架构
  • AI 应用的引用精度工程 2026:从反事实可证伪到四层架构

    AI 应用的引用精度工程 2026:从反事实可证伪到四层架构

    把 RAG 引用从文本标签提升为可证伪归因算子,沿 chunk-level 反查、sentence-level 锚定、claim-level 可证伪、falsification-driven 闭环四层递进,覆盖金融、医疗、法律等高风险场景的 evidence-grade 引用工程。

    2026年7月27日·
    智能体与 AI 应用开发
  • COCoT 2026:隐空间推理的范式跃迁

    COCoT 2026:隐空间推理的范式跃迁

    把推理从离散 token 链搬到连续隐空间流,在信息论上消除语言化压缩瓶颈、在几何上统一 token 级 CoT 与隐空间推理的对偶、在工程上重写 test-time scaling 的 Pareto 前沿——COCoT 是 2026 年推理范式跃迁的关键候选。

    2026年7月27日·
    大模型研究
  • Agent 流式响应与中断恢复工程 2026:从 HLC 时钟到 Cost-Aware 早停的生产闭环

    Agent 流式响应与中断恢复工程 2026:从 HLC 时钟到 Cost-Aware 早停的生产闭环

    Agent 流式响应的工程本质是在不确定延迟、不稳定网络和有限预算三重约束下,通过 HLC 时钟保障全序、通过幂等令牌保障恢复、通过 Cost-Aware 早停保障资源效率——三者的协同设计构成生产级流式 Agent 系统的可靠性基座。

    2026年7月27日·
    Agent 技术
  • Agent 决策机制的可解释性理论 2026:从电路发现、激活补丁到行为干预的统一框架

    Agent 决策机制的可解释性理论 2026:从电路发现、激活补丁到行为干预的统一框架

    把 Agent 决策链当作可微程序,在电路发现、激活补丁、行为干预三个互补视角下,沿决策流形的路径积分统一形式化,得到一张对生产可观测性与训练数据多样性都直接可操作的电路拓扑图,但必须正视假阴性陷阱与电路漂移,否则可解释性会从洞察变成错觉。

    2026年7月27日·
    Agent 技术
  • 多 LoRA 推理工程 2026:分桶、KV 隔离与 SRE 闭环

    多 LoRA 推理工程 2026:分桶、KV 隔离与 SRE 闭环

    把多 LoRA 推理服务视为受张量存储、KV 隔离、多 SLO 三重约束下的在线调度问题,通过 PEFT 微架构分层、L_max 容量公式、adapter-aware KV scheduler 与租户级成本归因,构建 2026 年生产可用的多租户 LLM 推理工程闭环。

    2026年7月26日·
    AI 原生架构
  • RAG 应用的离线评估工程 2026:从合成查询、参考答案到三件套回归门禁的闭环架构

    RAG 应用的离线评估工程 2026:从合成查询、参考答案到三件套回归门禁的闭环架构

    把改 RAG 的不确定性从上线后前置到 PR 之前——靠合成 query + 参考答案 + context precision/recall/faithfulness 三层指标 + 多 LLM 双盲 + 回归门禁矩阵构筑改 A 不打坏 B 的工程闭环。

    2026年7月26日·
    智能体与 AI 应用开发
  • 大模型涌现能力的相变标度律 2026:从有限尺寸标度到临界指数普适性的统一形式化

    大模型涌现能力的相变标度律 2026:从有限尺寸标度到临界指数普适性的统一形式化

    把大模型的能力涌现视为统计力学的有限尺寸相变,用 Fisher 标度假设与临界指数给出可证伪的统一框架,把 emergent abilities 现象统一到 Wilson-Fisher 不动点的 RG flow 语言里。

    2026年7月26日·
    大模型研究
上一页1 / 18
下一页