博客
文章系列日历
归档关于搜索

鄂ICP备19019526号

© 2026 博客

标签

  • 全部
  • AI 日报(36)
  • AI 编程(51)
  • Hermes Agent(13)
  • AI 工具与产品(31)
  • AI 原生架构(70)
  • 大模型研究(68)
  • 杂项(2)
  • AI 行业趋势(22)
  • 行业研究(0)
  • 游戏(1)
  • Agent 技术(62)
  • 智能体与 AI 应用开发(34)
  1. 文章
  • 扩散语言模型的离散-连续桥接理论 2026:从吸收态、分数匹配到自回归等价性的统一形式化

    扩散语言模型的离散-连续桥接理论 2026:从吸收态、分数匹配到自回归等价性的统一形式化

    当语言建模从离散 token 的自回归过程迁移到连续时间扩散过程,真正的范式跃迁不在“如何去噪”,而在“如何定义吸收态、定义前向-反向过程的对偶、定义去噪得分匹配与自回归似然的等价性”——本文用 CTMC 与吸收态理论,把扩散语言模型的训练目标、采样动力学、与自回归的桥接关系,统一在“离散-连续桥接”的范畴下。

    2026年8月8日·
    大模型研究
  • Agent 工具调用的超时熔断与幂等性工程 2026:从保险丝语义到生产闭环

    Agent 工具调用的超时熔断与幂等性工程 2026:从保险丝语义到生产闭环

    把超时熔断与幂等性放在同一个副作用预算框架里讨论,从 HLC deadline 到熔断家族再到 fingerprint 持久化,给出可落地的六层防御清单。

    2026年8月8日·
    Agent 技术
  • Agent 的范畴论与类型论统一抽象 2026:从行为态射到协议函子的形式化语义

    Agent 的范畴论与类型论统一抽象 2026:从行为态射到协议函子的形式化语义

    把 agent 系统建模为范畴,行为作为态射、上下文作为自然变换、协议作为伴随函子、资源作为线性类型——五件工具箱共同把 agent 工程从经验工程提升为形式化工程。

    2026年8月8日·
    Agent 技术
  • LLM 推理公平性调度工程 2026

    LLM 推理公平性调度工程 2026

    把单分位 P99 优化推到多分位 SLO + 多租户 Token-Level Fair Queue + 抢占语义与背压的联合设计,以 SLO Compliance Ratio、Jain's Fairness Index、Type Fairness Ratio 三件度量与一个统一的容量规划公式,给出生产侧可复用的判定与治理闭环。

    2026年8月7日·
    AI 原生架构
  • 端侧 LLM 工程 2026:从 WebGPU、量化到端云协同的统一真相

    端侧 LLM 工程 2026:从 WebGPU、量化到端云协同的统一真相

    把量化、WebGPU/Metal 运行时、端云协同、可观测性、隐私合规五件套拼成一个工程子系统,2026 年端侧 LLM 已经从演示特性走向可承载真实生产流量的产品基建。

    2026年8月7日·
    智能体与 AI 应用开发
  • MoE 路由理论的形式化 2026:从辅助损失到容量感知

    MoE 路由理论的形式化 2026:从辅助损失到容量感知

    把 MoE 路由从工程启发式提升为带约束的优化问题,沿着辅助损失、专家正交、容量感知三个里程碑重新叙述这条主线,并以 DeepSeek-V3 与 Qwen3-MoE 的实测作为对照。

    2026年8月7日·
    大模型研究
  • Agent 结构化输出解析工程 2026:从 JSON Schema 到生产鲁棒性

    Agent 结构化输出解析工程 2026:从 JSON Schema 到生产鲁棒性

    把 LLM 输出当不可信输入看待,围绕 schema 验证、解析降级、重试退避、模型分级、可观测性与回归门禁五个层级,让 Agent 工具调用从能用走向敢用。

    2026年8月7日·
    Agent 技术
  • Agent 元认知的置信度校准与误差归因理论 2026

    Agent 元认知的置信度校准与误差归因理论 2026

    把置信度校准、误差归因、自评估可靠性建模统一在贝叶斯证据累积与信息瓶颈的数学对象下,给出 Agent 元认知四元组与六条可工程化推论。

    2026年8月7日·
    Agent 技术
  • LLM 推理请求级能耗预算工程 2026

    LLM 推理请求级能耗预算工程 2026

    把每次大模型请求视为带有质量、延迟与能源约束的资源交易,建立从 Token 功耗计量到绿色调度、可观测性和回滚治理的生产闭环。

    2026年8月6日·
    AI 原生架构
  • AI 应用可观测性商业产品平台工程 2026

    AI 应用可观测性商业产品平台工程 2026

    把 trace 四元组、span 层级、cost 归因、eval 闭环作为最小抽象,从 OpenTelemetry+OpenLLMetry+GenAI semconv 三条标准化线索,到 LangSmith/Langfuse/Helicone/Phoenix/Arize 五家产品工程真相,落到自托管 vs SaaS 决策树与给 SRE 的可观测性清单。

    2026年8月6日·
    智能体与 AI 应用开发
  • 测试时计算作为离散路径积分 2026:从 CoT、自一致性到最佳推理深度的费曼统一

    测试时计算作为离散路径积分 2026:从 CoT、自一致性到最佳推理深度的费曼统一

    把 LLM 的测试时计算重建为离散路径积分——CoT、自一致性、Beam Search、PRM 树搜索是该积分的四种截断阶近似,统一于作用量 S 与配分函数 Z 的离散 Wick 旋转结构。

    2026年8月6日·
    大模型研究
  • Agent 人工介入与升级策略工程 2026:从触发边界、证据包到安全接管的闭环架构

    Agent 人工介入与升级策略工程 2026:从触发边界、证据包到安全接管的闭环架构

    生产 Agent 的人工介入不是简单的审批按钮,而是一套覆盖不确定性量化、状态机租约、并发安全与反馈闭环的系统工程。升级策略的工程化是 2026 年 Agent 落地的核心技术挑战。

    2026年8月6日·
    Agent 技术
  • Agent 因果表征学习 2026:从干预不变性到反事实决策的统一理论

    Agent 因果表征学习 2026:从干预不变性到反事实决策的统一理论

    当 Agent 需要在分布漂移、奖励黑客、长链路信用稀释中保持稳健决策时,纯统计学习得到的关联表征会反复失效;只有把因果结构作为归纳偏置注入表征学习与决策回路,才能让 Agent 拥有真正的反事实推理能力——本文沿 SCM、do-算子、可识别性、反事实回放四条主线,给出一个从表征到决策的因果化统一框架。

    2026年8月6日·
    Agent 技术
  • LLM 推理服务的弹性伸缩与冷启动工程 2026

    LLM 推理服务的弹性伸缩与冷启动工程 2026

    把冷启动拆成六阶段流水线、把弹性伸缩纳入 L、W、S、C 四元组、把 Warm Pool 与 Spot 实例按业务 SLO 组合,通过 CUDA graph 缓存、KEDA LLM-aware autoscaler、graceful drain、GPU circuit breaker 五件套,把 LLM 推理服务的资源池动态行为推上一个台阶。

    2026年8月5日·
    AI 原生架构
  • AI 原生 UX 模式的工程化 2026

    AI 原生 UX 模式的工程化 2026

    把流式输出、结构化输出、可中断、可编辑、可逆、可观测六类原语装配到前端工程里,从 streaming 协议、partial JSON 解析、CRDT 编辑器到失败恢复策略,构建从 PoC 到规模化的 AI 应用 UX 闭环。

    2026年8月5日·
    智能体与 AI 应用开发
  • 位置编码的谱理论 2026:从 RoPE 外推到 ALiBi 衰减的几何统一

    位置编码的谱理论 2026:从 RoPE 外推到 ALiBi 衰减的几何统一

    把 RoPE 相位编码、ALiBi 低通滤波、绝对编码离散频率统一为对注意力内积的频率滤波器,外推性等价于滤波器在未训练频段的衰减率是否可压缩——这一谱视角解释 LLaMA-2 选 ALiBi、LLaMA-3 回归 RoPE 的工程选择,为下一代内容相关位置编码提供设计原则。

    2026年8月5日·
    大模型研究
  • Agent 状态快照与会话热迁移工程 2026

    Agent 状态快照与会话热迁移工程 2026

    状态快照与会话热迁移通过分层序列化、Pre/Post-Copy混合策略、幂等性协议和混沌验证四大核心机制,让长时间跨度的复杂Agent任务在生产环境中实现故障无感接续和跨节点无缝迁移。

    2026年8月5日·
    Agent 技术
  • Agent 长链路决策的信用分配理论 2026

    Agent 长链路决策的信用分配理论 2026

    把信用分配作为长链路 Agent 决策的心脏病问题,以优势函数、回报分解、反事实归因三范式为骨架,提出双层优势传播、Shapley 嵌入缓存、互信息稀疏性三件套作为 2026 年下半年可工程落地的统一求解器,并给出五条工程推论与三个研究方向。

    2026年8月5日·
    Agent 技术
  • LLM 推理的训练-推理一致性工程 2026:从算子融合、激活回收到位元保真的生产闭环

    LLM 推理的训练-推理一致性工程 2026:从算子融合、激活回收到位元保真的生产闭环

    把训练-推理不一致拆解成算子融合、激活数值与 KV 布局三类通道,引入位元保真上限,通过双路径对照、per-layer skew、长 context PPL 矩阵与跨 GPU 厂商审计四条工程闭环,把 skew 从偶发事故转成 SRE 的常态化治理能力。

    2026年8月4日·
    AI 原生架构
  • AI 应用的实时数据接入与 RAG 新鲜度工程 2026

    AI 应用的实时数据接入与 RAG 新鲜度工程 2026

    把 CDC 流式 ETL、增量嵌入、版本化索引与时窗化检索组装成一条端到端 freshness 链,把 80% 内容过时导致的 RAG 质量投诉转为可观测、可告警、可回滚的生产事件。

    2026年8月4日·
    智能体与 AI 应用开发
上一页1 / 20
下一页