Blog·Studio
文章系列日历归档关于搜索
Blog·Studio

一个记录思考、笔记与作品的技术博客。

Connect

© 2026 · Blog Studio

鄂ICP备19019526号

crafted with care

stay curious ✦

📅 9月16日星期三— No.557 —

👋 hi,这里是

my notebook

随手记下关于代码、设计 与日常的一些小想法。

📌 最新

Agent 上下文窗口的动态预算管理与 Token 级配额工程 2026

点击翻看 →

📚 累计

556

已发表

☕ 今日

慢慢写

9月16日

↓ 翻到下一页to be continued...
  1. 文章

Journal

Editorial

随笔、研究与作品 — 一个持续生长的写作实验室。

按标签筛选

全部555AI 日报36AI 编程51Hermes Agent13AI 工具与产品31AI 原生架构96大模型研究97杂项
2
AI 行业趋势22
行业研究0
游戏1
Agent 技术123
智能体与 AI 应用开发71
游戏引擎与渲染4
游戏开发4
游戏服务架构4
  • 01

    Agent 上下文窗口的动态预算管理与 Token 级配额工程 2026

    把上下文窗口当成可观测、可计量、可治理的运行时资源池,用四元组预算 + 滑动回收 + 跨智能体公平队列,让长流程 Agent 在 200K 至 1M 模型下既不因历史膨胀而崩溃,也不因预留不足而输出截断。

    • #Agent 技术
    2026.09.03
  • 02

    Agent 决策链的形式化验证与时序逻辑规约 2026

    把 Agent 决策链放进 Kripke 结构后,LTL/CTL 把“永不犯的错”从经验观察提升为可证明命题;shield 与 runtime monitor 在运行期兜底,CEGAR 反例喂回训练循环。

    • #Agent 技术
    2026.09.03
  • 03

    LLM 推理的能耗感知调度工程 2026:从 PUE 到碳感知路由与绿色推理的统一框架

    把 PUE 感知地理路由、DVFS/动态 batch 的能效曲线、碳感知 defer 窗口三条工程主线沿碳-时-算三维 Pareto 边界滑动,给出可观测性指标、ROI 公式、SLA 反向约束与十项 SRE 可执行清单。

    • #AI 原生架构
    2026.09.02
  • 04

    AI 应用的端到端延迟预算工程 2026:从 P50 切片到 SLO 反向约束的统一架构

    把端到端延迟切成 prefill、decode、检索、网络四个阶段并分配独立预算,把总延迟当作硬约束而非优化目标,叠加流式输出、prefix caching、speculative decoding 与容量规划四项核心工程动作,把 500ms 总预算下的 P99 从开盲盒变成可承诺的 SLO。

    • #智能体与 AI 应用开发
    2026.09.02
  • 05

    思维链压缩的格论与抽象层级形式化 2026

    从偏序集与 Galois 连接出发,把 CoT 推理状态形式化为格、把压缩映射形式化为抽象算子、把抽象层级形式化为格同态与范畴函子,给出 CoT 蒸馏的商格条件与压缩-正确率下界,并落到 5 类可测格不变量。

    • #大模型研究
    2026.09.02
  • 06

    Agent 灰度发布与 A/B 实验工程 2026:从影子到流量分层与决策回路

    把 Agent 的 prompt / 模型 / 工具 / 编排 / 策略五层异构变更统一进影子模式 → 金丝雀 → A/B 实验 → 全量四阶段灰度闭环,并把指标采集 → 质量评估 → 自动回滚当作与发布同等重要的一等公民,才能让 Agent 在生产里真正可演进。

    • #Agent 技术
    2026.09.02
  • 07

    Agent 好奇心驱动的内在动机理论 2026:从 ICM 到信息增益的 KL 几何统一

    把内在动机驱动的探索抽象为预测误差、密度估计、信息增益三个正交维度,通过 KL 散度的几何统一,推导出 Agent 在稀疏奖励场景下从 ICM、RND 到 VIME 的奖励塑形等价性与收敛性边界。

    • #Agent 技术
    2026.09.02
  • 08

    LLM 推理的混合精度调度工程 2026:端到端精度与吞吐的联合优化

    把 LLM 推理的精度选择从选一个全局精度升级为为每个推理路径单独选精度——prefill 走 FP8 linear + BF16 attention,decode 走 FP8 权重 + BF16/FP8 KV cache,logits 强制 FP32;再把这些路径放进一个可观测、可调度、可回滚的端到端优化循环——这是 2026 年生产推理服务的及格线。

    • #AI 原生架构
    2026.09.01
  • 09

    AI 应用的数据飞轮工程 2026:从隐式反馈到 Reward Model 在线更新

    把点赞、复制、regenerate、停留、撤销等用户反应转成对下一版本模型参数或 prompt 模板的可控增量更新;这是一篇关于反馈四元组 + 流式 Reward Model + 三层 Canary + 联邦差分隐私 + 鲁棒训练与反中毒的可监控可回滚闭环工程长文。

    • #智能体与 AI 应用开发
    2026.09.01
  • 10

    大模型坍缩现象的代数几何理论 2026:从神经坍缩到权重空间 blow-up 的统一不变量

    把神经坍缩视为权重空间的 blow-up 奇点,给出三类代数不变量(截面秩亏、Schubert 类积分、Chern 类积分),让训练监控从单一损失曲线升级为实时的几何相位图。

    • #大模型研究
    2026.09.01
  • 11

    Agent 安全护栏 2026:从 Prompt Injection 到审计闭环

    把 Agent 安全防御从「加几句系统提示词」升级为可工程化的四层护栏流水线——输入层 sanitizer、模型层越狱检测、工具层间接注入防御、输出层 PII/敏感数据脱敏——并用 trace 级红队回归与审计日志闭环,7 天 MVP 到 90 天生产级。

    • #Agent 技术
    2026.09.01
  • 12

    Agent 推理范式的形式化收敛性理论 2026

    把 ReAct/Reflexion/ToT/Plan-and-Execute 放进统一 POMDP 框架,从 (H,π,update) 三元组差异给出各范式的边界与失败模式分类,并收敛为可操作的范式选择判别式。

    • #Agent 技术
    2026.09.01
  • 13

    大模型的信息瓶颈理论 2026:从互信息单调压缩到算法信息论结构函数的统一视角

    把大模型学习重写为输入-上下文-提示三层互信息的非单调耦合优化,用 InfoNCE 下界作为可观测代理、用算法信息论结构函数作为形态度量,让 IB 成为几何拓扑动力系统公理化四条主线的垂直度量层。

    • #大模型研究
    2026.08.31
  • 14

    Agent 分布式执行与状态协调工程 2026

    把 Agent 调度当作分布式系统而非单机 LLM 异步队列:用 actor 模型、事件溯源与 CRDT 的分层混合,控制平面走中心化协调器、数据平面走去中心化 actor,让任务因果链、故障域隔离、状态恢复在水平扩展下同时成立。

    • #Agent 技术
    2026.08.31
  • 15

    Agent 持续学习与灾难性遗忘理论 2026

    把灾难性遗忘形式化为 Fisher 信息累积损失,把持续学习重述为稳定性-可塑性 Pareto 边界上的最优轨迹问题,给出 EWC 与经验回放的可执行理论,并把元认知视为 replay 的触发通道。

    • #Agent 技术
    2026.08.31
  • 16

    MoE 推理的专家并行工程 2026:通信、放置与动态批处理的统一框架

    从 All-to-All 通信的拓扑感知优化、专家负载偏斜的自适应控制、capacity factor 的动态调节、显存分层管理到量化精度的精细平衡,系统拆解 MoE 推理的四大工程支柱与生产级落地路径。

    • #AI 原生架构
    2026.08.30
  • 17

    企业 RAG 的权限感知检索工程 2026

    企业 RAG 的权限泄露不是过滤 bug 而是架构缺陷:必须把 ACL 下推进 ANN 检索内部、在分块阶段对齐权限边界、按权限域分片缓存,并用权限退化比与红队回归把正确性锁进 CI。

    • #智能体与 AI 应用开发
    2026.08.30
  • 18

    In-context Learning 的隐式贝叶斯推断与算法学习理论 2026

    把大模型在 prompt 中的少样本学习统一重写为隐式贝叶斯后验推断 + 隐式梯度下降的双重解释,在 PAC-Bayes 边界与算法信息论的复合约束下给出可计算的泛化误差上界,让 ICL 的可泛化能力从经验直觉变成可证伪、可工程优化的理论对象。

    • #大模型研究
    2026.08.30
  • 19

    Agent 工具调用的鲁棒性工程 2026:从错误分类学到指数退避与熔断的实战范式

    当 Agent 工具调用失败不再是偶尔超时而是可被分类、可被预测、可被工程化兜底的常态运行时,只有把错误分类、退避策略、熔断隔离、半失败补偿四件事连成一个可观测闭环,工具调用才能稳定地撑住生产 SLA。

    • #Agent 技术
    2026.08.30
  • 20

    Agent 多智能体协作的机制设计与可计算性理论 2026

    把经典分布式系统的 FLP 不可能性、机制设计的激励相容、以及 LLM 智能体的有界理性三条线索拧成一根绳,用语言介导的协商原语替代显式消息传递,给出在不可靠信道+不可信主体+模糊偏好三重要素并存下,多 Agent 协作可计算、可验证、可定价的统一理论框架。

    • #Agent 技术
    2026.08.30
← 上一页3 / 28
下一页 →