Blog·Studio
文章系列日历归档关于搜索
Blog·Studio

一个记录思考、笔记与作品的技术博客。

Connect

© 2026 · Blog Studio

鄂ICP备19019526号

crafted with care

stay curious ✦

  1. 文章
  2. ›大模型研究

Archive

标签「大模型研究」

97 篇文章

切换标签

全部555AI 日报36AI 编程51Hermes Agent13AI 工具与产品31AI 原生架构96大模型研究97杂项2AI 行业趋势22行业研究0游戏1Agent 技术123智能体与 AI 应用开发71游戏引擎与渲染4游戏开发4游戏服务架构4
  • 01

    合成数据训练与坍缩的信息几何理论 2026

    从 Fisher 信息矩阵的退化轨迹出发,把 model collapse 重新理解为生成模型与真实分布之间 KL 散度沿 Fisher-Rao 测地线的相变;给出合成数据 scaling 的临界点公式、三阶段相变判据与工程上的早停、抗 collapse 设计清单。

    • #大模型研究
    2026.09.06
  • 02

    稀疏自编码器与电路发现的统计学习统一理论 2026

    把稀疏自编码器与电路发现统一为残差流激活的稀疏因果分解,几何-信息论-因果三件套训练目标使 SAE 特征成为可干预、可审计、可蒸馏的电路原子,在 7B-13B 模型上已具备工程化训练与红队探针的落地条件。

    • #大模型研究
    2026.09.05
  • 03

暗知识传输的几何统一:从 soft label 到特征子空间

把知识蒸馏的传输通道从概率单纯形升级为 Grassmann 流形,把暗知识从 Hinton 软标签的标量统计扩展到特征子空间的正交基,把学生模仿教师重构为流形间的测地线对齐——为下一代多模态/异构蒸馏提供理论底座。

  • #大模型研究
2026.09.04
  • 04

    后训练阶段的保留-习得张力理论 2026

    把对齐训练中保留预训练知识与习得新偏好的张力,形式化为策略流形上的保留-习得比;证明 GRPO 的 KL 锚点是这条张力 Pareto 前沿的几何稳定锚点。

    • #大模型研究
    2026.09.03
  • 05

    思维链压缩的格论与抽象层级形式化 2026

    从偏序集与 Galois 连接出发,把 CoT 推理状态形式化为格、把压缩映射形式化为抽象算子、把抽象层级形式化为格同态与范畴函子,给出 CoT 蒸馏的商格条件与压缩-正确率下界,并落到 5 类可测格不变量。

    • #大模型研究
    2026.09.02
  • 06

    大模型坍缩现象的代数几何理论 2026:从神经坍缩到权重空间 blow-up 的统一不变量

    把神经坍缩视为权重空间的 blow-up 奇点,给出三类代数不变量(截面秩亏、Schubert 类积分、Chern 类积分),让训练监控从单一损失曲线升级为实时的几何相位图。

    • #大模型研究
    2026.09.01
  • 07

    大模型的信息瓶颈理论 2026:从互信息单调压缩到算法信息论结构函数的统一视角

    把大模型学习重写为输入-上下文-提示三层互信息的非单调耦合优化,用 InfoNCE 下界作为可观测代理、用算法信息论结构函数作为形态度量,让 IB 成为几何拓扑动力系统公理化四条主线的垂直度量层。

    • #大模型研究
    2026.08.31
  • 08

    In-context Learning 的隐式贝叶斯推断与算法学习理论 2026

    把大模型在 prompt 中的少样本学习统一重写为隐式贝叶斯后验推断 + 隐式梯度下降的双重解释,在 PAC-Bayes 边界与算法信息论的复合约束下给出可计算的泛化误差上界,让 ICL 的可泛化能力从经验直觉变成可证伪、可工程优化的理论对象。

    • #大模型研究
    2026.08.30
  • 09

    稀疏自编码器机制可解释性的高阶相关理论 2026

    从单特征稀疏激活到特征电路的二阶统计与高阶累积量——把 LLM 可解释性从一阶语义推进到算法子结构,给出 SAE 训练的 Pareto 改进、电路冗余度猜想与拓扑骨架幂律。

    • #大模型研究
    2026.08.29
  • 10

    RL 训练梯度流的 Wasserstein 几何与策略熵-奖励耦合动力学 2026

    从自然梯度、TRPO、PPO 到 Wasserstein 梯度流,把 RLHF/RLVR 时代的策略优化统一为策略分布空间上的黎曼优化,并给出六个基于几何意义的训练稳定性推论。

    • #大模型研究
    2026.08.28
  • 11

    Mamba 与线性注意力的状态空间统一理论 2026:从对偶递推到选择性遗忘

    把 SSM / linear attention / Mamba / RetNet / RWKV 全部纳入 (A,B,C,D) 对偶线性算子的统一骨架,用 State Space Duality 给出与 softmax attention 的等价类,在 input-dependent 选择性遗忘机制下推到 LTV 系统,并论证 2026 年主流 LLM 架构收敛到 SSM + sparse attention 混合范式的工程必然性。

    • #大模型研究
    2026.08.27
  • 12

    用算力换推理:Test-time Compute 的统计理论

    以 statistical decision theory 为统一框架,把 2024-2025 年兴起的 test-time compute scaling 四大主流范式 (CoT / ToT / PRM / verifier-search) 放进同一张 compute-optimal allocation frontier 图,论证「用算力换推理」是大模型继 pretraining scaling 之后的第二条扩展曲线,其增长边界由 verifier 质量决定而非 base model 容量。

    • #大模型研究
    2026.08.26
  • 13

    自回归与扩散的对偶理论 2026:从对接面到混合调度的统一框架

    把自回归与扩散看作同一状态空间上的 Forward-Backward 对偶,通过对接面映射器、混合误差界与破缺检测,把等价性层面提升到对偶结构层面,为 2026 年混合调度器奠基。

    • #大模型研究
    2026.08.25
  • 14

    扩散语言模型的理论统一 2026:从连续时间扩散到离散 token 生成

    把扩散过程的连续时间演化与离散 token 的 mask-and-replace 机制统一为同一个生成模型族,自回归只是 mask diffusion 在特定归纳偏置下的边界情形;采样步数与生成质量遵循幂律,工程上 confidence-based 调度 + 混合 AR/diffusion 部署是 2026 年的最优策略。

    • #大模型研究
    2026.08.24
  • 15

    扩散语言模型 2026:LLaDA 的等价性与采样步数律

    把连续时间扩散过程与离散 token 自回归统一在随机微分方程的同一形式下,把掩码扩散的去噪过程解释为吸收布朗运动的离散化采样,推导出 LLaDA 类模型生成质量与采样步数之间的幂律标度,并讨论对训练目标、长度泛化和推理加速的工程推论。

    • #大模型研究
    2026.08.23
  • 16

    稀疏 MoE 路由的代数拓扑理论 2026:从 Betti 数到持续同调

    把稀疏 MoE 的专家共激活矩阵编码为 Vietoris-Rips 单纯复形,用持续同调 (persistent homology) 提取 Betti 数与持续图,刻画 β₀ 专家社群、β₁ 循环协同、β₂ 高阶空腔的涌现过程,给出比负载均衡 loss 更早的训练健康度信号与 checkpoint 选择准则。

    • #大模型研究
    2026.08.22
  • 17

    大模型预训练的彩票假设与隐式模块涌现理论 2026

    把彩票假设从十亿参数尺度的存续性、隐式电路的自发涌现、以及训练动力学的相位结构,统一在稀疏相位恢复与统计力学组合优化的视角下,并给出稀疏预训练加早停的工程协议。

    • #大模型研究
    2026.08.21
  • 18

    RLHF 后训练动力学的拓扑几何视角 2026

    把 RLHF 训练动力学放到策略流形的拓扑-几何视角下重写,持续同调能比奖励曲线本身更早识别奖励黑客,联合拓扑熵、奖励-拓扑相关性、Betti 数脉冲三判据构成工业级可观测性指标体系。

    • #大模型研究
    2026.08.20
  • 19

    偏好优化算法的几何统一理论 2026

    把 RLHF 之后的偏好优化算法家族——DPO、IPO、KTO、ORPO、SimPO、GRPO、RLVR——放到同一个损失景观里去看,会发现它们本质上是同一个 Bradley-Terry 对偶目标在参考策略附近的不同切平面投影。本文给出统一形式化与工程决策准则。

    • #大模型研究
    2026.08.19
  • 20

    大模型训练动力学的李雅普诺夫稳定性理论 2026

    把大模型训练动力学重新表述为损失景观上梯度流的李雅普诺夫稳定性,能把收敛这一工程口号变成可被理论验证的命题,并给出对训练监控可直接落地的工程推论。

    • #大模型研究
    2026.08.18
  • ← 上一页1 / 5
    下一页 →