研究框架与规范
下一检查点:给 Scaling 与推理专题补逐篇图表/实验精读层级
PUBLIC LEDGER BUILD IN THE OPEN
这里不把“正在研究”包装成“已经完成”。每个专题显示成熟度、下一检查点和证据边界; 本地 PROGRESS.md 与网站同步维护。
01 WORKSTREAMS
内容首版优先打通全局脉络;随后每轮迭代选择一个专题推进到论文/工程层,并做独立事实复核。
下一检查点:给 Scaling 与推理专题补逐篇图表/实验精读层级
下一检查点:打印样式与更多通用可视化组件
下一检查点:扩写 pre-training / infra 逐图笔记
下一检查点:加入矩阵形状动画与手算练习
下一检查点:加入真实拟合复现、置信区间与更多模型族对照
下一检查点:逐图精读 FineWeb / DCLM,加入真实去重与 mixture traces
下一检查点:补 R1 / DAPO 的逐图训练轨迹与复现对照
下一检查点:真实模型采样曲线、PRM 案例与逐篇图表精读
下一检查点:补充真实集群 traces 与专家特化案例
下一检查点:加入更多论文逐图笔记与真实模型配置对比
下一检查点:补真实集群 traces、故障案例与精确 topology 配置
下一检查点:自动化外链复查与来源等级扩展
下一检查点:每轮保留不可变镜像、提交与回滚点
02 COMPLETED THIS ITERATION
下列项目都能在仓库或网站中直接检查,不是计划项。
总体路线、完成标准、来源等级与进度账本已写入项目。
47 页报告目录、151 条参考来源和架构/后训练/系统主线已经提取。
从语言模型基础到评测安全,包含先修依赖和三条贯穿案例。
响应式导航、章节模板、侧栏、进度、论文链和证据提示组件。
K3、注意力、DeepSeek、长上下文、MoE、推理,以及训练系统、Scaling 与数据工程的多页签实验。
K3、Transformer、DeepSeek、Scaling、数据工程、长上下文、MoE、推理与训练系统专题。
九张账、29 个一手节点、DeepSeek/Kimi 双谱系与曲面—部署—复用—涌现四联实验。
十二张账、31 个一手节点、DeepSeek/Kimi 双谱系与流水线—去重—混合—改写四联实验。
五张成本账、26 篇一手论文、10+ 机制图与 8 策略交互实验室。
六张账、19 篇一手论文、DeepSeek/K3 主线与路由—容量—通信交互实验室。
八张账、30 篇一手论文链、DeepSeek/Kimi 双主线与三页签互动实验室。
九张账、37 个一手节点、DeepSeek/Kimi 双谱系与显存—网格—气泡—通信实验室。
新增数据专题标签和 20 个一手节点,继续支持全文搜索与 Kimi/DeepSeek 聚光主线。
源码公开到 git.k1412.top,网站由不可变镜像、Compose Manager 与 HTTPS 交付。
03 NEXT QUEUE
优先级由 K3 依赖度、初学者断点和论文可验证性共同决定。
真实拟合复现 → 置信区间 → 更多模型族与下游任务外推
可复现实验 + 逐图笔记FineWeb / DCLM 逐图 → 真实去重误伤 → mixture traces 与污染案例
逐图笔记 + 案例库真实集群 traces → 故障恢复 → 精确 topology / kernel 配置
案例库 + 实测边界真实模型配置 → 内核细节 → 长上下文评测与失败案例
配置比较器 + 逐图论文笔记真实负载 traces → 专家特化可解释性 → 共享专家语义
案例库 + 集群证据真实 pass@k 曲线 → PRM 失败案例 → 逐篇图表精读
案例库 + 真实 tracesViT/CLIP → connector VLM → Kimi-VL/MoonViT-V2
视觉 Token 流程图04 QUALITY CONTROL
Grok CLI 用于扩大检索覆盖和找遗漏;任何进入正文的机制、数字与时间仍回到原论文、官方仓库或正式文档。
K3 references、引用网络、Grok/web 检索、作者仓库。
核对标题、版本、公式、表格、实验设置和限制。
直觉、机制、论文证据、工程代价;简化处显式标注。
链接、数字、先修、图文一致性、移动端与可访问性。
05 DECISION LEDGER
更完整的机器可读进度和研究记录位于开源仓库的 ROADMAP.md、PROGRESS.md 与 research/。
K3 是锚点,范围覆盖完整 LLM 技术史。
现象 → 旧瓶颈 → 关键论文 → 后继桥梁 → K3/DeepSeek 落点。
架构图做成可缩放 SVG/HTML,明确简化与来源。
代码 MIT,原创文字与图 CC BY-SA 4.0。
源码公开到 git.k1412.top,网站部署到 k1412 私有基础设施。
把答案、覆盖、选择、过程、预算、优化、分布与系统证据分开核算。
把模型状态、激活、并行、气泡、通信、专家、上下文、数值与可靠性分开核算。
把观测量、模型、数据、算术、配比、配方、外推、经济目标与能力阶段分开核算。
把来源、解析、语言、质量、唯一性、污染、混合、变换、Tokenizer、Packing、课程与价值分开核算。
1264 行正式研究账本只接受回查一手来源后的结论;203 行 Grok 产物保留为未核验发现队列。