讲清楚

原理讲解

从零讲清一个系统或机制的原理,配图为主

面向没有背景的读者解释架构与机制,用类比和图解代替公式堆砌。适合承接长期搜索需求,也是把云架构、流媒体、大数据这些既有积累继续变现为流量的入口。

30 篇文章

AI 与 Agent

提示缓存(一):到底缓存了什么

prompt caching 省下的不是网络往返,而是 prefill 阶段的算力。本文讲清 KV cache 从哪来、前缀哈希为什么要求逐 token 一致、TTL 为什么必须存在,以及缓存写入为什么会比不缓存更贵。

AI 与 Agent

提示缓存(三):开了却没命中,怎么查

提示缓存失效几乎不报错——推理成功、日志干净、只有账单变贵。本文按出现频率拆四类元凶:前缀混进易变内容、序列化顺序抖动、工具顺序不稳、中间层静默吞掉缓存标记,并给出一个跨厂商的命中率自检脚本。

拆解 Kimi K3 的两大架构支柱:KDA 与 AttnRes,讲到小白也能懂
AI 与 Agent

拆解 Kimi K3 的两大架构支柱:KDA 与 AttnRes,讲到小白也能懂

零基础友好、全程打比方:KDA 把'开卷翻书'的注意力改成'一页高级小抄',显存省 75%、百万 token 解码快 6.3 倍;AttnRes 把'流水账'残差流改成'带目录的笔记本',训练效率 +25%、开销不到 2%。看完就知道 2.8T 是怎么撑起来的。

云架构

GPU 通信技术全景:从 PCIe、NVLink 到 RDMA、EFA 与 NCCL

训练大模型时,通信会取代计算成为瓶颈。这篇文章把 GPU 互联的整条链路一次讲透:PCIe 的事务模型与 BAR、NVLink/NVSwitch 的全互联与在网规约、AMD Infinity Fabric、RDMA/InfiniBand 的 QP 与内存注册、RoCE 的无损以太网三件套、AWS EFA 的 SRD 多路径喷洒、GPUDirect 如何消除 CPU 拷贝,以及 NCCL 如何调度这一切。

VOD 深度剖析(一):视频基础——视频到底是什么?
流媒体

VOD 深度剖析(一):视频基础——视频到底是什么?

VOD 流媒体系列(共 12 篇)的开篇之作。从字节层面理解视频究竟是什么——像素、分辨率、帧率、码率、I/P/B 帧、GOP、色彩空间与 HDR。

流媒体

VOD 深度剖析 第 10 篇:QoE 指标 —— 如何衡量用户真实的观看感受

QoE 与 QoS 的区别、六大核心指标(VST、RBR、VSF、EBVS、VPF、平均码率)、数据管道、多维度下钻、故障排查案例,以及自建还是采购的抉择。

流媒体

VOD 深度剖析 第 11 部分:端到端工作流——从上传到播放

完整的 10 步 VOD 生产流水线:上传、内容审核、探测、转码、封装、发布、CDN 预热,以及使用 Step Functions 和 Temporal 进行编排、灾难恢复。

流媒体

VOD 深度剖析第 12 部分:在 AWS 上构建 VOD —— 服务、架构与成本

完整的 AWS VOD 参考:MediaConvert、MediaPackage、CloudFront、S3、Step Functions、SPEKE DRM 集成、Terraform IaC、真实成本拆解、常见陷阱,以及一份生产落地路线图。

流媒体

VOD 深度剖析(二):视频编解码器 —— 为什么一部 4K 电影只需 5 GB

视频压缩的工作原理、为什么 H.264 至今仍占主导、何时选择 H.265 或 AV1、逐标题编码、VMAF 质量指标,以及可上手实操的 ffmpeg 示例。

流媒体

VOD 深度解析 第 3 部分:音频基础 —— 让声音变小

深入理解数字音频的工作原理:采样率、位深、声道、AAC 对比 Opus 对比 Dolby Atmos、多语言音轨、响度归一化,以及实用的 ffmpeg 配方。

流媒体

VOD 深度剖析(四):容器格式 —— .mp4 并不是编解码器

容器与编解码器的区别、MP4 内部结构(Box 结构)、faststart 陷阱、分片 MP4、用于统一 HLS 与 DASH 的 CMAF、分片时长权衡,以及字幕格式。

流媒体

VOD 深度剖析(五):流媒体协议——HLS 和 DASH 到底是怎么工作的

为什么渐进式下载会失败、HLS 两级清单和 DASH MPD 如何工作、CMAF 双清单最佳实践、面向低延迟的 LL-HLS,以及何时该考虑 WebRTC。

流媒体

VOD 深度剖析(六):自适应码率——播放器如何自动切换清晰度

深入解析 ABR 的底层原理:基于吞吐量、基于缓冲区(BBA)、BOLA、MPC 以及 Pensieve 算法。并给出码率阶梯与短视频场景的实用工程建议。

流媒体

VOD 深度剖析(七):CDN 分发 —— 为什么它在全球都快

CDN 架构(Edge/Shield/Origin)、缓存策略、请求合并、签名 URL、预热、JIT 与预打包、多 CDN 策略、HTTP/3 以及成本估算。

流媒体

VOD 深度剖析 第 8 部分:DRM 内容保护 —— 为什么 Netflix 无法被录屏

深入讲解 Widevine、FairPlay、PlayReady。涵盖 CENC/CBCS 统一加密、许可证流程、L1/L2/L3 安全级别、HDCP、SPEKE 集成,以及针对短视频的轻量级保护方案。

流媒体

VOD 深度剖析 第 9 篇:视频播放器 —— 从清单到首帧

深入视频播放器内部:Web(MSE/EME)、iOS(AVPlayer)、Android(ExoPlayer/Media3),以及 TTFF 优化、缓冲策略、音画同步,还有自研与采购的取舍。

怎么向你老婆解释什么是 Agent?
AI 与 Agent

怎么向你老婆解释什么是 Agent?

从'飞书机器人算不对数'到'养一只自己的 AI 龙虾'——一篇给普通人看的智能体科普。13 个灵魂拷问讲透 LLM、Token、Tools、MCP、RAG、Skills、Memory、Multi-Agent 和 2026 年的模型价格:AI 不是蠢,是还没养好。

AI 编程 Agent 究竟是如何工作的:一次源码深度剖析
技术深潜

AI 编程 Agent 究竟是如何工作的:一次源码深度剖析

我们追踪了 Amazon Q CLI 和 Claude Code 的源代码,深入理解 AI 编程 Agent 底层的真实运作方式。

大数据

AWS 大数据深度解析(第 10 部分):完整架构蓝图与成本拆解

社交应用数据仓库与推荐系统在 AWS 上的完整端到端架构——每一个服务都一一对应,附带真实的月度成本估算与优化策略。

大数据

AWS 大数据深度剖析(第九篇):SageMaker 与机器学习平台——从训练到生产

全面解析 SageMaker AI:Studio 笔记本、Feature Store、训练作业、实时 Endpoint、Model Monitor,以及它们如何融入推荐系统的 MLOps 工作流。

大数据

AWS 大数据深度剖析(第 8 部分):在线特征存储 —— DynamoDB、ElastiCache 与 OpenSearch k-NN

推荐系统如何在推理时提供特征服务:用 DynamoDB 存用户特征、用 ElastiCache 做热点缓存、用 OpenSearch k-NN 做向量召回、用 Neptune 做图检索。

大数据

AWS 大数据深度剖析(第 7 部分):推荐系统基础——漏斗、双塔与 PIT

理解推荐系统漏斗(召回 → 粗排 → 精排 → 重排)、双塔召回架构,以及为什么 Point-in-Time(时点)正确性对训练样本至关重要。

大数据

AWS 大数据深度剖析(第 6 部分):端到端数据管道 —— 从数据源到特征存储

把所有环节串联起来:追踪一个点击事件如何从客户端 SDK 经过 API Gateway、MSK、Firehose、S3、数仓分层(ODS→DWD→DWS→ADS),最终写入 DynamoDB 用于实时服务。

大数据

AWS 大数据深度解析(第五部分):EMR、Glue ETL、Flink 与管道编排

对比 EMR Serverless、Glue ETL、Managed Flink,选出合适的计算引擎;再用 MWAA(Airflow)与 Step Functions 编排数据管道。

大数据

AWS 大数据深度剖析(第四部分):Glue Catalog、Athena 与 Lake Formation

AWS Glue Data Catalog 如何充当数据湖的中央目录,以及 Athena 如何用无服务器 SQL 查询 S3 上的 Parquet 与 Iceberg 表。

大数据

AWS 大数据深度剖析(第三部分):数据接入 —— DMS、Zero-ETL、Firehose 与 MSK

四类数据源,四条接入管道 —— 学习使用 DMS 做 CDC、Aurora Zero-ETL、MSK 上的 Kafka,以及 Firehose 微批处理,将数据落地到你的 S3 数据湖。

大数据

AWS 大数据深度剖析(第二部分):S3、Parquet 与 Apache Iceberg 详解

掌握现代数据湖的存储基石 —— S3 对象存储、Parquet 列式格式,以及 Iceberg 如何为 S3 上的文件加上 ACID 事务能力。

大数据

AWS 大数据深度剖析(第一部分):数据湖、数据仓库与湖仓一体革命

理解大数据的核心概念——数据湖 vs. 数据仓库 vs. 湖仓一体,OLTP vs. OLAP,以及为什么现代分析架构都在向 S3 收敛。

技术深潜

如何用 Elasticsearch 设计一个全站搜索引擎

多数据源索引、CDC 同步、权限感知搜索、热词与联想输入——一份完整的 Elasticsearch 架构指南。

云架构

DNS 深度剖析:从第一性原理到 Kubernetes

从 dig 追踪到 Kubernetes 中的 CoreDNS,彻底搞懂 DNS。一份面向实战的容器 DNS 调试指南。