中文

中文研究文章

论文阅读、AI 系统工程、行业分析与产品实践。

papers·

Auto-Encoding Variational Bayes 论文分析:VAE、ELBO 与重参数化技巧

系统解读 Kingma 与 Welling 的 Auto-Encoding Variational Bayes:从变分推断、ELBO、SGVB 与重参数化技巧出发,理解 VAE 对现代生成模型、本地多模态与 Agent Memory 的影响。

VAEVariational InferenceGenerative Models
papers·

DeepSeek-V4 论文分析:百万 Token 上下文如何走向高效推理与 Agent

系统解析 DeepSeek-V4 的核心架构、CSA/HCA 混合注意力、mHC、Muon、1M Token 上下文、MoE、训练与推理基础设施、On-Policy Distillation,以及它对长上下文模型与 Agent 系统的意义。

DeepSeek-V4DeepSeekLarge Language Models
papers·

Vision Transformer(ViT)论文分析:An Image is Worth 16×16 Words

系统解析 ViT 的核心思想、模型结构、实验结论、局限性及其对视觉基础模型和多模态大模型的长期影响。

Vision TransformerViTTransformer
papers·

PEFT 论文全景解析:如何用极少可训练参数适配大模型

从 Adapter、Prefix Tuning、Prompt Tuning 到 LoRA 与 QLoRA,系统梳理参数高效微调(PEFT)的统一问题、方法谱系、关键取舍与生产部署策略。

PEFTFine-tuningAdapter
papers·

Kimi K3 技术报告深度分析:2.8T 超稀疏 MoE、KDA 与长程 Agent

系统解析 Moonshot AI Kimi K3 的模型规格、混合注意力、Attention Residuals、Stable LatentMoE、低精度训练及其长程 Agent 工程意义。

Kimi K3Moonshot AIMoE
papers·

LoRA:低秩适配如何让大模型微调变得可组合、可部署

系统解析 LoRA 的低秩更新公式、初始化与训练方式、实验结论、推理合并,以及它如何成为现代 PEFT 与本地模型适配器生态的基础。

LoRAPEFTFine-tuning
papers·

Attention Is All You Need:Transformer 论文分析与现代 LLM 视角复盘

系统解析 Transformer 的结构、Scaled Dot-Product Attention、Multi-Head Attention、位置编码、训练策略、实验结果、历史影响,以及它与现代 LLM 推理优化的关系。

TransformerSelf-AttentionMulti-Head Attention
builders·

PrivyPDF:从 PDF 阅读工具到本地优先的 PDF Agent

详细介绍 PrivyPDF 在 iOS 与 macOS 上的产品形态,包括扫描、OCR、RAG、PDF 理解、编辑与 PDF Agent 工作流。

PrivyPDFPDF AgentOCR
papers·

从模型论文到训练系统:如何判断一项优化是否重要

面向工程师的论文阅读框架,用于区分算法与系统贡献、训练成本和可复现性。

TrainingSystemsDeepSeek
systems·

本地 AI 运行时不只是模型加载器

从 LocalEngine 看生产级端侧运行时:模型生命周期、双后端、私有本地 API 与资源策略。

Local AIRuntimeApple Silicon
industry·

AI 行业分析中真正重要的领先指标

跳出融资新闻,追踪推理价格、开发者迁移、人才流动和分发渠道的真实变化。

IndustryStrategyInfrastructure
builders·

从读论文到 Privy 产品决策

将研究结论转化为模型选择、端侧性能预算和产品方向,而不是停留在摘要层面。

PrivyProductLocal AI