归档

07-16
Computer Vision深入理解 3D Gaussian Splatting (3DGS):从原理到实践
07-16
3D Vision深度解析 ActionMesh:Temporal 3D Diffusion 实现动画 3D 网格生成
07-16
Large Language Models深入理解 AI Agent 架构:从单 Agent 到多 Agent 协作
07-16
Large Language Models深入理解 Chain-of-Thought (CoT):让大模型学会"思考"
07-16
Deep LearningCLIP 深度剖析:对比语言-图像预训练的完整技术栈
07-16
Generative AIConsistency Models 深度解析:一步生成扩散模型
07-16
Generative AIControlNet 深度剖析:条件控制扩散模型的结构化控制系统
07-16
Large Language Models数据构建深度解析:LLM 训练数据的艺术与科学
07-16
Generative AIDDIM 深度剖析:从随机马尔可夫链到确定性隐式模型
07-16
Generative AIDDPM 深度剖析:变分推断视角下的去噪扩散概率模型
07-16
Large Language ModelsDeepSeek-R1 深度解析:推理能力涌现与纯 RL 的范式突破
07-16
Generative AI深入理解 Diffusion Transformer (DiT):扩散模型的 Transformer 范式
07-16
Large Language Models分布式训练深度解析:Data / Tensor / Pipeline / Sequence Parallelism
07-16
Large Language ModelsDoRA 深度解析:权重分解低秩适应的理论与实践
07-16
Large Language ModelsDPO 深度解析:绕过强化学习的直接偏好优化
07-16
3D Vision深度解析 DUSt3R:无需相机标定的稠密无约束立体 3D 重建
07-16
Generative AI深入理解 Flow Matching:生成建模的统一理论框架
07-16
Large Language Models深入理解 Function Calling:让大模型连接真实世界
07-16
Large Language ModelsGRPO 深度解析:DeepSeek 的高效对齐算法与数学推理革命
07-16
Generative AI深度解析腾讯混元 3D (Hunyuan3D):大规模扩散模型的 3D 资产生成
07-16
Large Language Models知识蒸馏深度解析:从大模型到小模型的智能迁移
07-16
Large Language ModelsKV Cache 优化与内存管理深度解析:PagedAttention 原理与实践
07-16
Generative AILatent Diffusion Model 深度剖析:从像素扩散到潜在空间生成
07-16
Large Language ModelsLLaVA 深度剖析:从视觉指令微调到开源多模态助手的完整技术栈
07-16
Generative AI深度解析 LRM:大型重建模型与单图像 3D 重建的突破
07-16
Large Language Models深入理解 Mamba:选择性状态空间模型的架构与实现
07-16
3D Vision深度解析 MASt3R:融合 3D 几何的稠密匹配新范式
07-16
3D Vision深度解析 MeshFlow:MeshVAE + Flow Matching DiT 实现高效艺术家风格网格生成
07-16
Large Language Models深入理解 MoE (混合专家模型):稀疏激活与高效扩展
07-16
Generative AI深入理解 MMDiT:多模态扩散 Transformer 与 Stable Diffusion 3 革命
07-16
Computer Vision深入理解神经辐射场 (NeRF):从体渲染到可微 3D 重建
07-16
Large Language Models参数高效微调深度解析:从 LoRA 到 QLoRA 的全面指南
07-16
Large Language Models后训练深度解析:LLM 从基座到助手的能力锻造
07-16
Large Language ModelsPPO 深度解析:信赖域优化的艺术与 LLM 对齐实践
07-16
Large Language Models偏好对齐深度解析:从 RLHF 到 DPO/KTO 的技术演进
07-16
Large Language Models预训练策略:从 GPT 到 Llama,大模型的"九年义务教育"
07-16
Large Language ModelsQLoRA 深度解析:4-bit 量化与低秩适应的完美结合
07-16
Large Language Models模型量化与压缩深度解析:INT8/INT4/AWQ/GPTQ 全面指南
07-16
Large Language Models深入理解 ReAct 模式:让大模型学会推理与行动
07-16
Large Language ModelsReward Hacking 深度解析:LLM 对齐中的奖励黑客问题
07-16
Large Language ModelsRLHF 深度解析:从人类反馈到 PPO/GRPO/DPO 的对齐革命
07-16
Large Language ModelsRoPE (Rotary Position Embedding) 深度解析:旋转位置编码的数学之美
07-16
3D Vision深度解析 Scaffold-GS:结构化 3D 高斯与视角自适应渲染
07-16
Generative AIStable Diffusion LoRA 微调:从 Dreambooth 到社区生态的完整指南
07-16
Large Language Models深入理解状态空间模型 (SSM):RNN 与 Transformer 的优雅融合
07-16
Large Language Models监督微调 SFT:从基础模型到任务专家的关键一步
07-16
Large Language Models推理时扩展深度解析:Test-Time Scaling 的理论与实践
07-16
Generative AI深度解析 Microsoft TRELLIS:结构化潜在表示与可扩展的 3D 资产生成
07-16
Generative AI视频生成模型深度解析:从 Video DiT 到 Sora 架构
07-16
Embodied AIVLA 架构深度剖析:视觉语言动作模型与机器人操控
07-16
Large Language Models多模态大模型 VLM 架构:从模态对齐到 GPT-4V 的完整技术栈
07-16
Deep Learning深入理解 Vision Transformer (ViT):图像识别的范式革新
07-16
Large Language ModelsvLLM 深度解析:高效 LLM 推理引擎的架构与实践
07-16
Large Language ModelsYaRN / LongRoPE 深度解析:大模型上下文扩展技术
07-14
Generative AI深入理解扩散模型 (Diffusion Model):从原理到实践
07-14
Large Language Models深入理解 Transformer 架构:从注意力机制到 GPT
Profile Image of the Author

Federico

AI Research Lab

Hello, I'm Federico.

关于实验室 / About
公告

欢迎来到Federico的个人博客

分类
标签
站点统计
57文章
7分类
404标签

当前页面没有目录