logo
AI
  1. 大模型发展史总复盘:从生成文本到可执行系统

    AI
    LLM
    技术总结
    Agent
    学习路线
  2. 复现论文的工程方法:环境、数据、指标与误差

    AI
    LLM
    论文复现
    实验工程
    机器学习
  3. 读论文方法:如何拆解一篇大模型论文

    AI
    LLM
    论文阅读
    学习方法
    科研实践
  4. 从零搭建 LLM 应用 CI:测试、评测与发布门禁

    AI
    LLM
    CI/CD
    自动化测试
    评测
  5. AI 系统的 SLO:质量、延迟、可用性与安全

    AI
    LLM
    SLO
    可观测性
    可靠性
  6. AI 系统成本核算:Token、GPU、存储与人工成本

    AI
    LLM
    成本优化
    GPU
    工程实践
  7. 长任务 Agent:检查点、恢复与幂等执行

    AI
    LLM
    Agent
    工作流引擎
    可靠性
  8. 实时语音 Agent:延迟预算与打断处理

    AI
    LLM
    语音交互
    Agent
    WebRTC
  9. 多模态 Agent:让模型读图、读表、读屏幕

    AI
    LLM
    多模态
    Agent
    Computer Use
    top
  10. 软件工程 Agent:从 Issue 到可审查 Pull Request

    AI
    LLM
    Coding Agent
    Git
    软件工程
  11. AI Coding Agent 的代码库理解与补丁生成

    AI
    LLM
    Coding Agent
    软件工程
    代码生成
  12. On-device AI:端侧推理的性能与隐私权衡

    AI
    LLM
    On-device AI
    端侧推理
    性能优化
  13. Model Distillation 实战:把大模型能力压缩下来

    AI
    LLM
    知识蒸馏
    模型训练
    PyTorch
  14. 小模型路线:蒸馏、剪枝与任务专用模型

    AI
    LLM
    小模型
    模型压缩
    部署优化
  15. 版权与训练数据:工程师需要知道的边界

    AI
    LLM
    版权
    数据合规
    工程实践
  16. AI 应用的隐私保护:脱敏、留存与数据边界

    AI
    LLM
    隐私保护
    数据安全
    RAG
  17. 多租户 AI 应用:隔离数据、配额和检索权限

    AI
    LLM
    多租户
    RAG
    权限管理
  18. 生产级 RAG:离线评测、在线监控与增量索引

    AI
    LLM
    RAG
    评测
    工程实践
  19. Prompt 版本管理与回归测试

    AI
    LLM
    Prompt Engineering
    回归测试
    工程实践
  20. 构建黄金数据集:让评测从感觉变成证据

    AI
    LLM
    数据集
    评测
    工程实践
  21. LLM-as-a-Judge:自动评审的偏差与校准

    AI
    LLM
    LLM-as-a-Judge
    模型评测
    数据质量
  22. 结构化生成的终极实践:JSON Schema 与类型安全

    AI
    LLM
    JSON Schema
    TypeScript
    结构化输出
  23. LLM 网关设计:统一鉴权、限流、重试与审计

    AI
    LLM
    API Gateway
    限流
    可观测性
  24. 从模型选型到能力路由:建立自己的 Model Gateway

    AI
    LLM
    Model Gateway
    模型选型
    系统架构
  25. 2025 年总结:从 Copilot 到可执行 Agent

    AI
    LLM
    Agent
    Copilot
    技术总结
  26. 量化实践:GPTQ、AWQ、GGUF 如何选择

    AI
    LLM
    量化
    GPTQ
    AWQ
    GGUF
  27. FlashAttention:注意力计算的 IO 优化

    AI
    LLM
    FlashAttention
    GPU
    性能优化
  28. Speculative Decoding:用小模型加速大模型

    AI
    LLM
    Speculative Decoding
    推理优化
    性能优化
  29. Continuous Batching 与服务并发

    AI
    LLM
    Continuous Batching
    GPU
    并发优化
  30. KV Cache:LLM 推理为什么会被显存卡住

    AI
    LLM
    KV Cache
    GPU
    推理优化
  31. vLLM 推理服务:PagedAttention 与吞吐优化

    AI
    LLM
    vLLM
    PagedAttention
    推理服务
  32. BrowserGym 与任务型 Agent 基准测试

    AI
    LLM
    Agent
    BrowserGym
    模型评测
  33. Agent 评测:任务成功率、轨迹质量与成本

    AI
    LLM
    Agent
    模型评测
    成本优化
    top
  34. Human-in-the-loop:高风险动作前的审批设计

    AI
    LLM
    Agent
    Human-in-the-loop
    安全设计
  35. Agent 失败模式:循环、幻觉、工具误用与失控

    AI
    LLM
    Agent
    可靠性
    安全工程
  36. Agent Memory:短期记忆、长期记忆与用户画像

    AI
    LLM
    Agent
    Memory
    隐私保护
  37. Computer Use:浏览器操作的状态机设计

    AI
    LLM
    Computer Use
    Agent
    浏览器自动化
  38. MCP Server 实战:为博客暴露搜索工具

    AI
    LLM
    MCP
    Agent
    TypeScript
  39. MCP 协议入门:统一模型与外部工具的连接

    AI
    LLM
    MCP
    Agent
    协议
  40. 多智能体协作:什么时候值得拆成多个 Agent

    AI
    LLM
    Agent
    多智能体
    架构
  41. Tool Calling 的可靠性:Schema、重试与幂等

    AI
    LLM
    Agent
    Tool Calling
    工程实践
  42. ReAct Agent:从搜索工具开始实现智能体

    AI
    LLM
    Agent
    ReAct
    TypeScript
  43. GPT-4o 生图

    AI
    top
  44. Agent 是什么:模型、工具、状态与循环

    AI
    LLM
    Agent
    架构
    学习
    top
  45. 推理模型的思维链评测与结果校验

    AI
    LLM
    推理模型
    评测
    思维链
  46. GRPO 入门:群体相对策略优化

    AI
    LLM
    推理模型
    GRPO
    强化学习
  47. DeepSeek-R1 的训练思路与开源影响

    AI
    LLM
    DeepSeek
    推理模型
    强化学习
  48. Test-time Compute:用更多推理换更高正确率

    AI
    LLM
    推理模型
    Test-time Compute
    性能优化
  49. Chain-of-Thought、ReAct 与 Tree-of-Thought 对比

    AI
    LLM
    推理
    ReAct
    Tree-of-Thought
  50. 推理模型兴起:为什么测试时计算开始变重要

    AI
    LLM
    推理模型
    Test-time Compute
    发展史
  51. 2024 年总结:LLM 应用工程化检查清单

    AI
    LLM
    工程实践
    RAG
    多模态
  52. 多模型路由:按质量、延迟和价格选择模型

    AI
    LLM
    模型路由
    架构
    成本优化
  53. LLM 观测:Tracing、Token 用量与失败样本

    AI
    LLM
    可观测性
    Tracing
    工程实践
  54. Guardrails:输出过滤、策略判断与人工兜底

    AI
    LLM
    安全
    Guardrails
    工程实践
  55. LLM 安全:Prompt Injection 与越权工具调用

    AI
    LLM
    安全
    Prompt Injection
    Agent
  56. RAG 数据管道:解析 PDF、网页与表格

    AI
    LLM
    RAG
    数据工程
    文档解析
  57. GraphRAG:知识图谱如何补足向量检索

    AI
    LLM
    RAG
    GraphRAG
    知识图谱
  58. RAG 进阶:Hybrid Search 与 Reranker

    AI
    LLM
    RAG
    Hybrid Search
    Reranker
  59. DPO 实战:训练一个更符合业务偏好的模型

    AI
    LLM
    DPO
    微调
    偏好优化
  60. 偏好优化:从 RLHF 到 DPO

    AI
    LLM
    RLHF
    DPO
    对齐
  61. SFT 指令微调:数据格式、清洗与训练

    AI
    LLM
    SFT
    微调
    数据工程
  62. QLoRA 实战:在消费级显卡上微调模型

    AI
    LLM
    QLoRA
    LoRA
    微调
  63. LoRA 原理:低秩矩阵为什么能微调大模型

    AI
    LLM
    LoRA
    微调
    Transformer
  64. MoE 的路由、负载均衡与训练难点

    AI
    LLM
    MoE
    稀疏专家
    深度学习
  65. Mixtral 与 MoE:稀疏专家模型怎么省计算

    AI
    LLM
    Mixtral
    MoE
    稀疏模型
  66. Llama 3 开源模型部署与 API 封装

    AI
    LLM
    Llama 3
    本地部署
    API
  67. Claude 3 系列与模型能力评测方法

    AI
    LLM
    Claude 3
    模型评测
    多模态
  68. 长文档问答:Map-Reduce、Refine 与分层摘要

    AI
    LLM
    长上下文
    RAG
    文档问答
  69. ComfyUI一键写真(包含NextJS封装ComfyUI API)

    AI
    top
  70. Context Window 的内存模型与成本计算

    AI
    LLM
    Context Window
    KV Cache
    成本优化
  71. ComfyUI 人像写真工作流

    AI
  72. 老板让我抄个侧边栏 那我得用AI一把梭

    AI
    效率工具
  73. 大模型发展史:

    AI
    LLM
    学习路线
    写作计划