跳至主要內容
秀才的进阶之路
秀才的进阶之路
Go语言进阶之路
🔥后端/AI面试题
🤖Go Agent实战指南
🔥Vibe Coding实战指南
🔥Agent项目
关于作者
搜索文档
K
Llm Interview
秀才
小于 1 分钟
目录
1. 你如何定义一个基于 LLM 的智能体?它通常由哪些核心组件构成?
1. 如何设计实现一个 LLM Gateway ?
1. 请解释 RAG 的工作原理。与直接对 LLM 进行微调相比,RAG 主要解决了什么问题?有哪些优势?
1. 请详细解释一下 Transformer 模型中的自注意力机制是如何工作的?它为什么比 RNN 更适合处理长序列?
10. RAG 检索不到问题时如何定位问题?排查思路是什么?
10. 如何确保一个Agent的行为是安全、可控且符合人类意图的?在Agent的设计中,有哪些保障对齐方法?
11. RAGAS了解吗?它的评估指标有哪些?评估流程是怎样的?评估数据如何获取和构造?
11. 请比较一下LangChain 和 LlamaIndex,它们的核心应用场景有何不同?
12. RAG用户提问和向量库中的语义发生不匹配怎么办?如何解决语义鸿沟问题?
12. 在 Agent 中,记忆模块你一般会怎么设计?
13. 什么是RAG 中的Rerank?具体需要怎么做?你了解哪些常用的 Rerank模型?
13. 假如说要设计一个多轮对话Agent,你会怎么设计?
14. 你的Agent意图识别是怎么做的?
14. 你项目中 RAG 的存储架构是怎么设计的?
15. RAG系统中如何进行query改写,以及如何基于检索结果构建有效prompt?
15. 介绍一下多 Agent 如何实现工作?多个 Agent 之间如何协调和分工?
16. 你的RAG知识库更新策略是怎样的?
16. 在高并发RAG Agent系统中,如何优化召回和生成阶段的延迟?
17. 你的Agent是怎么应对高并发的?
17. 百万级知识库检索 RT 越来越高,你会如何做性能优化?
18. LLM 响应慢导致整个 Agent 链路超时,你说一下分层超时的熔断策略是什么?
19. 最常见的 Agent 生产环境内存泄漏有哪几种?你会如何排查修复?
2. 什么是位置编码?在 Transformer 中,为什么它是必需的?请列举至少两种实现方式
2. 你会怎么设计一个大模型应用的后端架构?
2. 在构建知识库时,文本切块策略至关重要。你会如何选择合适的切块大小和重叠长度?这背后有什么考虑?
2. 请详细解释 ReAct 框架。它是如何将思维链和行动结合起来,以完成复杂任务的?
20. LangChain 和 LangGraph 的区别是什么?各自适用什么场景?
21. 你的 Agent 服务是如何保证高可用和稳健性的?
22. 生产环境Agent链路很长,包含了检索工具和多轮推理,你会如何设计把P95的RT降下来?
23. 讲一下生产环境完整的Agent缓存体系,哪些数据可以做缓存,哪些不能做缓存?
24. 生产环境Agent的Token成本持续增长,你说一下有哪些降本的优化手段?
25. 多用户并发Agent会话隔离你如何工程化落地?如何避免这种串会话?
26. 生产环境 Agent 出现了大量的异步任务堆积,你会如何处理?
27. 小模型成本低但推理能力较弱,大模型效果好但成本高,生产环境如何平衡?
3. Agent的规划能力有哪些主流的实现方法?
3. Prompt 注入是什么?有哪些攻击方式?如何防护?
3. 如何选择一个合适的嵌入模型?评估一个 Embedding 模型的好坏有哪些指标?
3. 有微调过 Agent 能力吗?数据集如何收集?
4. Function Calling 的可靠性怎么保证?
4. 请问如何为Agent设计短期记忆和长期记忆系统?可以借助哪些外部工具或技术?
4. 除了基础的向量检索,你还知道哪些可以提升 RAG 检索质量的技术?
5. Agent 的记忆覆盖问题如何解决?
5. 如何全面地评估一个 RAG 系统的性能?请分别从检索和生成两个阶段提出评估指标
5. 高并发场景下你会如何去解决LLM接口限流?
6. 在什么场景下,你会选择使用图数据库或知识图谱来增强或替代传统的向量数据库检索?
6. 在构建一个复杂的 Agent 时,你认为最主要的挑战是什么?
6. 生产环境中你会如何设计大模型推理调度系统?
7. RAG 系统在实际部署中可能面临哪些挑战?
7. 什么是多Agent系统?让多个Agent 协同工作相比于单个 Agent 有什么优势?又会引入哪些新的复杂性?
8. 传统的 RAG 流程是"先检索后生成",你是否了解一些其他的 RAG 范式,比如在生成过程中多次检索或自适应检索?
8. 你用过哪些 Agent 框架?选型是如何选的?你最终场景的评价指标是什么?
9. Tool Use是扩展Agent能力的有效途径。请解释LLM是如何学会调用外部API或工具的?
9. 你知道哪些方法可以提高RAG的检索正确率?