面试题库

全部 Django Elasticsearch FastAPI Flask Function Call JVM Java IO Java 后端 Java 基础 Java 并发 Java 新特性 Java 集合 JavaWeb Kafka LLM LangChain LangGraph MongoDB MyBatis MySQL Netty Nginx Python RAG RabbitMQ Redis RocketMQ Spring Spring AI SpringBoot SpringCloud SpringMVC ZooKeeper 分布式 后端技术 大厂面经 大数据 微服务 提示词工程 操作系统 数据库 数据结构 智能体 海康威视2026秋季社招专项 消息队列 监控运维 算法 系统设计 缓存 计算机基础 计算机网络 设计模式 面试题 高可用 高并发
LLM 中等

什么时候用指令微调(SFT)?什么时候需要偏好优化(DPO/RLHF)?

LLM 简单

微调数据质量为什么比数量更重要?LIMA实验说明了什么?

LLM 困难

QLoRA是如何通过NF4、双重量化与paged optimizer在单张消费级GPU上微调大模型的?

LLM 困难

LoRA的秩(r)与缩放系数(alpha)如何选择?alpha/r的缩放关系是什么?

LLM 中等

微调如何缓解灾难性遗忘(catastrophic forgetting)?LoRA与数据混合各起什么作用?

LLM 中等

RAG检索到了正确文档但生成答案仍然错误,可能是什么原因?如何缓解?

LLM 中等

RAG与微调在成本、延迟、知识更新与可解释性上如何系统对比?什么信号应倾向微调?

LLM 中等

越狱攻击中的翻译攻击与编码绕过是如何工作的?输入净化(input sanitization)能有效防御吗?

LLM 中等

LLM应用的输入/输出双向内容审查(moderation)如何实现?它有哪些局限?

LLM 简单

什么是系统提示泄露(system prompt leakage)?如何在产品中设计防御?

LLM 中等

大模型安全评估中红队测试(red teaming)是如何进行的?如何自动化生成攻击样本?

LLM 中等

什么是奖励hacking(reward hacking)?在RLHF中如何检测与缓解?