面试题库

全部 Django Elasticsearch FastAPI Flask Function Call JVM Java IO Java 后端 Java 基础 Java 并发 Java 新特性 Java 集合 JavaWeb Kafka LLM LangChain LangGraph MongoDB MyBatis MySQL Netty Nginx Python RAG RabbitMQ Redis RocketMQ Spring Spring AI SpringBoot SpringCloud SpringMVC ZooKeeper 分布式 后端技术 大厂面经 大数据 微服务 提示词工程 操作系统 数据库 数据结构 智能体 海康威视2026秋季社招专项 消息队列 监控运维 算法 系统设计 缓存 计算机基础 计算机网络 设计模式 面试题 高可用 高并发
LLM 简单

大模型推理为什么会有非确定性输出?如何用固定seed与贪心解码复现结果?

LLM 中等

RAG中bi-encoder与cross-encoder是如何分工的?为什么cross-encoder不能离线预计算?

LLM 简单

点积、余弦相似度与L2距离在检索中有什么区别?归一化嵌入为何常用余弦?

LLM 中等

向量数据库的HNSW索引是如何工作的?它如何在召回率与构建成本间权衡?

LLM 中等

嵌入模型的对比学习训练是如何构造正负样本的?常用损失是什么?

LLM 中等

LLM流式输出(streaming)是如何实现的?SSE为何适合逐token推送?

LLM 简单

停止序列(stop sequence)与EOS等特殊token在流式输出中分别如何触发停止?

LLM 中等

什么是logits processor与logit bias?如何在推理时禁止或偏好特定token?

LLM 简单

大模型为什么会陷入重复输出或循环?如何用采样参数与停止条件缓解?

LLM 中等

repetition penalty与frequency/presence penalty有何区别?它们如何缓解循环输出?

LLM 中等

beam search的宽度(beam width)与长度惩罚(length penalty)如何影响生成质量与延迟?

LLM 困难

function calling的工作机制是什么?工具schema如何注入、参数如何流式增量解析?