AI Agent 高频题信号榜

按独立来源数量和最近出现时间排序。频次只代表本仓库已核验的公开样本,不代表公司的固定题库。

当前收录 12 个高频问题信号;每条均关联原始来源、公司、轮次、回答骨架和评估要点。

#1
Tooling 5 个独立来源 high 最近 2026-09-07

Tool、Function Calling、MCP 与 Skill 的边界是什么?

公司:字节跳动 · 阿里巴巴 · 快手 · 米哈游 · 蚂蚁 轮次:一面 · 二面

回答骨架

  1. Function Calling 是模型输出约定
  2. Tool 是可执行能力
  3. MCP 是工具和资源接入协议
  4. Skill 是可复用工作方法与资源包

评估要点

  • 能说明权限边界
  • 能说明渐进式加载
  • 能举出不该使用 MCP 的场景
查看证据来源
#2
Context Engineering 5 个独立来源 high 最近 2026-09-04

长上下文、Session、Working State 与长期 Memory 如何分层?

公司:字节跳动 · 腾讯 · 百度 · 阿里巴巴 轮次:一面 · 二面

回答骨架

  1. 分离短期上下文与长期记忆
  2. 按预算触发压缩
  3. 保留证据和 Artifact 引用
  4. 评估压缩后的任务成功率

评估要点

  • 说明压缩失真风险
  • 说明恢复时如何重建上下文
  • 不能把所有历史都塞回 Prompt
查看证据来源
#3
Coding Agent 5 个独立来源 high 最近 2026-09-03

如何验证 AI Coding 生成的代码,而不是直接接受结果?

公司:字节跳动 · 快手 · 阿里巴巴 · 腾讯 · 米哈游 轮次:一面 · 二面 · 现场编码

回答骨架

  1. 静态检查
  2. 单元和属性测试
  3. 安全扫描
  4. 差异审查
  5. 运行时验证
  6. 回滚

评估要点

  • 区分生成和交付
  • 能解释测试盲区
  • 保留证据而非口头确认
查看证据来源
#4
Agent Evaluation 5 个独立来源 high 最近 2026-08-31

如何设计 Agent 的离线评测、线上指标和失败样本回流?

公司:字节跳动 · 阿里巴巴 · 美团 · 米哈游 · 蚂蚁国际 轮次:一面 · 二面 · 项目深挖

回答骨架

  1. 定义任务成功条件
  2. 区分 outcome/trajectory/state grading
  3. 构建失败与对抗样本
  4. 建立回归门禁
  5. 监控成本延迟和安全

评估要点

  • 不能只用 LLM-as-Judge
  • 要区分模型自述完成与独立验证
  • 能说明数据污染和评测漂移
查看证据来源
#5
RAG 5 个独立来源 high 最近 2026-06-18

RAG 召回或回答效果差时,如何逐层定位?

公司:字节跳动 · 美团 · 快手 · 百度 · 京东 轮次:一面 · 项目深挖

回答骨架

  1. 解析和切块
  2. Query Rewrite
  3. Sparse/Dense 召回
  4. RRF/Rerank
  5. 生成忠实度
  6. 线上反馈

评估要点

  • 有分层指标
  • 能定位表格和扫描 PDF
  • 区分召回失败与生成失败
查看证据来源
#6
Agent Runtime 4 个独立来源 high 最近 2026-09-04

Agent、Orchestrator、Harness 和 Runtime 分别负责什么?

公司:字节跳动 · 小红书 · 阿里巴巴 轮次:一面 · 系统设计

回答骨架

  1. Agent 负责语义决策
  2. Orchestrator 负责依赖和分派
  3. Harness 约束模型工具循环
  4. Runtime 管理生命周期和恢复

评估要点

  • 边界清晰
  • 能解释为什么 while loop 不够
  • 能画出控制面与执行面
查看证据来源
#7
Multi-Agent 4 个独立来源 high 最近 2026-06-29

为什么一定要使用 Multi-Agent,单 Agent 或 Workflow 不行吗?

公司:字节跳动 · 腾讯 · 阿里巴巴 · 快手 轮次:一面 · 二面 · 项目深挖

回答骨架

  1. 先给单 Agent 基线
  2. 证明上下文隔离或并行收益
  3. 说明通信和一致性成本
  4. 提供消融实验

评估要点

  • 不能用角色数量代替架构理由
  • 说明失败传播
  • 给出不用 Multi-Agent 的条件
查看证据来源
#8
Reliability 3 个独立来源 high 最近 2026-09-04

工具调用失败或超时时,如何安全重试并避免重复副作用?

公司:腾讯 · 阿里巴巴 · 字节跳动 轮次:一面 · 系统设计

回答骨架

  1. 错误分类
  2. 幂等键
  3. 结果日志
  4. 指数退避
  5. 补偿事务
  6. 人工审批

评估要点

  • 认识到超时不等于未执行
  • 高风险操作不能自动无限重试
  • 恢复要读取执行日志
查看证据来源
#9
Performance 3 个独立来源 high 最近 2026-09-04

包含多个模型和工具调用的 Agent 链路如何优化延迟与成本?

公司:字节跳动 · 阿里巴巴 · 快手 轮次:一面 · 项目深挖

回答骨架

  1. Trace 分解延迟
  2. 并行无依赖调用
  3. 缓存
  4. 模型路由
  5. 上下文预算
  6. 超时与降级

评估要点

  • 给出 P50/P95
  • 不能只说换小模型
  • 同时报告质量回归
查看证据来源
#10
Structured Output 3 个独立来源 high 最近 2026-09-04

模型生成工具参数或结构化评分时,如何保证输出合法且语义一致?

公司:字节跳动 · 阿里巴巴 · 美团 轮次:一面

回答骨架

  1. JSON Schema
  2. 约束解码
  3. 语义校验
  4. 修复重试
  5. 失败降级

评估要点

  • 格式正确不等于业务正确
  • 参数需要权限和范围校验
  • 保留原始输出用于审计
查看证据来源
#11
Agentic RL 3 个独立来源 high 最近 2026-07-22

Agent 多步工具轨迹如何设计 Reward 和信用分配?

公司:阿里巴巴 · 腾讯 · 字节跳动 轮次:一面 · 算法面

回答骨架

  1. Outcome Reward
  2. Process Reward
  3. 格式与工具合法性
  4. 延迟成本惩罚
  5. Reward Hacking 防护

评估要点

  • 说明稀疏奖励
  • 说明 token/turn/trajectory 粒度
  • 区分训练指标和线上成功
查看证据来源
#12
Reliability 1 个独立来源 medium 最近 2026-08-28

如何检测并处理 Agent 路径震荡和无进展循环?

公司:字节跳动 轮次:一面 · 系统设计

回答骨架

  1. 动作与错误指纹去重
  2. 进展检测
  3. 失败预算
  4. 强制重规划
  5. 转人工

评估要点

  • 区分探索和震荡
  • 不能只增加 max_iterations
  • 能定义 no-progress 信号
查看证据来源