本文带有 todo 标签,表示尚未完成本人复刷。代码与推导已按公开题目和参考实现整理;刷完后可删除 frontmatter 中的 todo。
这道题的核心是把题目的操作规则直接转成确定的状态机,并保证每一步只修改规定状态。面试时先说清楚“状态表示什么、为什么能排除其他候选、何时更新答案”,再写代码;只报出“用 模拟”还不足以证明理解。
题目要求完成“删除注释”。输入包括 source(string[]),需要返回 list<string>。完整限制以原题为准,解题时重点利用这些特征:数组、字符串。
示例:
从题目标签和参考实现看,本题采用 模拟。判断依据是:把题目的操作规则直接转成确定的状态机,并保证每一步只修改规定状态。
变量保存当前下标、方向、边界或累计结果,完整描述下一步该做什么。整个过程保持一个关键不变量:每轮开始时,已经处理的部分符合题意,未处理部分仍保持原始语义。因此每一步被排除或已经处理的状态都无需回退,不会漏掉最终答案。
| 阶段 | 当前状态 | 处理动作 |
|---|---|---|
| 读取输入 | 输入:: source = ["/*Test program /", "int main()", "{ ", " // variable declaration ", "int a, b, c;", "/ This is a test", " multiline ", " comment for ", " testing */", "a = b + c;", "}"]输出:: ["int main()","{ "," ","int a, b, c;","a = b + c;","}"]解释:: 示例代码可以编排成这样:/*Test program /int main(){// variable declarationint a, b, c;/ This is a testmultilinecomment fortesting /a = b + c;}第 1 行和第 6-9 行的字符串 / 表示块注释。第 4 行的字符串 // 表示行注释。编排后:int main(){int a, b, c;a = b + c;} | 明确输入、输出和限制 |
| 建立状态 | 使用 模拟 所需的边界或辅助结构 | 保证状态定义和代码一致 |
| 推进 | 按规则读取当前状态、生成下一状态,并在越界或完成条件出现时停止 | 每一步缩小未处理范围 |
| 结束 | 候选区间为空或满足终止条件 | 返回已记录答案 |
left <= right,它表示闭区间 [left, right];若使用 left < right,则必须结合边界赋值判断是闭区间还是左闭右开区间。ans 或返回变量只保存已经被证明有效的候选,不把未经验证的中间状态当作答案。按规则读取当前状态、生成下一状态,并在越界或完成条件出现时停止。移动边界前要能说明被跳过部分为什么不可能更优,这是本题正确性的核心,而不是模板本身。
Math.floor;涉及大整数时要检查是否超过 Number.MAX_SAFE_INTEGER。参考实现来源:JoshCrozier/leetcode-javascript,按本文结构重新整理;原项目采用 MIT License。
| 阶段 | 对应代码 | 作用 |
|---|---|---|
| 入口 | removeComments | 接收题目输入,入口签名与 LeetCode 元数据一致 |
| 初始化 | var removeComments = function(source) | 建立后续推进所需的边界、缓存或答案变量 |
| 核心推进 | 按规则读取当前状态、生成下一状态,并在越界或完成条件出现时停止 | 落实“按规则读取当前状态、生成下一状态,并在越界或完成条件出现时停止” |
| 输出 | return source.join('\n').replace(/\/\*.*?\*\/|\/\/[^\n]+/gs, '').split(/\n/).filter(Boolean) | 只返回已经满足状态定义的最终结果 |
读代码时应把每个判断还原成“它排除了什么状态或完成了哪次转移”,而不是只记变量名。
复杂度必须按“状态数量 × 每个状态处理成本”分析;如果存在排序、堆操作、递归深度或结果数组,需要单独计入,不能只看最外层循环。
因为把题目的操作规则直接转成确定的状态机,并保证每一步只修改规定状态。 为什么问: 检查你是在识别性质,还是只凭题号背模板。回答要抓住可被利用的单调性、重复子问题或数据结构约束。
变量保存当前下标、方向、边界或累计结果,完整描述下一步该做什么。 为什么问: 状态定义决定代码是否可证明。回答时要让每个变量都能对应到题意。
每轮开始时,已经处理的部分符合题意,未处理部分仍保持原始语义。 为什么问: 不变量比逐行复述代码更能证明理解,回答要说明它在初始化、推进和结束时都成立。
按规则读取当前状态、生成下一状态,并在越界或完成条件出现时停止,被跳过的状态已经由题目性质证明不可能更优或已经处理完成。 为什么问: 检查正确性证明,重点不是“指针这样写”,而是“为什么可以排除”。
最容易错在状态更新顺序、边界少一位,以及修改输入后影响后续读取。 为什么问: 检查代码能否一次通过,回答要给出具体失败场景而不是只说“注意边界”。
先看瓶颈来自状态数量、每次转移成本还是辅助结构操作;只有其中一项能被减少时,复杂度才可能继续下降。 为什么问: 检查你能否从成本组成出发优化,而不是机械背最优复杂度。
要判断当前算法是否需要随机访问全部输入;若只依赖有限历史状态,可以做滚动或在线维护,否则需要分块、外存或调整数据结构。 为什么问: 检查算法理解能否迁移到工程约束。
可以从暴力枚举开始,再比较排序、哈希、搜索或动态规划等方案;取舍标准是时间、空间、是否修改输入和实现复杂度。 为什么问: 检查横向比较能力。回答要说明替代方案为什么更慢或在什么条件下更合适。
O(n) 或 O(n²):没有解释每个状态被访问多少次,也容易漏掉排序或辅助结构。先只回答第 1 题,再展开后续问题: