CS50 Week2作业:如何避免单词计数函数重复计数?
单词计数函数优化提示(CS50 Readability 作业)
核心思路调整提示
- 别再统计分隔符了,改成统计单词的起始点。比如:当你遇到一个属于单词的字符,且它的前一个字符是分隔符(或者它是字符串的第一个字符),这时候才给
word_count加1。这种方式天然能避免连续空格/标点重复计数的问题。 - 先明确「单词字符」的定义:除了字母,把你想保留的撇号(
')、连字符(-)也算作单词的一部分。只有空格、句号、逗号这类真正的分隔标点才视为单词的结束标记。
具体实现方向提示
- 可以用一个状态变量(比如
bool in_word = false;)来跟踪当前是否处于单词内部:- 遍历字符时,如果当前字符是单词字符,且
in_word为false,说明刚进入新单词,计数加1,同时把in_word设为true; - 如果当前字符是分隔符,就把
in_word设为false; - 要是已经在单词里(
in_word为true)且遇到的还是单词字符,啥也不用做,继续遍历就行。
- 遍历字符时,如果当前字符是单词字符,且
- 注意边界情况:比如字符串开头就是单词的情况,或者结尾跟着标点的情况,用状态变量的方式能自动处理这些场景。
你的当前代码
int count_words(string text) { int length = strlen(text); int word_count = 0; for (int i = 0; i < length; i++) { if (isspace(text[i]) || ispunct(text[i])) word_count++; } return word_count; }
测试输入示例:"This should be 8 words. But it isn't.",正确结果应为8,当前函数返回10。
内容的提问来源于stack exchange,提问作者quovixi
相关产品推荐
相关产品推荐

