getchar()和EOF总结

getchar()和EOF总结

大师级经典的著作，要字斟句酌的去读，去理解。以前在看K&R的The C Programming Language(SecondEdition)
第1.5节的字符输入/输出，被getchar()和EOF所迷惑了。可能主要还是由于没有搞清楚getchar()的工作原理和EOF的用法。因此,感觉很有必要总结一下，不然，很多琐碎的知识点长时间过后就会淡忘的，只有写下来才是最好的方法。

其实，getchar()最典型的程序也就几行代码而已。本人所用的环境是DebianGNU/Linux，在其他系统下也一样。
一、 getchar的两点总结：
1.getchar是以行为单位进行存取的。
当用getchar进行输入时，如果输入的第一个字符为有效字符(即输入是文件结束符EOF，Windows下为组合键Ctrl+Z， Unix/Linux下为组合键Ctrl+D)，那么只有当最后一个输入字符为换行符'/n'(也可以是文件结束符EOF，EOF将在后面讨论)时， getchar才会停止执行，整个程序将会往下执行。譬如下面程序段：

while ( ( c = getchar ( ) ) ! = EOF ) {     putchar ( c) ; }

执行程序，输入：abc，然后回车。则程序就会去执行puchar(c)，然后输出abc，这个地方不要忘了，系统输出的还有一个回车（是因为我们输入abc之后又输入回车，而不是putchar自动添加）。然后可以继续输入，再次遇到换行符的时候，程序又会把那一行的输入的字符输出在终端上。

对于getchar，肯定很多初学的朋友会问，getchar不是以字符为单位读取的吗？那么，既然我输入了第一个字符a，肯定满足while循环(c = getchar()) != EOF的条件阿，那么应该执行putchar(c)在终端输出一个字符a。不错，我在用getchar的时候也是一直这么想的，但是程序就偏偏不着样执行，而是必需读到一个换行符或者文件结束符EOF才进行一次输出。

对这个问题的一个解释是，在大师编写C的时候，当时并没有所谓终端输入的概念，所有的输入实际上都是按照文件进行读取的，文件中一般都是以行为单位的。因此，只有遇到换行符，那么程序会认为输入结束，然后采取执行程序的其他部分。同时，输入是按照文件的方式存取的，那么要结束一个文件的输入就需用到EOF (Enf Of File) . 这也就是为什么getchar结束输入退出时要用EOF的原因。

2.getchar()的返回值一般情况下是字符，但也可能是负值，即返回EOF。

这里要强调的一点就是，getchar函数通常返回终端所输入的字符，这些字符系统中对应的ASCII值都是非负的。因此，很多时候，我们会写这样的两行代码：

char c; c = getchar ( ) ;

这样就很有可能出现问题。因为getchar函数除了返回终端输入的字符外，在遇到Ctrl+D(Linux下)即文件结束符EOF时，getchar ()的返回EOF，这个EOF在函数库里一般定义为-1。因此，在这种情况下，getchar函数返回一个负值，把一个负值赋给一个char型的变量是不正确的。为了能够让所定义的变量能够包含getchar函数返回的所有可能的值，正确的定义方法如下(K&R C中特别提到了这个问题)：

int c; c = getchar ( ) ;

二、 EOF的两点总结(主要指普通终端中的EOF)

首先明确一下EOF的概念，EOF是在stdio.h中定义的一个常量，为#define EOF (-1) 用来表示文件的结尾，当某些函数读取到文件尾时便返回EOF。另外，不是说每个文件的尾部都有一个专门的标志用来标示文件结尾，更不是说每个文件尾都有EOF，我们可以想象一下，如果我们每次读取一个字符都要判断是否到达文件尾，那样效率也太低了，那如何判断文件是否已经结束了呢？中断、异常。当我们用函数读入文件数据的时候,函数总会返回一个状态,是读取成功还是失败,那么这个状态怎么表示呢,所以就约定俗成定义一个标识符表示这个状态,就有了EOF,BOF等等

1.EOF作为文件结束符时的情况：

EOF虽然是文件结束符，但并不是在任何情况下输入Ctrl+D(Windows下Ctrl+Z)都能够实现文件结束的功能，只有在下列的条件下，才作为文件结束符。
(1)遇到 getcahr函数执行时，要输入第一个字符时就直接输入Ctrl+D，就可以跳出getchar(),去执行程序的其他部分；
(2)在前面输入的字符为换行符时，接着输入Ctrl+D；
(3)在前面有字符输入且不为换行符时，要连着输入两次Ctrl+D，这时第二次输入的Ctrl+D起到文件结束符的功能，至于第一次的Ctrl+D的作用将在下面介绍。
其实，这三种情况都可以总结为只有在getchar()提示新的一次输入时，直接输入Ctrl+D才相当于文件结束符。

2.EOF作为行结束符时的情况，这时候输入Ctrl+D并不能结束getchar(),而只能引发getchar()提示下一轮的输入。

这种情况主要是在进行getchar()新的一行输入时，当输入了若干字符(不能包含换行符)之后，直接输入Ctrl+D，此时的Ctrl+D并不是文件结束符，而只是相当于换行符的功能，即结束当前的输入。以上面的代码段为例，如果执行时输入abc，然后Ctrl+D，程序输出结果为：
abcabc

注意:第一组abc为从终端输入的，然后输入Ctrl+D，就输出第二组abc，同时光标停在第二组字符的c后面,然后可以进行新一次的输入。这时如果再次输入Ctrl+D，则起到了文件结束符的作用，结束getchar（）。
如果输入abc之后，然后回车，输入换行符的话，则终端显示为：
abc       //第一行，带回车
abc       //第二行
            //第三行

其中第一行为终端输入，第二行为终端输出，光标停在了第三行处，等待新一次的终端输入。
从这里也可以看出Ctrl+D和换行符分别作为行结束符时，输出的不同结果。
EOF 的作用也可以总结为：当终端有字符输入时，Ctrl+D产生的EOF相当于结束本行的输入，将引起getchar()新一轮的输入；当终端没有字符输入或者可以说当getchar()读取新的一次输入时，输入Ctrl+D，此时产生的EOF相当于文件结束符，程序将结束getchar()的执行。

另外，有可能有些人会有疑问，既然没有专门的标志表示文件的结尾，那我们输入的Ctrl+D是什么？这是系统定义的，Linux系统定义了几个特殊组合键，其功能如下：

ctrl-c 发送 SIGINT 信号给前台进程组中的所有进程。常用于终止正在运行的程序。
ctrl-z 发送 SIGTSTP 信号给前台进程组中的所有进程，常用于挂起一个进程。
ctrl-d 不是发送信号，而是表示一个特殊的二进制值，表示 EOF。
ctrl-/ 发送 SIGQUIT 信号给前台进程组中的所有进程，终止前台进程并生成 core 文件。

【补充】本文第二部分中关于EOF的总结部分，适用于终端驱动处于一次一行的模式 下。也就是虽然getchar()和putchar()确实是按照每次一个字符进行的。但是终端驱动处于一次一行的模式，它的输入只有到“/n”或者EOF时才结束，因此，终端上得到的输出也都是按行的。
如果要实现终端在读一个字符就结束输入的话，下面的程序是一种实现的方法(参考《C专家编程》,略有改动)：
相关阅读:
10465
移动Web开发图片自适应两种常见情况解决方案
 [置顶] Spring的DI依赖实现分析
 Android中两种设置全屏或者无标题的方法
 Esper系列(十二)Variables and Constants
Esper系列(十一)NamedWindow语法Merge、Queries、Indexing、Dropping
Esper系列(十)NamedWindow语法delete、Select+Delete、Update
Esper系列(九)NamedWindow语法create、Insert、select
Esper系列(八)Method Definition、Schema
Docker系列(五)OVS+Docker网络打通示例
原文地址：https://www.cnblogs.com/qq84435/p/3664823.html