零基础学数据科学:Windows环境搭建避坑指南
|
去年春天,我带着三个零基础学员在Windows上搭数据科学环境——结果三个人全卡在Anaconda安装界面,其中两人因为路径含中文直接报错,另一人更离谱——把Python装在C盘根目录后,系统直接提示“磁盘空间不足”(他C盘还剩200G)。这事儿让我意识到:Windows环境搭建的坑,比代码里的bug更难找。 先说最容易翻车的Anaconda——这个被吹爆的“数据科学全家桶”,在Windows上简直是个“问题制造机”。我实测发现,安装时勾选“Add to PATH”选项,80%的人会遇到“conda不是内部命令”的报错(别问我怎么知道的,上周刚帮学员远程解决过)。更坑的是,它的默认安装路径是C:\Users\用户名\Anaconda3,但凡用户名带中文或空格,后续装包时绝对报UnicodeDecodeError——我学员“张三”的电脑,就因为这个折腾了俩小时。 那咋办?我的经验是:安装时手动改路径到D:\Anaconda3(别用C盘!),并且坚决不勾选“Add to PATH”(装完后再手动配置环境变量)。对了,装完记得用“conda --version”测试,如果显示“不是内部命令”,别慌——打开Anaconda Prompt(开始菜单里找),输入“where conda”,把输出的路径(比如D:\Anaconda3\Scripts\conda.exe)复制到系统环境变量的Path里,重启终端就OK了。 再聊聊Python版本——数据科学圈现在主推3.8+,但Windows用户千万别手贱装最新版(比如3.12)。去年有个学员装了3.12,结果跑Pandas时直接报“AttributeError: module 'numpy' has no attribute 'ndarray'”,后来发现是NumPy和最新Python不兼容。我的建议是:直接用Anaconda自带的Python 3.8或3.9(装Anaconda时会自动配好),省心又稳定——毕竟数据科学库的更新速度,永远跟不上Python新版本的“破坏力”。 Jupyter Notebook的坑更隐蔽——很多人装完能打开,但一运行代码就卡死。我排查过十几个案例,发现80%是因为浏览器问题。Windows自带的Edge和IE,对Jupyter的兼容性差到离谱(尤其是IE,直接白屏)。我的解决方案是:装Chrome或Firefox,然后在Jupyter启动时指定浏览器——比如用“jupyter notebook --browser=chrome”命令(前提是Chrome已设为默认浏览器)。对了,如果Jupyter界面乱码,试试在终端先运行“chcp 65001”切换编码,亲测有效。 说到编码,Windows的“GBK”简直是数据科学的噩梦——读CSV时经常报“UnicodeDecodeError”。去年有个学员用Pandas读文件,因为文件里有中文,直接报错“'gbk' codec can't decode byte 0xXX”。我的办法是:读文件时显式指定编码为“utf-8”或“gb18030”(后者兼容性更好),比如“pd.read_csv('data.csv', encoding='gb18030')”。如果文件是别人给的,不确定编码?用Notepad++打开,右下角会显示当前编码——记下来,读文件时用就行。 最后说个冷门但致命的坑——Windows Defender。有学员装完TensorFlow后,运行代码时系统直接弹出“恶意软件阻止”提示,原来Defender把TensorFlow的某些文件误判为病毒。更坑的是,即使添加白名单,下次更新时还是会拦截。我的解决方案是:暂时关闭Defender(设置→更新和安全→Windows安全中心→病毒和威胁防护→管理设置→关闭实时保护),装完库后再打开——当然,装完记得全盘扫描一遍,安全第一嘛。 有人可能会问:“为啥不用WSL或Docker?Windows搞数据科学太麻烦!”——这话对,但不对零基础。我让学员用WSL,结果他们连“bash”是啥都不知道;用Docker,光是装Hyper-V就卡了半小时。Windows环境搭建的优点恰恰在“新技术”的包容性——它允许你用最“笨”的方式(比如直接装Anaconda)入门,再逐步过渡到更专业的工具。毕竟,零基础的第一步,是先跑通“Hello World”,而不是纠结“用不用WSL”。
文章配图,仅供参考 下一步该干啥?如果你已经装好了Anaconda,打开终端输入“conda create -n my_env python=3.8”创建一个新环境(别用默认的base环境,容易冲突),然后“conda activate my_env”激活,再“pip install pandas numpy matplotlib”装几个基础库——能运行“import pandas as pd”不报错,就算成功一半了。至于剩下的坑?放心,你还会遇到更多——但至少现在,你已经跨过了第一道门槛。(编辑:站长网) 【声明】本站内容均来自网络,其相关言论仅代表作者个人观点,不代表本站立场。若无意侵犯到您的权利,请及时与联系站长删除相关内容! |

