Unix系统(如Linux、macOS)是机器学习开发的主流平台,其稳定性和可定制性深受研究者与工程师青睐。环境搭建需兼顾系统兼容性、依赖隔离与可复现性。
基础工具链应优先安装:GNU编译器套件(gcc)、CMake、pkg-config及Python(推荐3.9–3.12)。macOS用户通过Xcode Command Line Tools获取核心编译支持;Linux发行版则使用原生包管理器,如Ubuntu/Debian执行sudo apt install build-essential python3-dev,CentOS/RHEL用sudo dnf groupinstall \”Development Tools\” python3-devel。

AI渲染图,仅供参考
Python环境建议采用pyenv统一管理多版本解释器,避免系统Python被意外污染。配合pipx安装独立沙盒化的命令行工具(如cookiecutter、jupyter),确保全局命令不干扰项目依赖。
项目级依赖必须隔离。强烈推荐使用venv(标准库)或poetry(支持pyproject.toml和锁定文件)。pip install –user仅适用于个人脚本工具,绝不用于项目依赖管理。注意禁用–user标志以防止隐式依赖冲突。
科学计算包如NumPy、SciPy、PyTorch需匹配系统架构与CUDA版本。Linux上优先使用conda-forge渠道的预编译包,可规避大量源码编译;macOS M系列芯片用户应选用arm64架构的wheel包,禁用x86_64模拟运行。安装PyTorch时务必核对官网提供的精确命令,包含正确的cu118/cu121或cpu-only标识。
环境变量需谨慎设置:PYTHONPATH应为空或严格限定,LD_LIBRARY_PATH仅在必要时临时指定本地库路径,避免覆盖系统默认链接行为。调试时可用python -m site验证实际生效的site-packages位置。
最终,所有环境配置应通过可执行的shell脚本或Dockerfile固化,结合requirements.txt或poetry.lock实现跨机器精准重建。避免手工逐条pip install——每一次不可复现的操作,都是未来调试成本的伏笔。