Python AI入门：从Hello World到图像分类

优质文章学习记录

07 Apr 2026 — 6 min read

Python AI入门：从Hello World到图像分类

一、Python AI的Hello World

1.1 环境搭建

首先，我们需要搭建Python AI的开发环境：

# 安装PyTorch pip install torch torchvision # 安装其他依赖 pip install numpy matplotlib

1.2 第一个AI程序

让我们来编写一个最简单的AI程序 - 线性回归：

import torch import torch.nn as nn import numpy as np import matplotlib.pyplot as plt # 生成训练数据 x = torch.linspace(0,10,100).unsqueeze(1) y =2* x +1+ torch.randn(100,1)*0.5# 定义模型classLinearModel(nn.Module):def__init__(self):super(LinearModel, self).__init__() self.linear = nn.Linear(1,1)defforward(self, x):return self.linear(x)# 创建模型实例 model = LinearModel()# 定义损失函数和优化器 criterion = nn.MSELoss() optimizer = torch.optim.SGD(model.parameters(), lr=0.01)# 训练模型 epochs =100for epoch inrange(epochs):# 前向传播 outputs = model(x)# 计算损失 loss = criterion(outputs, y)# 反向传播 optimizer.zero_grad() loss.backward()# 更新参数 optimizer.step()if(epoch +1)%10==0:print(f'Epoch [{epoch+1}/{epochs}], Loss: {loss.item():.4f}')# 测试模型with torch.no_grad(): predicted = model(x)# 可视化结果 plt.scatter(x.numpy(), y.numpy(), label='Original data') plt.plot(x.numpy(), predicted.numpy(),'r-', label='Fitted line') plt.legend() plt.show()print("Hello World! AI模型训练完成")

二、从线性回归到神经网络

2.1 神经网络基础

线性回归是最简单的AI模型，而神经网络则是更复杂的模型。让我们来构建一个简单的神经网络：

import torch import torch.nn as nn import torch.optim as optim # 生成非线性数据 x = torch.linspace(-1,1,100).unsqueeze(1) y = x.pow(2)+0.2* torch.randn(100,1)# 定义神经网络模型classNeuralNet(nn.Module):def__init__(self):super(NeuralNet, self).__init__() self.hidden = nn.Linear(1,10) self.output = nn.Linear(10,1)defforward(self, x): x = torch.relu(self.hidden(x)) x = self.output(x)return x # 创建模型实例 model = NeuralNet()# 定义损失函数和优化器 criterion = nn.MSELoss() optimizer = optim.SGD(model.parameters(), lr=0.01)# 训练模型 epochs =1000for epoch inrange(epochs): outputs = model(x) loss = criterion(outputs, y) optimizer.zero_grad() loss.backward() optimizer.step()if(epoch +1)%100==0:print(f'Epoch [{epoch+1}/{epochs}], Loss: {loss.item():.4f}')# 测试模型with torch.no_grad(): predicted = model(x)# 可视化结果import matplotlib.pyplot as plt plt.scatter(x.numpy(), y.numpy(), label='Original data') plt.plot(x.numpy(), predicted.numpy(),'r-', label='Neural network prediction') plt.legend() plt.show()

2.2 理解神经网络的工作原理

神经网络的基本原理是通过多层神经元的组合，学习数据中的复杂模式：

输入层：接收原始数据
隐藏层：提取数据特征
输出层：产生预测结果
激活函数：引入非线性，使网络能够学习复杂模式

三、图像分类入门

3.1 数据准备

我们将使用MNIST数据集进行图像分类：

import torch import torchvision import torchvision.transforms as transforms # 数据预处理 transform = transforms.Compose([ transforms.ToTensor(), transforms.Normalize((0.5,),(0.5,))])# 加载MNIST数据集 trainset = torchvision.datasets.MNIST(root='./data', train=True, download=True, transform=transform) trainloader = torch.utils.data.DataLoader(trainset, batch_size=64, shuffle=True) testset = torchvision.datasets.MNIST(root='./data', train=False, download=True, transform=transform) testloader = torch.utils.data.DataLoader(testset, batch_size=64, shuffle=False)# 查看数据import matplotlib.pyplot as plt import numpy as np # 函数：显示图像defimshow(img): img = img /2+0.5# 反归一化 npimg = img.numpy() plt.imshow(np.transpose(npimg,(1,2,0))) plt.show()# 获取一批训练数据 dataiter =iter(trainloader) images, labels =next(dataiter)# 显示图像 imshow(torchvision.utils.make_grid(images))print('标签:',' '.join(f'{labels[j]}'for j inrange(4)))

3.2 构建图像分类模型

现在我们来构建一个用于图像分类的卷积神经网络：

import torch.nn as nn import torch.nn.functional as F classNet(nn.Module):def__init__(self):super(Net, self).__init__()# 卷积层 self.conv1 = nn.Conv2d(1,32,3,1) self.conv2 = nn.Conv2d(32,64,3,1)# 池化层 self.pool = nn.MaxPool2d(2,2)# 全连接层 self.fc1 = nn.Linear(64*12*12,128) self.fc2 = nn.Linear(128,10)defforward(self, x): x = self.pool(F.relu(self.conv1(x))) x = self.pool(F.relu(self.conv2(x))) x = x.view(-1,64*12*12) x = F.relu(self.fc1(x)) x = self.fc2(x)return x # 创建模型实例 net = Net()print(net)

3.3 训练图像分类模型

import torch.optim as optim # 定义损失函数和优化器 criterion = nn.CrossEntropyLoss() optimizer = optim.SGD(net.parameters(), lr=0.001, momentum=0.9)# 训练模型 epochs =5for epoch inrange(epochs): running_loss =0.0for i, data inenumerate(trainloader,0):# 获取输入 inputs, labels = data # 清零梯度 optimizer.zero_grad()# 前向传播 outputs = net(inputs)# 计算损失 loss = criterion(outputs, labels)# 反向传播 loss.backward()# 更新参数 optimizer.step()# 统计损失 running_loss += loss.item()if i %100==99:print(f'[{epoch +1}, {i +1}] loss: {running_loss /100:.3f}') running_loss =0.0print('训练完成')

3.4 测试模型

# 测试模型 correct =0 total =0with torch.no_grad():for data in testloader: images, labels = data outputs = net(images) _, predicted = torch.max(outputs.data,1) total += labels.size(0) correct +=(predicted == labels).sum().item()print(f'测试准确率: {100* correct / total:.2f}%')# 查看预测结果 dataiter =iter(testloader) images, labels =next(dataiter)# 显示图像 imshow(torchvision.utils.make_grid(images))print('真实标签:',' '.join(f'{labels[j]}'for j inrange(4)))# 预测 outputs = net(images) _, predicted = torch.max(outputs,1)print('预测标签:',' '.join(f'{predicted[j]}'for j inrange(4)))

四、从Rust开发者角度的思考

4.1 与Rust的对比

作为一个Rust开发者，学习Python AI有以下感受：

开发效率：Python的开发效率比Rust高，尤其是在AI开发中
生态系统：Python的AI生态系统非常丰富，有大量成熟的库
性能：Python的性能虽然不如Rust，但在AI开发中，PyTorch等库已经做了很多优化
类型系统：Python的动态类型与Rust的静态类型有很大不同，需要适应

4.2 学习建议

对于Rust开发者学习Python AI，我有以下建议：

利用系统思维：Rust的系统级编程经验有助于理解AI模型的底层实现
注重代码质量：保持Rust的代码风格，写出清晰、可维护的Python代码
实践项目：通过实际项目巩固学习成果
跨语言学习：将Rust和Python结合起来，发挥各自的优势

五、总结

通过从Hello World到图像分类的学习，我已经初步掌握了Python AI的基本概念和使用方法。作为一个Rust开发者，我发现Python AI的学习过程既有挑战也有机遇。

挑战在于Python的动态类型和内存管理与Rust有很大不同，需要适应新的思维方式。机遇在于Python的AI生态系统非常丰富，开发效率高，能够快速实现AI模型。

JSBSim 1.0.0无人机仿真系统完整实战手册

本文还有配套的精品资源，点击获取简介：JSBSim 1.0.0是一款基于Java的开源无人机飞行模拟框架，用于高精度仿真无人机的动力学行为和飞行控制。新版在动力系统、环境建模、控制系统、接口设计、性能优化等方面均有显著提升，支持多种无人机类型和飞行场景模拟。适用于无人机研发、控制算法测试、故障模拟与自主导航开发，是无人机研究者和开发者的重要工具。本资料基于完整1.0.0版本内容，适合无人机技术学习与项目实践使用。 1. JSBSim无人机仿真框架概述 JSBSim是一个基于C++开发的开源飞行器动力学仿真引擎，具备高精度的飞行物理建模能力，广泛应用于无人机系统的设计、测试与仿真验证。其模块化架构支持灵活配置，涵盖动力系统、空气动力学、环境模拟与飞行控制等多个核心模块。其核心优势在于： - 开源可扩展：用户可通过XML配置文件定义飞行器模型，并支持自定义模块的集成。 - 跨平台兼容性：支持Linux、Windows及macOS系统，便于多平台仿真部署。 - 高精度仿真：采用实时物理引擎，结合大气模型与传感器建模，提供接近真实飞行的模拟环境。本章将为读者梳理JSB

仿生新势力：Openclaw开源仿生爪，如何革新机器人抓取？

仿生新势力：Openclaw开源仿生爪，如何革新机器人抓取？引言在仓储、农业乃至家庭服务中，机器人如何像猫一样灵巧、自适应地抓取千变万化的物体？这曾是行业难题。如今，一个名为 Openclaw 的开源仿生机械爪项目，正以其独特的被动适应性设计和亲民的成本，在机器人末端执行器领域掀起波澜。本文将深入解析Openclaw的仿生奥秘、实现原理、应用场景及未来布局，带你全面了解这款来自开源社区的“仿生新势力”。一、核心揭秘：从猫爪到机械爪的实现原理本节将拆解Openclaw如何将生物灵感转化为工程现实。 1. 仿生学设计理念 Openclaw的核心灵感源于猫科动物爪部。当猫抓取物体时，其爪趾会自然地包裹贴合物体表面，这种能力主要依赖于其肌腱和骨骼的被动结构，而非大脑的实时精密控制。Openclaw借鉴了这一思想，核心是被动适应性机制。它无需依赖复杂的传感器反馈和实时力控算法，仅凭精巧的机械结构即可根据物体形状自动调整接触点和抓取力，从而极大地简化了控制系统。配图建议：猫爪与Openclaw的对比图，或Openclaw抓取不同形状物体的动态示意图。 2. 欠驱动与

【选型】地瓜机器人RDK系列选型指南：X3 vs X5 vs S100 vs S100P（含资源对比图）

在机器人开发领域，地瓜机器人（D-Robotics）凭借其“RDK（Robot Developer Kit）”系列开发套件，已成为众多开发者和创业团队的首选平台。从轻量级边缘计算到高性能具身智能，地瓜机器人已构建了覆盖多场景的完整产品线，致力于为开发者提供高性价比、高集成度、高扩展性的解决方案。其核心芯片“旭日®”系列持续迭代，推动AI与机器人深度融合，助力实现从感知到控制的全链路自主化。本文将深入对比当前主流的四款RDK开发套件：RDK X3、RDK X5、RDK S100、RDK S100P，并提供详细的资源对比图与应用场景分析，帮助你快速完成技术选型，降低开发门槛，提升项目落地效率。一、产品定位概览在深入参数前，先明确每款产品的核心定位，以便根据项目阶段、预算和性能需求做出合理选择。 ● RDK X3：轻量级边缘AI计算模组，适合入门级机器人、智能摄像头、无人机等低功耗、小体积场景。是初学者和教育项目的理想起点，具备基础AI推理能力，可快速搭建视觉识别系统。 ● RDK

FPGA实现多协议编码器接口：BISS-C、SSI与多摩川的集成设计

1. 工业编码器接口的统一挑战与FPGA方案在工业自动化领域，高精度运动控制系统的核心挑战之一是如何高效集成多种编码器协议。不同厂商的编码器采用不同的通信协议，比如BISS-C、SSI和多摩川协议，每种协议都有自己的时序要求、数据格式和校验机制。传统方案往往需要为每种协议设计独立的硬件接口，这不仅增加了系统复杂度，还提高了成本和维护难度。我在实际项目中多次遇到这样的需求：客户希望用一个控制板卡同时支持多种编码器，但又不愿意增加额外的硬件成本。这时候FPGA的优势就凸显出来了。FPGA的可编程特性允许我们在同一块硬件上实现多种协议接口，通过逻辑资源复用和状态机控制，真正做到"硬件统一、软件定义"。我记得有一次为数控机床项目设计编码器接口时，就遇到了同时连接BISS-C和多摩川编码器的需求。最初尝试用MCU+多路转换芯片的方案，但实时性总是达不到要求。后来转向FPGA方案，不仅实现了协议兼容，还将响应时间从原来的毫秒级降低到了微秒级。这种性能提升对于高精度运动控制来说是至关重要的。 2. BISS-C协议深度解析与FPGA实现 2.1 BISS-C协议核心机制 BISS