当前位置：首页 > news >正文

【自然语言处理（NLP）】基于Transformer架构的预训练语言模型：BERT 训练之数据集处理、训练代码实现

news 来源：原创 2025/9/10 14:52:58

文章目录

介绍
BERT 训练之数据集处理
- BERT 原理及模型代码实现
- 数据集处理
- - 导包
  - 加载数据
  - 生成下一句预测任务的数据
  - 从段落中获取nsp数据
  - 生成遮蔽语言模型任务的数据
  - 从token中获取mlm数据
  - 将文本转换为预训练数据集
  - 创建Dataset
  - 加载WikiText-2数据集
BERT 训练代码实现
- 导包
- 加载数据
- 构建BERT模型
- 模型损失
- 训练
- 获取BERT编码器

个人主页：道友老李
欢迎加入社区：道友老李的学习社区

介绍

**自然语言处理（Natural Language Processing，NLP）**是计算机科学领域与人工智能领域中的一个重要方向。它研究的是人类（自然）语言与计算机之间的交互。NLP的目标是让计算机能够理解、解析、生成人类语言，并且能够以有意义的方式回应和操作这些信息。

NLP的任务可以分为多个层次，包括但不限于：

词法分析：将文本分解成单词或标记（token），并识别它们的词性（如名词、动词等）。
句法分析：分析句子结构，理解句子中词语的关系，比如主语、谓语、宾语等。
语义分析：试图理解句子的实际含义，超越字面意义，捕捉隐含的信息。
语用分析：考虑上下文和对话背景，理解话语在特定情境下的使用目的。
情感分析：检测文本中表达的情感倾向，例如正面、负面或中立。
机器翻译：将一种自然语言转换为另一种自然语言。
问答系统：构建可以回答用户问题的系统。
文本摘要：从大量文本中提取关键信息，生成简短的摘要。
命名实体识别（NER）：识别文本中提到的特定实体，如人名、地名、组织名等。
语音识别：将人类的语音转换为计算机可读的文字格式。

NLP技术的发展依赖于算法的进步、计算能力的提升以及大规模标注数据集的可用性。近年来，深度学习方法，特别是基于神经网络的语言模型，如BERT、GPT系列等，在许多NLP任务上取得了显著的成功。随着技术的进步，NLP正在被应用到越来越多的领域，包括客户服务、智能搜索、内容推荐、医疗健康等。

BERT 训练之数据集处理

BERT 原理及模型代码实现

【自然语言处理（NLP）】基于Transformer架构的预训练语言模型：BERT 原理及代码实现

数据集处理

导包

import os
import random
import torch
import dltools

加载数据

def _read_wiki(data_dir):file_name = os.path.join(data_dir, 'wiki.train.tokens')with open(file_name, 'r',encoding="utf-8") as f:lines = f.readlines()# 大写字母转换为小写字母paragraphs = [line.strip().lower().split(' . ') for line in lines if len(line.split(' . ')) >= 2]random.shuffle(paragraphs)return paragraphs_read_wiki('./wikitext-2')

在这里插入图片描述

生成下一句预测任务的数据

def _get_next_sentence(sentence, next_sentence, paragraphs):if random.random() < 0.5:is_next = Trueelse:# paragraphs是三重列表的嵌套next_sentence = random.choice(random.choice(paragraphs))is_next = Falsereturn sentence, next_sentence, is_next

从段落中获取nsp数据

def _get_nsp_data_from_paragraph(paragraph, paragraphs, vocab, max_len):nsp_data_from_paragraph = []for i in range(len(paragraph) - 1):tokens_a, tokens_b, is_next = _get_next_sentence(paragraph[i], paragraph[i + 1], paragraphs)# 考虑1个'<cls>'词元和2个'<sep>'词元if len(tokens_a) + len(tokens_b) + 3 > max_len:continuetokens, segments = dltools.get_tokens_and_segments(tokens_a, tokens_b)nsp_data_from_paragraph.append((tokens, segments, is_next))return nsp_data_from_paragraph

生成遮蔽语言模型任务的数据

为遮蔽语言模型的输入创建新的词元副本，其中输入可能包含替换的mask或随机词元
打乱后用于在遮蔽语言模型任务中获取15%的随机词元进行预测
80%的时间：将词替换为mask词元
10%的时间：保持词不变
10%的时间：用随机词替换该词

def _replace_mlm_tokens(tokens, candidate_pred_positions, num_mlm_preds,vocab):# 为遮蔽语言模型的输入创建新的词元副本，其中输入可能包含替换的“<mask>”或随机词元mlm_input_tokens = [token for token in tokens]pred_positions_and_labels = []# 打乱后用于在遮蔽语言模型任务中获取15%的随机词元进行预测random.shuffle(candidate_pred_positions)for mlm_pred_position in candidate_pred_positions:if len(pred_positions_and_labels) >= num_mlm_preds:breakmasked_token = None# 80%的时间：将词替换为“<mask>”词元if random.random() < 0.8:masked_token = '<mask>'else:# 10%的时间：保持词不变if random.random() < 0.5:masked_token = tokens[mlm_pred_position]# 10%的时间：用随机词替换该词else:masked_token = random.choice(vocab.idx_to_token)mlm_input_tokens[mlm_pred_position] = masked_tokenpred_positions_and_labels.append((mlm_pred_position, tokens[mlm_pred_position]))return mlm_input_tokens, pred_positions_and_labels

从token中获取mlm数据

在遮蔽语言模型任务中不会预测特殊词元

def _get_mlm_data_from_tokens(tokens, vocab):candidate_pred_positions = []# tokens是一个字符串列表for i, token in enumerate(tokens):# 在遮蔽语言模型任务中不会预测特殊词元if token in ['<cls>', '<sep>']:continuecandidate_pred_positions.append(i)# 遮蔽语言模型任务中预测15%的随机词元num_mlm_preds = max(1, round(len(tokens) * 0.15))mlm_input_tokens, pred_positions_and_labels = _replace_mlm_tokens(tokens, candidate_pred_positions, num_mlm_preds, vocab)pred_positions_and_labels = sorted(pred_positions_and_labels,key=lambda x: x[0])pred_positions = [v[0] for v in pred_positions_and_labels]mlm_pred_labels = [v[1] for v in pred_positions_and_labels]return vocab[mlm_input_tokens], pred_positions, vocab[mlm_pred_labels]

将文本转换为预训练数据集

valid_lens不包括’'的计数
填充词元的预测将通过乘以0权重在损失中过滤掉

def _pad_bert_inputs(examples, max_len, vocab):max_num_mlm_preds = round(max_len * 0.15)all_token_ids, all_segments, valid_lens,  = [], [], []all_pred_positions, all_mlm_weights, all_mlm_labels = [], [], []nsp_labels = []for (token_ids, pred_positions, mlm_pred_label_ids, segments,is_next) in examples:all_token_ids.append(torch.tensor(token_ids + [vocab['<pad>']] * (max_len - len(token_ids)), dtype=torch.long))all_segments.append(torch.tensor(segments + [0] * (max_len - len(segments)), dtype=torch.long))# valid_lens不包括'<pad>'的计数valid_lens.append(torch.tensor(len(token_ids), dtype=torch.float32))all_pred_positions.append(torch.tensor(pred_positions + [0] * (max_num_mlm_preds - len(pred_positions)), dtype=torch.long))# 填充词元的预测将通过乘以0权重在损失中过滤掉all_mlm_weights.append(torch.tensor([1.0] * len(mlm_pred_label_ids) + [0.0] * (max_num_mlm_preds - len(pred_positions)),dtype=torch.float32))all_mlm_labels.append(torch.tensor(mlm_pred_label_ids + [0] * (max_num_mlm_preds - len(mlm_pred_label_ids)), dtype=torch.long))nsp_labels.append(torch.tensor(is_next, dtype=torch.long))return (all_token_ids, all_segments, valid_lens, all_pred_positions,all_mlm_weights, all_mlm_labels, nsp_labels)

创建Dataset

输入paragraphs[i]是代表段落的句子字符串列表
而输出paragraphs[i]是代表段落的句子列表，其中每个句子都是词元列表
获取下一句子预测任务的数据
获取遮蔽语言模型任务的数据
填充输入

class _WikiTextDataset(torch.utils.data.Dataset):def __init__(self, paragraphs, max_len):# 输入paragraphs[i]是代表段落的句子字符串列表；# 而输出paragraphs[i]是代表段落的句子列表，其中每个句子都是词元列表paragraphs = [dltools.tokenize(paragraph, token='word') for paragraph in paragraphs]sentences = [sentence for paragraph in paragraphsfor sentence in paragraph]self.vocab = dltools.Vocab(sentences, min_freq=5, reserved_tokens=['<pad>', '<mask>', '<cls>', '<sep>'])# 获取下一句子预测任务的数据examples = []for paragraph in paragraphs:examples.extend(_get_nsp_data_from_paragraph(paragraph, paragraphs, self.vocab, max_len))# 获取遮蔽语言模型任务的数据examples = [(_get_mlm_data_from_tokens(tokens, self.vocab)+ (segments, is_next))for tokens, segments, is_next in examples]# 填充输入(self.all_token_ids, self.all_segments, self.valid_lens,self.all_pred_positions, self.all_mlm_weights,self.all_mlm_labels, self.nsp_labels) = _pad_bert_inputs(examples, max_len, self.vocab)def __getitem__(self, idx):return (self.all_token_ids[idx], self.all_segments[idx],self.valid_lens[idx], self.all_pred_positions[idx],self.all_mlm_weights[idx], self.all_mlm_labels[idx],self.nsp_labels[idx])def __len__(self):return len(self.all_token_ids)

加载WikiText-2数据集

def load_data_wiki(batch_size, max_len):"""加载WikiText-2数据集"""num_workers = dltools.get_dataloader_workers()data_dir = "./wikitext-2/"paragraphs = _read_wiki(data_dir)train_set = _WikiTextDataset(paragraphs, max_len)train_iter = torch.utils.data.DataLoader(train_set, batch_size,shuffle=True, num_workers=num_workers)return train_iter, train_set.vocabbatch_size, max_len = 512, 64
train_iter, vocab = load_data_wiki(batch_size, max_len)for (tokens_X, segments_X, valid_lens_x, pred_positions_X, mlm_weights_X,mlm_Y, nsp_y) in train_iter:print(tokens_X.shape, segments_X.shape, valid_lens_x.shape,pred_positions_X.shape, mlm_weights_X.shape, mlm_Y.shape,nsp_y.shape)break

torch.Size([512, 64]) torch.Size([512, 64]) torch.Size([512]) torch.Size([512, 10]) torch.Size([512, 10]) torch.Size([512, 10]) torch.Size([512])

len(vocab)

BERT 训练代码实现

导包

import torch
from torch import nn
import dltools

加载数据

dltools中加载本地wiki文件，请自行修改路径 ./data/wikitext-2

batch_size, max_len = 1, 64
# dltools中加载本地wiki文件，请自行修改路径 ./data/wikitext-2
train_iter, vocab = dltools.load_data_wiki(batch_size, max_len)# tokens, segments, valid_lens, pred_positions, mlm_weights,mlm, nsp
for i in train_iter:break
i

在这里插入图片描述

构建BERT模型

net = dltools.BERTModel(len(vocab), num_hiddens=128, norm_shape=[128],ffn_num_input=128, ffn_num_hiddens=256, num_heads=2,num_layers=2, dropout=0.2, key_size=128, query_size=128,value_size=128, hid_in_features=128, mlm_in_features=128,nsp_in_features=128)
devices = dltools.try_all_gpus()

模型损失

前向传播
计算遮蔽语言模型损失
计算下一句子预测任务的损失

loss = nn.CrossEntropyLoss()def _get_batch_loss_bert(net, loss, vocab_size, tokens_X,segments_X, valid_lens_x,pred_positions_X, mlm_weights_X,mlm_Y, nsp_y):# 前向传播_, mlm_Y_hat, nsp_Y_hat = net(tokens_X, segments_X,valid_lens_x.reshape(-1),pred_positions_X)# 计算遮蔽语言模型损失mlm_l = loss(mlm_Y_hat.reshape(-1, vocab_size), mlm_Y.reshape(-1)) * mlm_weights_X.reshape(-1, 1)mlm_l = mlm_l.sum() / (mlm_weights_X.sum() + 1e-8)# 计算下一句子预测任务的损失nsp_l = loss(nsp_Y_hat, nsp_y)l = mlm_l + nsp_lreturn mlm_l, nsp_l, l

训练

遮蔽语言模型损失的和，下一句预测任务损失的和，句子对的数量，计数

def train_bert(train_iter, net, loss, vocab_size, devices, num_steps):net = nn.DataParallel(net, device_ids=devices).to(devices[0])trainer = torch.optim.Adam(net.parameters(), lr=0.01)step, timer = 0, dltools.Timer()animator = dltools.Animator(xlabel='step', ylabel='loss',xlim=[1, num_steps], legend=['mlm', 'nsp'])# 遮蔽语言模型损失的和，下一句预测任务损失的和，句子对的数量，计数metric = dltools.Accumulator(4)num_steps_reached = Falsewhile step < num_steps and not num_steps_reached:for tokens_X, segments_X, valid_lens_x, pred_positions_X,mlm_weights_X, mlm_Y, nsp_y in train_iter:tokens_X = tokens_X.to(devices[0])segments_X = segments_X.to(devices[0])valid_lens_x = valid_lens_x.to(devices[0])pred_positions_X = pred_positions_X.to(devices[0])mlm_weights_X = mlm_weights_X.to(devices[0])mlm_Y, nsp_y = mlm_Y.to(devices[0]), nsp_y.to(devices[0])trainer.zero_grad()timer.start()mlm_l, nsp_l, l = _get_batch_loss_bert(net, loss, vocab_size, tokens_X, segments_X, valid_lens_x,pred_positions_X, mlm_weights_X, mlm_Y, nsp_y)l.backward()trainer.step()metric.add(mlm_l, nsp_l, tokens_X.shape[0], 1)timer.stop()animator.add(step + 1,(metric[0] / metric[3], metric[1] / metric[3]))step += 1if step == num_steps:num_steps_reached = Truebreakprint(f'MLM loss {metric[0] / metric[3]:.3f}, 'f'NSP loss {metric[1] / metric[3]:.3f}')print(f'{metric[2] / timer.sum():.1f} sentence pairs/sec on 'f'{str(devices)}')train_bert(train_iter, net, loss, len(vocab), devices, 500)

在这里插入图片描述

获取BERT编码器

def get_bert_encoding(net, tokens_a, tokens_b=None):tokens, segments = dltools.get_tokens_and_segments(tokens_a, tokens_b)token_ids = torch.tensor(vocab[tokens], device=devices[0]).unsqueeze(0)segments = torch.tensor(segments, device=devices[0]).unsqueeze(0)valid_len = torch.tensor(len(tokens), device=devices[0]).unsqueeze(0)encoded_X, _, _ = net(token_ids, segments, valid_len)return encoded_Xtokens_a = ['a', 'crane', 'is', 'flying']
encoded_text = get_bert_encoding(net, tokens_a)
# 词元：'<cls>','a','crane','is','flying','<sep>'
encoded_text_cls = encoded_text[:, 0, :]
encoded_text_crane = encoded_text[:, 2, :]
encoded_text.shape, encoded_text_cls.shape, encoded_text_crane[0][:3]

(torch.Size([1, 6, 128]),torch.Size([1, 128]),tensor([-1.0005,  0.8355,  0.2930], grad_fn=<SliceBackward0>))

tokens_a, tokens_b = ['a', 'crane', 'driver', 'came'], ['he', 'just', 'left']
encoded_pair = get_bert_encoding(net, tokens_a, tokens_b)
# 词元：'<cls>','a','crane','driver','came','<sep>','he','just',
# 'left','<sep>'
encoded_pair_cls = encoded_pair[:, 0, :]
encoded_pair_crane = encoded_pair[:, 2, :]
encoded_pair.shape, encoded_pair_cls.shape, encoded_pair_crane[0][:3]

(torch.Size([1, 10, 128]),torch.Size([1, 128]),tensor([-1.0168,  0.8235,  0.2141], grad_fn=<SliceBackward0>))

【自然语言处理（NLP）】基于Transformer架构的预训练语言模型：BERT 训练之数据集处理、训练代码实现

文章目录介绍BERT 训练之数据集处理BERT 原理及模型代码实现数据集处理导包加载数据生成下一句预测任务的数据从段落中获取nsp数据生成遮蔽语言模型任务的数据从token中获取mlm数据将文本转换为预训练数据集创建Dataset加载WikiText-2数据集 BERT 训练代码实现导包加载数据构建…...

编程日记 2025/9/10 14:52:58

深度解析：网站快速收录与网站安全性的关系

本文转自：百万收录网原文链接：https://www.baiwanshoulu.com/58.html 网站快速收录与网站安全性之间存在着密切的关系。以下是对这一关系的深度解析： 一、网站安全性对收录的影响搜索引擎惩罚： 如果一个网站存在安全隐患&am…...

编程日记 2025/9/8 21:09:25

《基于Scapy的综合性网络扫描与通信工具集解析》

在网络管理和安全评估中，网络扫描和通信是两个至关重要的环节。Python 的 Scapy 库因其强大的网络数据包处理能力，成为开发和实现这些功能的理想工具。本文将介绍一个基于 Scapy 编写的 Python 脚本，该脚本集成了 ARP 扫描、端口扫描以及 TCP…...

编程日记 2025/9/9 9:09:30

MySQL索引详解

MySQL索引详解什么是索引索引的原理索引的分类索引的数据结构二叉树平衡二叉树B树B树聚集索引与非聚集索引概念利用聚集索引查找数据利用非聚集索引查找数据覆盖索引与回表操作如何正确使用索引什么是索引索引是存储引擎中一种数据结构，或者说数据的组织方式&…...

编程日记 2025/9/8 19:03:42

【NEXT】网络编程——上传文件（不限于jpg/png/pdf/txt/doc等），或请求参数值是file类型时，调用在线服务接口

最近在使用华为AI平台ModelArts训练自己的图像识别模型，并部署了在线服务接口。供给客户端（如：鸿蒙APP/元服务）调用。 import核心能力： import { http } from kit.NetworkKit; import { fileIo } from kit.CoreFileK…...

编程日记 2025/9/4 4:47:28

【Qt】界面优化

界面优化设置全局样式样式文件使⽤ Qt Designer 编辑样式选择器设置子控件样式伪类选择器样式属性盒模型设置按钮样式设置复选框样式输入框样式列表样式菜单栏样式在 Qt 中对界面的优化和 CSS 类似。语法结构如下： 选择器 {属性名: 属性值; }例如： QP…...

编程日记 2025/9/10 14:51:00

机器学习算法在网络安全中的实践

机器学习算法在网络安全中的实践本文将深入探讨机器学习算法在网络安全领域的应用实践，包括基本概念、常见算法及其应用案例，从而帮助程序员更好地理解和应用这一领域的技术。"> 序言网络安全一直是信息技术领域的重要议题，随着互联…...

编程日记 2025/9/9 15:54:17

课题介绍：基于惯性与单目视觉信息融合的室内微小型飞行器智能自主导航研究

室内微小型飞行器在国防、物流和监测等领域中应用广泛，但在复杂的非合作环境中实时避障和导航仍面临诸多挑战。由于微小型飞行器的载荷和能源限制，迫切需要开发高效的智能自主导航系统。本项目旨在研究基于惯性导航与单目视觉信息融合的技术，…...

编程日记 2025/9/5 4:47:37

Observability：实现 OpenTelemetry 原生可观察性的商业价值

作者：来自 Elastic David Hope 利用开放标准和简化的数据收集转变组织的可观察性策略。现代组织面临着前所未有的可观察性挑战。随着系统变得越来越复杂和分散，传统的监控方法难以跟上步伐。由于数据量每两年翻一番，系统跨越多个云和技术&am…...

编程日记 2025/9/8 16:59:58

nginx 报错404

404：服务器无法正常解析页面，大多是配置问题(路径配置错误)、或访问页面不存在如果你也是用nginx来转接服务的话，那你有可能碰到过这种情况，当你启动服务后，在本地打开页面，发现404，然后你找遍…...

编程日记 2025/9/2 22:42:24

2.2.1 人眼色觉与色度图

文章目录人眼色觉色度图人眼色觉视网膜上的视杆细胞、视锥细胞在人眼色觉中起到重要作用。视杆细胞主要用在弱光暗环境下，其数量远远多于视锥细胞。视锥细胞负责明亮环境的视觉，有L,M,S三种类型的细胞，分别对长、中、短波长敏感&#xff0…...

编程日记 2025/9/9 13:45:59

DeepSeek 遭 DDoS 攻击背后：DDoS 攻击的 “千层套路” 与安全防御 “金钟罩”

当算力博弈升级为网络战争：拆解DDoS攻击背后的技术攻防战——从DeepSeek遇袭看全球网络安全新趋势在数字化浪潮席卷全球的当下，网络已然成为人类社会运转的关键基础设施，深刻融入经济、生活、政务等各个领域。从金融交易的实时清算&#xf…...

编程日记 2025/9/5 4:47:40

c语言（关键字）

前言： 感谢b站鹏哥c语言内容： 栈区（存放局部变量） 堆区静态区（存放静态变量） rigister关键字寄存器，cpu优先从寄存器里边读取数据 #include <stdio.h>//typedef，类型…...

编程日记 2025/9/9 3:48:27

眼见着折叠手机面临崩溃，三星计划增强抗摔能力挽救它

据悉折叠手机开创者三星披露了一份专利，通过在折叠手机屏幕上增加一个抗冲击和遮光层的方式来增强折叠手机的抗摔能力，希望通过这种方式进一步增强折叠手机的可靠性和耐用性，来促进折叠手机的发展。据悉三星和研发可折叠玻璃的企业的做法是在…...

编程日记 2025/9/7 15:31:00

Excel to form ？一键导入微软表单

一句话痛点 “你的Excel越强大，手动复制到Forms就越痛苦。” 合并单元格崩溃成乱码、下拉菜单变纯文本、条件逻辑消失无踪——这些不是技术问题，而是低效工作模式的死刑判决书。直击解决方案：3分钟，3步，300%效率 1…...

编程日记 2025/9/9 19:38:36

使用Ollama本地化部署DeepSeek

1、Ollama 简介 Ollama 是一个开源的本地化大模型部署工具，旨在简化大型语言模型（LLM）的安装、运行和管理。它支持多种模型架构，并提供与 OpenAI 兼容的 API 接口，适合开发者和企业快速搭建私有化 AI 服务。 Ollama …...

编程日记 2025/9/8 0:46:29

【xdoj-离散线上练习】T251（C++）

解题反思： 开始敲代码前想清楚整个思路比什么都重要嘤嘤嘤！看到输入m, n和矩阵，注意不能想当然地认为就是高m，宽n的矩阵，细看含义比如本题给出了树的邻接矩阵，就是n*n的，代码实现中没有用到m这…...

编程日记 2025/9/8 17:16:27

【数据结构】_链表经典算法OJ（力扣/牛客第二弹）

目录 1. 题目1：返回倒数第k个节点 1.1 题目链接及描述 1.2 解题思路 1.3 程序 2. 题目2：链表的回文结构 2.1 题目链接及描述 2.2 解题思路 2.3 程序 1. 题目1：返回倒数第k个节点 1.1 题目链接及描述题目链接： 面试题 …...

编程日记 2025/9/6 0:34:46

线性代数复习笔记

1. 课程学习 1.1 3Blue1Brown 线性代数 2. 基本术语 eigenvector（特征向量）：线性变换中方向保持不变的向量可以视作3D旋转矩阵形成的旋转的轴...

编程日记 2025/8/28 4:48:54

51单片机 01 LED

一、点亮一个LED 在STC-ISP中单片机型号选择 STC89C52RC/LE52RC；如果没有找到hex文件（在objects文件夹下），在keil中options for target-output- 勾选 create hex file。如果要修改编程 ：重新编译-下载/编程-单片机重…...

编程日记 2025/9/7 13:09:15

用一个例子详细说明python单例模式

单例模式是一种设计模式，它确保一个类只有一个实例，并提供一个全局访问点来访问该实例。这在需要控制资源（如数据库连接、文件系统等）的访问时非常有用。下面是一个使用Python实现单例模式的例子： class Singleton:…...

编程日记 2025/9/6 20:09:12

QT知识点复习

1.qt核心机制对象树、信号和槽、事件机制 2.对象树的作用优化了内存回收机制。子对象实例化的时候，被父对象放对象树上，父对象释放内存，子对象也释放内存 3.信号和槽的作用实现多个组件之间的通讯 4.信号和槽的几种连接方式 1.UI界面提…...

编程日记 2025/9/7 13:12:06

测试集进行测试 import os import torch import numpy as np from torch.utils.data import DataLoader from sklearn.metrics import (precision_score,recall_score,f1_score,roc_curve,auc,confusion_matrix, ) import matplotlib.pyplot as plt from utils import NiiData…...

编程日记 2025/9/3 1:49:55

linux下ollama更换模型路径

Linux下更换Ollama模型下载路径指南在使用Ollama进行AI模型管理时，有时需要根据实际需求更改模型文件的存储路径。本文将详细介绍如何在Linux系统中更改Ollama模型的下载路径。一、关闭Ollama服务在更改模型路径之前，需要先停止Ollama服务。…...

编程日记 2025/9/7 7:37:45

手机上运行AI大模型(Deepseek等)

最近deepseek的大火，让大家掀起新一波的本地部署运行大模型的热潮，特别是deepseek有蒸馏的小参数量版本，电脑上就相当方便了，直接ollamaopen-webui这种类似的组合就可以轻松地实现，只要硬件，如显存&#xf…...

编程日记 2025/9/7 17:42:19

第一性原理:游戏开发成本的思考

利润营收-成本营收定价x销量x分成比例销量曝光量x 点击率x （购买率- 退款率） 分成比例 100%- 平台抽成- 税- 引擎费- 发行抽成成本开发成本运营成本开发成本人工外包办公地点租金水电设备折旧人工成本设计成本开发成本迭代修改成本后续内容…...

编程日记 2025/9/8 9:49:25

【Numpy核心编程攻略：Python数据处理、分析详解与科学计算】2.11 视图与副本：内存优化的双刃剑

2.11 视图与副本：内存优化的双刃剑目录 #mermaid-svg-OpelXRXip4Xj1A2e {font-family:"trebuchet ms",verdana,arial,sans-serif;font-size:16px;fill:#333;}#mermaid-svg-OpelXRXip4Xj1A2e .error-icon{fill:#552222;}#mermaid-svg-OpelXRXip4Xj1A2e .…...

编程日记 2025/9/9 22:09:43

React 封装高阶组件做路由权限控制

React 高阶组件是什么官方解释∶ 高阶组件（HOC）是 React 中用于复用组件逻辑的一种高级技巧。HOC 自身不是 React API 的一部分，它是一种基于 React 的组合特性而形成的设计模式。高阶组件（HOC）就是一个函数&…...

编程日记 2025/9/9 1:55:07

Python sider-ai-api库 — 访问Claude、llama、ChatGPT、gemini、o1等大模型API

目前国内少有调用ChatGPT、Claude、Gemini等国外大模型API的库。 Python库sider_ai_api 提供了一个完整的解决方案。通过调用 sider.ai 的API，开发者可以实现对这些大模型的访问。众所周知，sider是一个Chrome，以及Edge的浏览器插件&#xf…...

编程日记 2025/9/3 21:20:21

深入解析 Linux 内核内存管理核心：mm/memory.c

在 Linux 内核的众多组件中，内存管理模块是系统性能和稳定性的关键。mm/memory.c 文件作为内存管理的核心实现，承载着页面故障处理、页面表管理、内存区域映射与取消映射等重要功能。本文将深入探讨 mm/memory.c 的设计思想、关键机制以及其在内核中的作用，帮助读者更好地理…...

编程日记 2025/8/31 8:10:55

git基础使用--3---git安装和基本使用

git基础使用–3–git-安装和基本使用 1. git工具安装使用git如果不考虑开发工具我们一般需要关注三个点 1.1 git 本地化仓库管理的基础打开https://git-scm.com/downloads地址下载安装安装完成后，配置环境变量配置完打开cmd，输入git --versio…...

编程日记 2025/9/7 6:26:19

Python 网络爬虫实战：从基础到高级爬取技术

📝个人主页🌹：一ge科研小菜鸡-CSDN博客 🌹🌹期待您的关注 🌹🌹 1. 引言网络爬虫（Web Scraping）是一种自动化技术，利用程序从网页中提取数据，广泛…...

编程日记 2025/9/8 1:14:44

【PyQt】学习PyQt进行GUI开发从基础到进阶逐步掌握详细路线图和关键知识点

学习PyQt的必要性 PyQt是开发跨平台GUI应用的强大工具，适合需要构建复杂、高性能界面的开发者。无论是职业发展还是项目需求，学习PyQt都具有重要意义。 1. 跨平台GUI开发跨平台支持：PyQt基于Qt框架，支持Windows、macOS、Linux…...

编程日记 2025/9/9 15:30:00

Web - CSS3基础语法与盒模型

概述这篇文章是关于 Web 前端 CSS3 的基础语法与盒模型的讲解。包括 CSS3 层叠性及处理冲突规则、伪元素和新增伪类元素、属性选择器等。还介绍了文本与字体属性，如段落和行相关属性、字体文本属性。最后阐述了盒子模型，如元素隐藏、行内与块元素转换、…...

编程日记 2025/8/23 11:00:26

【开源免费】基于Vue和SpringBoot的公寓报修管理系统（附论文）

本文项目编号 T 186 ，文末自助获取源码 \color{red}{T186，文末自助获取源码} T186，文末自助获取源码目录一、系统介绍二、数据库设计三、配套教程3.1 启动教程3.2 讲解视频3.3 二次开发教程四、功能截图五、文案资料5.1 选题背景5.2 国内…...

编程日记 2025/9/9 3:40:59

成绩案例demo

本案例较为简单，用到的知识有 v-model、v-if、v-else、指令修饰符.prevent .number .trim等、computed计算属性、toFixed方法、reduce数组方法。涉及的功能需求有：渲染、添加、删除、修改、统计总分，求平均分等。需求效果如下&#xff1a…...

编程日记 2025/9/8 6:25:23

【tiktok 国际版抖抖♬♬ __ac_signature算法】逆向分析

一开始的参数是没有X-Bogus和 __ac_signature的先是加密请求参数得到乱码。最终得到X-Bogus 然后请求参数添加了X-Bogus之后再去生成__ac_signature __ac_signature的生成需要用到X-Bogus...

编程日记 2025/9/3 7:20:51

【Linux】动静态库

一、库静态库 .a[Linux]、.lib[windows] 动态库 .so[Linux]、.dll[windows] 二、静态库使用如果我们要做一个静态库的话，首先我们需要把我们源文件(.c/.cpp)隐藏起来，头文件(.h)必须暴露出来， 1.我们先要把我们所有的.c文件编译成.o文件…...

编程日记 2025/9/9 6:00:26

《手札·开源篇》从开源到商业化：中小企业的低成本数字化转型路径 ——以Odoo为数据中台低成本实现售前售中一体化

某机电设备有限公司数字化转型案例：以Odoo为数据中台实现售前售中一体化一、企业背景某机电设备有限公司在机电设备领域历经多年发展，业务广泛，涵盖工业自动化设备、电力设备等产品的销售与服务。随着业务版图不断拓展，企业面临…...

编程日记 2025/9/4 7:23:38

携程Android开发面试题及参考答案

在项目中，给别人发的动态点赞功能是如何实现的？数据库设计：首先要在数据库中为动态表添加一个点赞字段，用于记录点赞数量，同时可能需要一个点赞关系表，记录用户与动态之间的点赞关联，包括点赞时间等信息。界面交互：在 Android 界面上，为点赞按钮设置点击事件监听器。…...

编程日记 2025/9/9 16:43:25

Python-列表

3.1 列表是什么在Python中，列表是一种非常重要的数据结构，用于存储一系列有序的元素。列表中的每个元素都有一个索引，索引从0开始。列表可以包含任何类型的元素，包括其他列表。 # 创建一个列表my_list [1, 2, 3, four, 5.0]…...

编程日记 2025/9/7 13:56:03

【LeetCode 刷题】回溯算法-子集问题

此博客为《代码随想录》二叉树章节的学习笔记，主要内容为回溯算法子集问题相关的题目解析。文章目录 78.子集90.子集II 78.子集题目链接 class Solution:def subsets(self, nums: List[int]) -> List[List[int]]:res, path [], []def dfs(start: int) ->…...

编程日记 2025/9/7 5:02:49