日韩性视频-久久久蜜桃-www中文字幕-在线中文字幕av-亚洲欧美一区二区三区四区-撸久久-香蕉视频一区-久久无码精品丰满人妻-国产高潮av-激情福利社-日韩av网址大全-国产精品久久999-日本五十路在线-性欧美在线-久久99精品波多结衣一区-男女午夜免费视频-黑人极品ⅴideos精品欧美棵-人人妻人人澡人人爽精品欧美一区-日韩一区在线看-欧美a级在线免费观看

歡迎訪問 生活随笔!

生活随笔

當(dāng)前位置: 首頁 > 编程语言 > python >内容正文

python

神经网络python实例分类_Python使用神经网络进行简单文本分类

發(fā)布時間:2025/3/20 python 31 豆豆
生活随笔 收集整理的這篇文章主要介紹了 神经网络python实例分类_Python使用神经网络进行简单文本分类 小編覺得挺不錯的,現(xiàn)在分享給大家,幫大家做個參考.

原文鏈接:http://tecdat.cn/?p=8613?tecdat.cn

深度學(xué)習(xí)無處不在。在本文中,我們將使用Keras進(jìn)行文本分類。

準(zhǔn)備數(shù)據(jù)集

出于演示目的,我們將使用 20個新聞組 數(shù)據(jù)集。數(shù)據(jù)分為20個類別,我們的工作是預(yù)測這些類別。如下所示:

通常,對于深度學(xué)習(xí),我們將訓(xùn)練和測試數(shù)據(jù)分開。

導(dǎo)入所需的軟件包

Pythonimport pandas as pd

import numpy as np

import pickle

from keras.preprocessing.text import Tokenizer

from keras.models import Sequential

from keras.layers import Activation, Dense, Dropout

from sklearn.preprocessing import LabelBinarizer

import sklearn.datasets as skds

from pathlib import Path

將數(shù)據(jù)從文件加載到Python變量

Python# For reproducibility

np.random.seed(1237)

label_index = files_train.target

label_names = files_train.target_names

labelled_files = files_train.filenames

data_tags = ["filename","category","news"]

data_list = []

# Read and add data from file to a list

data = pd.DataFrame.from_records(data_list, columns=data_tags)

在我們的情況下,數(shù)據(jù)無法以CSV格式提供。我們有文本數(shù)據(jù)文件,文件存放的目錄是我們的標(biāo)簽或類別。

我們將使用scikit-learn load_files方法。這種方法可以為我們提供原始數(shù)據(jù)以及標(biāo)簽和標(biāo)簽索引。

在以上代碼的結(jié)尾,我們將有一個數(shù)據(jù)框,其中包含文件名,類別和實(shí)際數(shù)據(jù)。

拆分?jǐn)?shù)據(jù)進(jìn)行訓(xùn)練和測試

Python# lets take 80% data as training and remaining 20% for test.

train_size = int(len(data) * .8)

train_posts = data['news'][:train_size]

train_tags = data['category'][:train_size]

train_files_names = data['filename'][:train_size]

test_posts = data['news'][train_size:]

test_tags = data['category'][train_size:]

test_files_names = data['filename'][train_size:]

標(biāo)記化并準(zhǔn)備詞匯

Python# 20 news groups

num_labels = 20

vocab_size = 15000

batch_size = 100

# define Tokenizer with Vocab Size

tokenizer = Tokenizer(num_words=vocab_size)

tokenizer.fit_on_texts(train_posts)

在對文本進(jìn)行分類時,我們首先使用Bag Of Words方法對文本進(jìn)行預(yù)處理。

預(yù)處理輸出標(biāo)簽/類

在將文本轉(zhuǎn)換為數(shù)字向量后,我們還需要確保標(biāo)簽以神經(jīng)網(wǎng)絡(luò)模型接受的數(shù)字格式表示。

建立Keras模型并擬合

PowerShell

model = Sequential()

它為輸入數(shù)據(jù)的形狀以及構(gòu)成模型的圖層類型提供了簡單的配置。

這是一些適合度和測試準(zhǔn)確性的代碼段

100/8145 [..............................] - ETA: 31s - loss: 1.0746e-04 - acc: 1.0000

200/8145 [..............................] - ETA: 31s - loss: 0.0186 - acc: 0.9950

300/8145 [>.............................] - ETA: 35s - loss: 0.0125 - acc: 0.9967

400/8145 [>.............................] - ETA: 32s - loss: 0.0094 - acc: 0.9975

500/8145 [>.............................] - ETA: 30s - loss: 0.0153 - acc: 0.9960

...

7900/8145 [============================>.] - ETA: 0s - loss: 0.1256 - acc: 0.9854

8000/8145 [============================>.] - ETA: 0s - loss: 0.1261 - acc: 0.9855

8100/8145 [============================>.] - ETA: 0s - loss: 0.1285 - acc: 0.9854

8145/8145 [==============================] - 29s 4ms/step - loss: 0.1293 - acc: 0.9854 - val_loss: 1.0597 - val_acc: 0.8742

Test accuracy: 0.8767123321648251

評估模型

Pythonfor i in range(10):

prediction = model.predict(np.array([x_test[i]]))

predicted_label = text_labels[np.argmax(prediction[0])]

print(test_files_names.iloc[i])

print('Actual label:' + test_tags.iloc[i])

print("Predicted label: " + predicted_label)

在Fit方法訓(xùn)練了我們的數(shù)據(jù)集之后,我們將如上所述評估模型。

混淆矩陣

混淆矩陣是可視化模型準(zhǔn)確性的最佳方法之一。

保存模型

通常,深度學(xué)習(xí)的用例就像在不同的會話中進(jìn)行數(shù)據(jù)訓(xùn)練,而使用訓(xùn)練后的模型進(jìn)行預(yù)測一樣。

# creates a HDF5 file 'my_model.h5'

model.model.save('my_model.h5')

# Save Tokenizer i.e. Vocabulary

with open('tokenizer.pickle', 'wb') as handle:

pickle.dump(tokenizer, handle, protocol=pickle.HIGHEST_PROTOCOL)

Keras沒有任何實(shí)用程序方法可將Tokenizer與模型一起保存。我們必須單獨(dú)序列化它。

加載Keras模型

Python

預(yù)測環(huán)境還需要注意標(biāo)簽。

encoder.classes_ #LabelBinarizer

預(yù)測

如前所述,我們已經(jīng)預(yù)留了一些文件進(jìn)行實(shí)際測試。

Pythonlabels = np.array(['alt.atheism', 'comp.graphics', 'comp.os.ms-windows.misc',

'comp.sys.ibm.pc.hardware', 'comp.sys.mac.hardware', 'comp.windows.x',

'misc.forsale', 'rec.autos', 'rec.motorcycles', 'rec.sport.baseball',

'rec.sport.hockey', 'sci.crypt', 'sci.electronics', 'sci.med', 'sci.space',

'soc.religion.christian', 'talk.politics.guns', 'talk.politics.mideast',

'talk.politics.misc', 'talk.religion.misc'])

...

for x_t in x_tokenized:

prediction = model.predict(np.array([x_t]))

predicted_label = labels[np.argmax(prediction[0])]

print("File ->", test_files[i], "Predicted label: " + predicted_label)

i += 1

輸出量File -> C:\DL\20news-bydate\20news-bydate-test\comp.graphics\38758 Predicted label: comp.graphics

File -> C:\DL\20news-bydate\20news-bydate-test\misc.forsale\76115 Predicted label: misc.forsale

File -> C:\DL\20news-bydate\20news-bydate-test\soc.religion.christian\21329 Predicted label: soc.religion.christian

我們知道目錄名是文件的真實(shí)標(biāo)簽,因此上述預(yù)測是準(zhǔn)確的。

結(jié)論

在本文中,我們使用Keras python庫構(gòu)建了一個簡單而強(qiáng)大的神經(jīng)網(wǎng)絡(luò)。

《新程序員》:云原生和全面數(shù)字化實(shí)踐50位技術(shù)專家共同創(chuàng)作,文字、視頻、音頻交互閱讀

總結(jié)

以上是生活随笔為你收集整理的神经网络python实例分类_Python使用神经网络进行简单文本分类的全部內(nèi)容,希望文章能夠幫你解決所遇到的問題。

如果覺得生活随笔網(wǎng)站內(nèi)容還不錯,歡迎將生活随笔推薦給好友。

主站蜘蛛池模板: 国产精品久久久久久久久免费桃花 | 天堂а在线中文在线新版 | 亚洲一区二区色 | 中文字幕一区二区三区在线观看 | 亚洲图片自拍偷拍区 | 国产乱码精品一区二区 | 欧美人成在线视频 | 99久久精品免费看 | 久草免费在线观看视频 | 草在线视频| 啊灬啊灬啊灬秀婷 | 男女免费视频 | 激情小说亚洲色图 | 农民人伦一区二区三区 | 少妇第一次交换又紧又爽 | 日本三级视频在线观看 | 91日日夜夜 | 国产区91 | 国产精品久久在线观看 | 日本一区二区三区四区视频 | 日韩视频免费观看高清完整版 | 黄网站免费观看 | 乱色视频 | 成熟了的熟妇毛茸茸 | 国产精品98 | 日韩视频一区二区三区在线播放免费观看 | 亚洲国产无码久久 | 成人在线免费观看网址 | 亚洲爱情岛论坛永久 | 国产成人精品无码高潮 | 亚洲视频网站在线观看 | 无码人妻精品一区二区中文 | 欧美freesex黑人又粗又大 | 天天干天天碰 | 毛片在线视频观看 | 午夜精品一区二区三区三上悠亚 | 欧美操老女人 | 欧美成年人在线观看 | 国产精品你懂得 | h无码动漫在线观看 | 色操插| 国产福利一区二区三区在线观看 | www国产免费 | 日韩伦理一区二区三区 | 色99视频| 国产精品久久久久久久久久久久午夜片 | 国产精品一区二区网站 | 黄色资源在线观看 | www毛片com | 色亚洲色图 | 插插插av | 国产精伦| 欧美另类色 | 中文字幕丰满乱子伦无码专区 | 国产成a人亚洲精v品无码 | 国产精品久久久久av | 色婷婷精品国产一区二区三区 | 欧美精品五区 | 就去吻亚洲 | zzjj国产精品一区二区 | 亚洲码欧美码一区二区三区 | jlzzjlzz欧美大全 | 男插女在线观看 | 亚洲女人初尝黑人巨大 | 欧美精品偷拍 | 色黄视频在线观看 | 亚洲一级一区 | 噜噜吧噜噜色 | www.com国产 | 午夜在线一区二区三区 | 亚洲精品视频网 | 一级香蕉视频在线观看 | 欧美日本在线播放 | 免费看污黄网站在线观看 | 欧美激情欧美激情在线五月 | 欧美日韩激情视频在线观看 | 69人妻精品久久无人专区 | 91丨九色丨国产 | 天天看夜夜看 | 视频国产在线 | 欧美色涩在线第一页 | 在线观看中文字幕一区 | 密桃成熟时在线观看 | 最新av在线 | 大又大粗又爽又黄少妇毛片 | 久久国产一 | 亚州视频在线 | 少妇无码一区二区三区 | 97在线视频免费 | 久久av免费看 | 躁躁躁日日躁 | 亚洲无卡| 国产成a人亚洲精v品无码 | 欧美福利视频导航 | 中文字幕+乱码+中文乱 | 少妇av片| 爱爱爱免费视频 | av无码久久久久久不卡网站 | 免费毛片看片 |