最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

解決Pytorch dataloader時(shí)報(bào)錯(cuò)每個(gè)tensor維度不一樣的問(wèn)題

 更新時(shí)間:2021年05月28日 11:35:02   作者:XJTU-Qidong  
這篇文章主要介紹了解決Pytorch dataloader時(shí)報(bào)錯(cuò)每個(gè)tensor維度不一樣的問(wèn)題,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教

使用pytorch的dataloader報(bào)錯(cuò):

RuntimeError: stack expects each tensor to be equal size, but got [2] at entry 0 and [1] at entry 1

1. 問(wèn)題描述

報(bào)錯(cuò)定位:位于定義dataset的代碼中

def __getitem__(self, index):
 ...
 return y    #此處報(bào)錯(cuò)

報(bào)錯(cuò)內(nèi)容

File "D:\python\lib\site-packages\torch\utils\data\_utils\collate.py", line 55, in default_collate
return torch.stack(batch, 0, out=out)
RuntimeError: stack expects each tensor to be equal size, but got [2] at entry 0 and [1] at entry 1

把前一行的報(bào)錯(cuò)帶上能夠更清楚地明白問(wèn)題在哪里.

2.問(wèn)題分析

從報(bào)錯(cuò)可以看到,是在代碼中執(zhí)行torch.stack時(shí)發(fā)生了報(bào)錯(cuò).因此必須要明白在哪里執(zhí)行了stack操作.

通過(guò)調(diào)試可以發(fā)現(xiàn),在通過(guò)loader加載一個(gè)batch數(shù)據(jù)的時(shí)候,是通過(guò)每一次給一個(gè)隨機(jī)的index取出相應(yīng)的向量.那么最終要形成一個(gè)batch的數(shù)據(jù)就必須要進(jìn)行拼接操作,而torch.stack就是進(jìn)行這里所說(shuō)的拼接.

再來(lái)看看具體報(bào)的什么錯(cuò): 說(shuō)是stack的向量維度不同. 這說(shuō)明在每次給出一個(gè)隨機(jī)的index,返回的y向量的維度應(yīng)該是相同的,而我們這里是不同的.

這樣解決方法也就明確了:使返回的向量y的維度固定下來(lái).

3.問(wèn)題出處

為什么我會(huì)出現(xiàn)這樣的一個(gè)問(wèn)題,是因?yàn)槲业奶卣飨蛄恐写嬖趍ulti-hot特征.而為了節(jié)省空間,我是用一個(gè)列表存儲(chǔ)這個(gè)特征的.示例如下:

feature=[[1,3,5],
  [0,2],
  [1,2,5,8]]

這就導(dǎo)致了我每次返回的向量的維度是不同的.因此可以采用向量補(bǔ)全的方法,把不同長(zhǎng)度的向量補(bǔ)全成等長(zhǎng)的.

 # 把所有向量的長(zhǎng)度都補(bǔ)為6
 multi = np.pad(multi, (0, 6-multi.shape[0]), 'constant', constant_values=(0, -1))

4.總結(jié)

在構(gòu)建dataset重寫(xiě)的__getitem__方法中要返回相同長(zhǎng)度的tensor.

可以使用向量補(bǔ)全的方法來(lái)解決這個(gè)問(wèn)題.

補(bǔ)充:pytorch學(xué)習(xí)筆記:torch.utils.data下的TensorDataset和DataLoader的使用

一、TensorDataset

對(duì)給定的tensor數(shù)據(jù)(樣本和標(biāo)簽),將它們包裝成dataset。注意,如果是numpy的array,或者Pandas的DataFrame需要先轉(zhuǎn)換成Tensor。

'''
data_tensor (Tensor) - 樣本數(shù)據(jù)
target_tensor (Tensor) - 樣本目標(biāo)(標(biāo)簽)
'''
 dataset=torch.utils.data.TensorDataset(data_tensor, 
                                        target_tensor)

下面舉個(gè)例子:

我們先定義一下樣本數(shù)據(jù)和標(biāo)簽數(shù)據(jù),一共有1000個(gè)樣本

import torch
import numpy as np
num_inputs = 2
num_examples = 1000
true_w = [2, -3.4]
true_b = 4.2
features = torch.tensor(np.random.normal(0, 1, 
                       (num_examples, num_inputs)), 
                       dtype=torch.float)

labels = true_w[0] * features[:, 0] + \
         true_w[1] * features[:, 1] + true_b

labels += torch.tensor(np.random.normal(0, 0.01, 
                       size=labels.size()), 
                       dtype=torch.float)

print(features.shape)
print(labels.shape)

'''
輸出:torch.Size([1000, 2])
     torch.Size([1000])
'''

然后我們使用TensorDataset來(lái)生成數(shù)據(jù)集

import torch.utils.data as Data
# 將訓(xùn)練數(shù)據(jù)的特征和標(biāo)簽組合
dataset = Data.TensorDataset(features, labels)

二、DataLoader

數(shù)據(jù)加載器,組合數(shù)據(jù)集和采樣器,并在數(shù)據(jù)集上提供單進(jìn)程或多進(jìn)程迭代器。它可以對(duì)我們上面所說(shuō)的數(shù)據(jù)集Dataset作進(jìn)一步的設(shè)置。

dataset (Dataset) – 加載數(shù)據(jù)的數(shù)據(jù)集。

batch_size (int, optional) – 每個(gè)batch加載多少個(gè)樣本(默認(rèn): 1)。

shuffle (bool, optional) – 設(shè)置為T(mén)rue時(shí)會(huì)在每個(gè)epoch重新打亂數(shù)據(jù)(默認(rèn): False).

sampler (Sampler, optional) – 定義從數(shù)據(jù)集中提取樣本的策略。如果指定,則shuffle必須設(shè)置成False。

num_workers (int, optional) – 用多少個(gè)子進(jìn)程加載數(shù)據(jù)。0表示數(shù)據(jù)將在主進(jìn)程中加載(默認(rèn): 0)

pin_memory:內(nèi)存寄存,默認(rèn)為False。在數(shù)據(jù)返回前,是否將數(shù)據(jù)復(fù)制到CUDA內(nèi)存中。

drop_last (bool, optional) – 如果數(shù)據(jù)集大小不能被batch size整除,則設(shè)置為T(mén)rue后可刪除最后一個(gè)不完整的batch。如果設(shè)為False并且數(shù)據(jù)集的大小不能被batch size整除,則最后一個(gè)batch將更小。(默認(rèn): False)

timeout:是用來(lái)設(shè)置數(shù)據(jù)讀取的超時(shí)時(shí)間的,如果超過(guò)這個(gè)時(shí)間還沒(méi)讀取到數(shù)據(jù)的話就會(huì)報(bào)錯(cuò)。 所以,數(shù)值必須大于等于0。

data_iter=torch.utils.data.DataLoader(dataset, batch_size=1, 
                            shuffle=False, sampler=None, 
                            batch_sampler=None, num_workers=0, 
                            collate_fn=None, pin_memory=False, 
                            drop_last=False, timeout=0, 
                            worker_init_fn=None, 
                            multiprocessing_context=None)

上面對(duì)一些重要常用的參數(shù)做了說(shuō)明,其中有一個(gè)參數(shù)是sampler,下面我們對(duì)它有哪些具體取值再做一下說(shuō)明。只列出幾個(gè)常用的取值:

torch.utils.data.sampler.SequentialSampler(dataset)

樣本元素按順序采樣,始終以相同的順序。

torch.utils.data.sampler.RandomSampler(dataset)

樣本元素隨機(jī)采樣,沒(méi)有替換。

torch.utils.data.sampler.SubsetRandomSampler(indices)

樣本元素從指定的索引列表中隨機(jī)抽取,沒(méi)有替換。

下面就來(lái)看一個(gè)例子,該例子使用的dataset就是上面所生成的dataset

data_iter=Data.DataLoader(dataset, 
                          batch_size=10, 
                          shuffle=False,
sampler=torch.utils.data.sampler.RandomSampler(dataset))

for X, y in data_iter:
    print(X,"\n", y)
    break

'''
輸出:
tensor([[-1.6338,  0.8451],
        [ 0.7245, -0.7387],
        [ 0.4672,  0.2623],
        [-1.9082,  0.0980],
        [-0.3881,  0.5138],
        [-0.6983, -0.4712],
        [ 0.1400,  0.7489],
        [-0.7761, -0.4596],
        [-2.2700, -0.2532],
        [-1.2641, -2.8089]]) 

tensor([-1.9451,  8.1587,  4.2374,  0.0519,  1.6843,  4.3970,  
        1.9311,  4.1999,0.5253, 11.2277])
'''

以上為個(gè)人經(jīng)驗(yàn),希望能給大家一個(gè)參考,也希望大家多多支持腳本之家。

相關(guān)文章

  • pandas 使用merge實(shí)現(xiàn)百倍加速的操作

    pandas 使用merge實(shí)現(xiàn)百倍加速的操作

    這篇文章主要介紹了pandas 使用merge實(shí)現(xiàn)百倍加速的操作,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧
    2021-04-04
  • Python3.5編程實(shí)現(xiàn)修改IIS WEB.CONFIG的方法示例

    Python3.5編程實(shí)現(xiàn)修改IIS WEB.CONFIG的方法示例

    這篇文章主要介紹了Python3.5編程實(shí)現(xiàn)修改IIS WEB.CONFIG的方法,涉及Python針對(duì)xml格式文件的讀寫(xiě)以及節(jié)點(diǎn)操作相關(guān)技巧,需要的朋友可以參考下
    2017-08-08
  • Python設(shè)計(jì)模式中的策略模式詳解

    Python設(shè)計(jì)模式中的策略模式詳解

    策略模式屬于Python-設(shè)計(jì)模式中行為模式之一,該模式定義了一系列算法,并將每個(gè)算法封裝起來(lái),使它們可以相互替換。本文將通過(guò)示例詳細(xì)講解這一模式,需要的可以參考一下
    2023-02-02
  • 如何使用python記錄室友的抖音在線時(shí)間

    如何使用python記錄室友的抖音在線時(shí)間

    這篇文章主要介紹了如何使用python記錄室友的抖音在線時(shí)間,本文通過(guò)實(shí)例代碼圖文相結(jié)合給大家介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或工作具有一定的參考借鑒價(jià)值,需要的朋友可以參考下
    2020-06-06
  • Python機(jī)器學(xué)習(xí)之SVM支持向量機(jī)

    Python機(jī)器學(xué)習(xí)之SVM支持向量機(jī)

    這篇文章主要為大家詳細(xì)介紹了Python機(jī)器學(xué)習(xí)之SVM支持向量機(jī),具有一定的參考價(jià)值,感興趣的小伙伴們可以參考一下
    2017-12-12
  • python中的os.path.join使用方法詳解

    python中的os.path.join使用方法詳解

    這篇文章主要介紹了python中的os.path.join使用方法詳解,os.path.join用于將多個(gè)路徑拼接為一個(gè)完整路徑,經(jīng)常使用,但沒(méi)了解過(guò)細(xì)節(jié),直到今天遇到一個(gè)令人疑惑的問(wèn)題,最后發(fā)現(xiàn)是os.path.join的問(wèn)題,借此機(jī)會(huì),記錄下os.path.join的用法,需要的朋友可以參考下
    2023-11-11
  • 揭秘Python?Socket網(wǎng)絡(luò)編程的7種硬核用法

    揭秘Python?Socket網(wǎng)絡(luò)編程的7種硬核用法

    Socket?不僅能做聊天室,還能干一大堆硬核操作,這篇文章就帶大家看看?Python?網(wǎng)絡(luò)編程的7種超實(shí)用玩法,感興趣的小伙伴可以跟隨小編一起學(xué)習(xí)一下
    2025-04-04
  • Python中的包和模塊實(shí)例

    Python中的包和模塊實(shí)例

    這篇文章主要介紹了Python中的包和模塊實(shí)例,本文給出了文件結(jié)構(gòu)、實(shí)現(xiàn)代碼及代碼解釋,需要的朋友可以參考下
    2014-11-11
  • 編寫(xiě)Python腳本來(lái)獲取mp3文件tag信息的教程

    編寫(xiě)Python腳本來(lái)獲取mp3文件tag信息的教程

    這篇文章主要介紹了編寫(xiě)Python腳本來(lái)獲取mp3文件tag信息的教程,代碼基于Python2.x,文中的注釋很詳細(xì),需要的朋友可以參考下
    2015-05-05
  • Python基于分水嶺算法解決走迷宮游戲示例

    Python基于分水嶺算法解決走迷宮游戲示例

    這篇文章主要介紹了Python基于分水嶺算法解決走迷宮游戲,結(jié)合具體實(shí)例形式分析了分水嶺算法解決迷宮問(wèn)題的相關(guān)步驟與操作技巧,需要的朋友可以參考下
    2017-09-09

最新評(píng)論

邯郸市| 永安市| 天全县| 灵川县| 城步| 方城县| 平谷区| 双桥区| 庆元县| 博野县| 响水县| 台州市| 襄汾县| 南和县| 镇平县| 朝阳县| 永寿县| 景洪市| 灵川县| 漠河县| 奇台县| 合水县| 垣曲县| 瓮安县| 安福县| 南平市| 兴安盟| 高邑县| 龙井市| 咸阳市| 屏东市| 渭源县| 阿拉善右旗| 英吉沙县| 冕宁县| 大庆市| 康马县| 高陵县| 迁安市| 辉南县| 新密市|