JavaScript 檢測文件的類型的方法
我們會(huì)想到通過 input 元素的 accept 屬性來限制上傳的文件類型:
<input type="file" id="inputFile" accept="image/png" />
這種方案雖然可以滿足大多數(shù)場景,但如果用戶把 JPEG 格式的圖片后綴名更改為 .png 的話,就可以成功突破這個(gè)限制。那么應(yīng)該如何解決這個(gè)問題呢?其實(shí)我們可以通過讀取文件的二進(jìn)制數(shù)據(jù)來識(shí)別正確的文件類型。在介紹具體的實(shí)現(xiàn)方案前,阿寶哥先以圖片類型的文件為例,來介紹一下相關(guān)的知識(shí)。
一、如何查看圖片的二進(jìn)制數(shù)據(jù)
要查看圖片對(duì)應(yīng)的二進(jìn)制數(shù)據(jù),我們可以借助一些現(xiàn)成的編輯器,比如 Windows 平臺(tái)下的 WinHex 或 macOS 平臺(tái)下的 Synalyze It! Pro 十六進(jìn)制編輯器。這里我們使用 Synalyze It! Pro 這個(gè)編輯器,以十六進(jìn)制的形式來查看阿寶哥頭像對(duì)應(yīng)的二進(jìn)制數(shù)據(jù)。
二、如何區(qū)分圖片的類型
計(jì)算機(jī)并不是通過圖片的后綴名來區(qū)分不同的圖片類型,而是通過 “魔數(shù)”(Magic Number)來區(qū)分。 對(duì)于某一些類型的文件,起始的幾個(gè)字節(jié)內(nèi)容都是固定的,根據(jù)這幾個(gè)字節(jié)的內(nèi)容就可以判斷文件的類型。
常見圖片類型對(duì)應(yīng)的魔數(shù)如下表所示:
文件類型 | 文件后綴 | 魔數(shù) |
---|---|---|
JPEG | jpg/jpeg | 0xFF D8 FF |
PNG | png | 0x89 50 4E 47 0D 0A 1A 0A |
GIF | gif | 0x47 49 46 38(GIF8) |
BMP | bmp | 0x42 4D |
同樣使用 Synalyze It! Pro 這個(gè)編輯器,來驗(yàn)證一下阿寶哥的頭像(abao.png)的類型是否正確:
由上圖可知,PNG 類型的圖片前 8 個(gè)字節(jié)是 0x89 50 4E 47 0D 0A 1A 0A。當(dāng)你把 abao.png 文件修改為 abao.jpeg 后,再用編輯器打開查看圖片的二進(jìn)制內(nèi)容,你會(huì)發(fā)現(xiàn)文件的前 8 個(gè)字節(jié)還是保持不變。但如果使用 input[type="file"] 輸入框的方式來讀取文件信息的話,將會(huì)輸出以下結(jié)果:
很明顯通過 文件后綴名或文件的 MIME 類型 并不能識(shí)別出正確的文件類型。接下來,阿寶哥將介紹在上傳圖片時(shí),如何通過讀取圖片的二進(jìn)制信息來確保正確的圖片類型。
三、如何檢測圖片的類型
3.1 定義 readBuffer 函數(shù)
在獲取文件對(duì)象后,我們可以通過 FileReader API 來讀取文件的內(nèi)容。因?yàn)槲覀儾⒉恍枰x取文件的完整信息,所以阿寶哥封裝了一個(gè) readBuffer 函數(shù),用于讀取文件中指定范圍的二進(jìn)制數(shù)據(jù)。
function readBuffer(file, start = 0, end = 2) { return new Promise((resolve, reject) => { const reader = new FileReader(); reader.onload = () => { resolve(reader.result); }; reader.onerror = reject; reader.readAsArrayBuffer(file.slice(start, end)); }); }
對(duì)于 PNG 類型的圖片來說,該文件的前 8 個(gè)字節(jié)是 0x89 50 4E 47 0D 0A 1A 0A。因此,我們?cè)跈z測已選擇的文件是否為 PNG 類型的圖片時(shí),只需要讀取前 8 個(gè)字節(jié)的數(shù)據(jù),并逐一判斷每個(gè)字節(jié)的內(nèi)容是否一致。
3.2 定義 check 函數(shù)
為了實(shí)現(xiàn)逐字節(jié)比對(duì)并能夠更好地實(shí)現(xiàn)復(fù)用,阿寶哥定義了一個(gè) check 函數(shù):
function check(headers) { return (buffers, options = { offset: 0 }) => headers.every( (header, index) => header === buffers[options.offset + index] ); }
3.3 檢測 PNG 圖片類型
基于前面定義的 readBuffer 和 check 函數(shù),我們就可以實(shí)現(xiàn)檢測 PNG 圖片的功能:
3.3.1 html 代碼
<div> 選擇文件:<input type="file" id="inputFile" accept="image/*" onchange="handleChange(event)" /> <p id="realFileType"></p> </div>
3.3.2 JS 代碼
const isPNG = check([0x89, 0x50, 0x4e, 0x47, 0x0d, 0x0a, 0x1a, 0x0a]); // PNG圖片對(duì)應(yīng)的魔數(shù) const realFileElement = document.querySelector("#realFileType"); async function handleChange(event) { const file = event.target.files[0]; const buffers = await readBuffer(file, 0, 8); const uint8Array = new Uint8Array(buffers); realFileElement.innerText = `${file.name}文件的類型是:${ isPNG(uint8Array) ? "image/png" : file.type }`; }
以上示例成功運(yùn)行后,對(duì)應(yīng)的檢測結(jié)果如下圖所示:
由上圖可知,我們已經(jīng)可以成功地檢測出正確的圖片格式。如果你要檢測 JPEG 文件格式的話,你只需要定義一個(gè) isJPEG 函數(shù):
const isJPEG = check([0xff, 0xd8, 0xff])
然而,如果你要檢測其他類型的文件,比如 PDF 文件的話,應(yīng)該如何處理呢?這里我們先使用 Synalyze It! Pro 編輯器來瀏覽一下 PDF 文件的二進(jìn)制內(nèi)容:
觀察上圖可知,PDF 文件的頭 4 個(gè)字節(jié)的是 0x25 50 44 46,對(duì)應(yīng)的字符串是 %PDF。為了讓用戶能更直觀地辨別出檢測的類型,阿寶哥定義了一個(gè) stringToBytes 函數(shù):
function stringToBytes(string) { return [...string].map((character) => character.charCodeAt(0)); }
基于 stringToBytes 函數(shù),我們就可以很容易的定義一個(gè) isPDF 函數(shù),具體如下所示:
const isPDF = check(stringToBytes("%PDF"));
有了 isPDF 函數(shù),你就實(shí)現(xiàn) PDF 文件檢測的功能了。但在實(shí)際工作中,遇到的文件類型是多種多樣的,針對(duì)這種情形,你可以使用現(xiàn)成的第三庫來實(shí)現(xiàn)文件檢測的功能,比如 file-type 這個(gè)庫。
其實(shí)基于文件的二進(jìn)制數(shù)據(jù),除了可以檢測文件的類型之外,我們還可以讀取文件相關(guān)的元信息,比如圖片的尺寸、位深度、色彩類型和壓縮算法等,我們繼續(xù)以阿寶哥的頭像(abao.png)為例,來看一下實(shí)際的情況:
好的,在前端如何檢測文件類型就介紹到這里。在實(shí)際項(xiàng)目中,對(duì)于文件上傳的場景,出于安全考慮,建議小伙伴們?cè)陂_發(fā)過程中,都限制一下文件上傳的類型。對(duì)于更嚴(yán)格的場景來說,就可以考慮使用阿寶哥介紹的方法來做文件類型的校驗(yàn)。
以上就是JavaScript 檢測文件的類型的方法的詳細(xì)內(nèi)容,更多關(guān)于JavaScript 檢測文件的類型的資料請(qǐng)關(guān)注腳本之家其它相關(guān)文章!
- JavaScript類型檢測的方法實(shí)例教程
- JS數(shù)組索引檢測中的數(shù)據(jù)類型問題詳解
- 詳解JavaScript中的數(shù)據(jù)類型,以及檢測數(shù)據(jù)類型的方法
- javascript中的數(shù)據(jù)類型檢測方法詳解
- js數(shù)據(jù)類型檢測總結(jié)
- js學(xué)習(xí)總結(jié)_基于數(shù)據(jù)類型檢測的四種方式(必看)
- JS檢測數(shù)組類型的方法小結(jié)
- 在javaScript中檢測數(shù)據(jù)類型的幾種方式小結(jié)
- javascript基本數(shù)據(jù)類型及類型檢測常用方法小結(jié)
- JS中檢測數(shù)據(jù)類型的幾種方式及優(yōu)缺點(diǎn)小結(jié)
- JS正則表達(dá)式匹配檢測各種數(shù)值類型(數(shù)字驗(yàn)證)
- 如何檢測JavaScript的各種類型
- JavaScript類型檢測之typeof 和 instanceof 的缺陷與優(yōu)化
- JavaScript學(xué)習(xí)筆記之檢測客戶端類型是(引擎、瀏覽器、平臺(tái)、操作系統(tǒng)、移動(dòng)設(shè)備)
- Javascript實(shí)現(xiàn)檢測客戶端類型代碼封包
相關(guān)文章
使用layer彈窗和layui表單實(shí)現(xiàn)新增功能
最近做項(xiàng)目遇到這樣的需求使用layer在彈窗內(nèi)完成新增,成功后提示并刷新頁面,下面小編給大家?guī)砹耸褂胠ayer彈窗和layui表單做新增功能,具體實(shí)現(xiàn)代碼,參考下本文2018-08-08fixedBox固定div漂浮代碼支持ie6以上大部分主流瀏覽器
本例為大家分享的是fixedBox固定div漂浮代碼支持ie6以上大部分瀏覽器,需要的朋友可以參考下2014-06-06用js讀、寫、刪除Cookie代碼分享及詳細(xì)注釋說明
JavaScript是運(yùn)行在客戶端的腳本,因此一般是不能夠設(shè)置Session的,因?yàn)镾ession是運(yùn)行在服務(wù)器端的。而cookie是運(yùn)行在客戶端的,所以可以用JS來設(shè)置cookie. 下面我們來分析下案例2014-06-06使用coffeescript編寫node.js項(xiàng)目的方法匯總
Node.js 基于JavaScript編寫應(yīng)用,JavaScript是我的主要開發(fā)語言。CoffeeScript是編譯為JavaScript的編程語言。CoffeeScript是一個(gè)非常高階的語言,將JavaScript、Ruby和Python中我最愛的部分結(jié)合在了一起。小編給大家介紹下使用coffeescript編寫node.js項(xiàng)目的方法2015-08-08javaScript合并對(duì)象的多種方式及知識(shí)擴(kuò)展
眾所周知JavaScript中有多種方法可以合并對(duì)象,下面這篇文章主要給大家介紹了關(guān)于javaScript合并對(duì)象的多種方式及知識(shí)擴(kuò)展,文中通過實(shí)例代碼介紹的非常詳細(xì),需要的朋友可以參考下2023-02-02