研究與資料
這裡只放 Nihongo to Japan 的原創研究與可公開取用的彙總資料——有方法、有樣本數、有限制說明、可以被引用的東西。一般的學習文章與旅遊文章不放這裡。
⚠️ 「可公開取用」不等於「開放授權」。這裡的資料集不是 open data,未採用 CC BY/CC0 等授權。統計數字可引用(請註明來源並連結回原頁);轉載我們製作的圖表請先聯絡。
資料集與報告
日語學習作答彙總資料集・2026 年 8 月
2026-08-14 發布・版本 1.1.0|56,613 筆匿名作答、1,053 個匿名 learner identifiers、11,987 道題目。資料期間 2026 年 8 月 2–13 日(12 天),不是全年研究。
依能力軸向、JLPT 級別與 39 個知識點切分的原始正確率,附 Wilson 95% 信賴區間、最小格數規則、analysis-set 分解與完整限制說明。可下載 JSON/CSV,附 APA/MLA/BibTeX 引用格式。⚠️ 非開放授權:數字可引用(註明來源),轉載圖表請先聯絡。
主要發現(測驗情境首答):句型軸 53.7%,詞彙軸 92.1%;助詞「が」60.9%、「を」78.7%。
2026 台灣人日文自學數據報告
2026-07-21 發布|結合國際交流基金、JLPT 官方統計、JNTO 等公開數據,與本站的搜尋與學習行為資料。
回答「台灣人怎麼學日文」:查詞需求的樣態、卡關在語感而非單字、課堂在縮而自學在長。
我們怎麼處理資料
- 凍結 snapshot:每一份報告的所有數字來自同一個時間凍結點,不會今天一個數字明天一個數字。
- 公開方法與限制:抽樣方式、分析集合定義、最小格數規則、已知缺口全部寫出來,不藏在頁尾。
- 只發彙總:公開檔案裡沒有任何一筆原始作答事件,也沒有任何個人識別資料。
- 不誇大:觀察性資料就說是觀察性資料,相關就說相關,不包裝成代表性研究或因果結論。
- 不可觀測就說不可觀測:儀器沒記到的行為,不會被寫成「沒有發生」。