研究
148,933 個質數上的七種聚合。
本頁所有內容都是在頁尾標明的環境下、由一支印出雜湊的腳本、從發行包的分片算出來的。沒有一個數字是從論文引來的。
資料集
a5caea22a57efaac915c…工作流
36f765220749b287cde6…輸出
5b93e5f26256e16f6290…環境
Python 3.14.5 · NumPy 2.5.1密度
2,000,000 以下有 148,933 個質數,密度為 0.074467。密度隨區間擴大而下降,正是質數定理預測的形狀;下面的數量級分段直接顯示這個下降。
| 區間 | 質數 | 密度 |
|---|---|---|
| 0–10 | 4 | 0.40000 |
| 10–100 | 21 | 0.23333 |
| 100–1,000 | 143 | 0.15889 |
| 1,000–10,000 | 1,061 | 0.11789 |
| 10,000–100,000 | 8,363 | 0.09292 |
| 100,000–1,000,000 | 68,906 | 0.07656 |
| 1,000,000–2,000,000 | 70,435 | 0.07043 |
表中計數加總正好是資料集總數,而每一列都是兩個相鄰 π(10ᵏ) 的差。它們是存下來的、不是重新推導的:分段邊界來自分片內隨附的 decimal_digits 欄。
間隔
在 148,932 個相鄰質數間隔中,平均為 13.429,最大為 132。這個最大值正是兩百萬以下已知的最大間隔,是拿這個資料集對照文獻最省事的檢查之一。
- 間隔中位數
- 10
- 90 百分位
- 28
- 99 百分位
- 52
- 最大值
- 132
- 相異間隔值
- 61
剩餘
大於 5 的質數都與 30 互質,因此必然落在八個剩餘類之一。而它們落得幾乎一樣平均:
質數族
四個配對族以位元旗標編碼,每一個都設在配對中較大的那一個成員上,所以新增後續區間永遠不會重寫先前的分片。
重播
一行指令,不需網路,不需索引:
shell
python workflows/stable_baseline.py --project-root . \
--output results_v10/stable_baseline_output.json腳本在讀取任何東西之前,會先用清單自己的雜湊驗證它;若分片數或質數數與清單不符則拒絕執行;若旗標欄帶有它無法命名的位元則大聲失敗。輸出以與清單相同的方式正規化並自我雜湊,所以下面這個值可以逐位元重現。
- 工作流
stable_baseline.py- 工作流 sha256
36f765220749b287cde604bbff48b2c1b31e1c212855afeac3c10498bfd22569- 資料集清單
a5caea22a57efaac915c00dd92c655b1126e0b6d9b2b93790e48bc167733e0d1- 輸出 sha256
5b93e5f26256e16f6290cea957df45aaf78de672ca0e80bf17ef2419b4d50ac3- 執行環境
- Python 3.14.5、NumPy 2.5.1、Windows
已知限制
- 區間固定為兩百萬。本頁每一個數字都只是關於這個區間的陳述,不涉及其外。
- 配對族記在較大的成員上,所以跨越上界的配對不被計入。
- 隨附的
prime-distribution-baseline工作流走資料湖查詢層,無法從發行包重播,因為湖索引不在包裡。這個缺口記錄在工作流頁;本研究的存在就是為了補上它。 - 本頁沒有任何結果以外部提供的整數為條件,它們的任何組合也不會縮小因數搜尋範圍。