View a markdown version of this page

Penyimpanan - Amazon Neptune

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

Penyimpanan

Data Neptunus disimpan dalam volume cluster, yang merupakan volume virtual tunggal yang menggunakan SSD-based drive Non-Volatile Memory Express (NVMe). Volume cluster terdiri dari kumpulan blok logis yang dikenal sebagai segmen. Masing-masing segmen ini dialokasikan 10 gigabytes (GB) penyimpanan. Data di setiap segmen direplikasi di tiga Availability Zone (AZ) dalam satu Wil AWS ayah tempat cluster DB berada.

Ketika cluster Neptune DB dibuat, itu dialokasikan satu segmen 10 GB. Ketika volume data meningkat dan melebihi penyimpanan yang dialokasikan saat ini, Neptunus secara otomatis memperluas volume cluster dengan menambahkan segmen baru. Volume cluster Neptunus dapat tumbuh hingga ukuran maksimum 128 tebibyte (TiB) di semua Wilayah yang didukung kecuali Wilayah China dan Wilayah AWS GovCloud (AS), di mana dibatasi hingga 64 TiB.

Volume cluster DB berisi semua data pengguna Anda, indeks, dan kamus (dijelaskan di Model Data Grafik Neptune bagian), serta metadata internal seperti log transaksi internal. Semua data grafik ini, termasuk indeks dan log internal, tidak dapat melebihi ukuran maksimum volume cluster.

I/O—Opsi penyimpanan yang dioptimalkan

Neptunus menawarkan dua model harga untuk penyimpanan:

  • Penyimpanan standar — Penyimpanan standar menyediakan penyimpanan database hemat biaya untuk aplikasi dengan I/O penggunaan sedang hingga rendah.

  • I/OPenyimpanan yang dioptimalkan — Dengan I/O —Penyimpanan yang dioptimalkan, Anda hanya membayar untuk penyimpanan yang Anda gunakan, dengan biaya lebih tinggi daripada penyimpanan standar, dan Anda tidak membayar apa pun untuk I/O yang Anda gunakan.

    Dengan penyimpanan I/O yang dioptimalkan, Anda mendapatkan biaya yang dapat diprediksi, I/O latensi rendah, dan I/O throughput yang konsisten untuk beban kerja I/O grafik intensif.

    Untuk informasi selengkapnya, lihat I/O —Penyimpanan yang dioptimalkan.

Alokasi penyimpanan Neptunus

Meskipun volume cluster Neptunus dapat tumbuh hingga 128 TiB (atau 64 TiB di beberapa wilayah), Anda dikenakan biaya untuk ruang yang dialokasikan. Total ruang yang dialokasikan ditentukan oleh tanda air penyimpanan tinggi, yang merupakan jumlah maksimum yang dialokasikan untuk volume cluster setiap saat selama keberadaannya.

Ini berarti bahwa meskipun Anda menghapus data pengguna dari volume cluster, seperti dengan menjalankan kueri drop sepertig.V().drop(), total ruang yang dialokasikan tetap sama. Neptunus secara otomatis mengoptimalkan ruang yang dialokasikan yang tidak terpakai untuk digunakan kembali di masa mendatang.

Selain data pengguna, data kamus dan log transaksi internal juga menghabiskan penyimpanan. Data kamus tetap ada bahkan setelah Anda menghapus data grafik yang didukungnya, meskipun Neptunus dapat menggunakan kembali entri tersebut jika Anda memperkenalkan kembali data. Untuk membersihkan entri kamus yang tidak digunakan, Anda dapat mengaktifkanKamus pengumpulan sampah. Log internal menggunakan ruang penyimpanan terpisah dengan tanda airnya sendiri yang tinggi. Log kedaluwarsa digunakan kembali hanya untuk log lain, bukan untuk data grafik. Ruang yang dialokasikan untuk log termasuk dalam total yang dilaporkan oleh VolumeBytesUsed CloudWatch metrik.

Per Praktik terbaik penyimpanan iksa cara untuk menjaga penyimpanan yang dialokasikan seminimal mungkin dan menggunakan kembali ruang.

Tagihan penyimpanan Neptunus

Biaya penyimpanan ditagih berdasarkan tanda air penyimpanan tinggi, seperti yang dijelaskan di bagian sebelumnya. Amazon Neptune mereplikasi data Anda di beberapa Zona Ketersediaan, tetapi Anda hanya membayar satu salinan data.

Anda dapat menentukan berapa tanda air tinggi penyimpanan saat ini dari cluster DB Anda dengan memantau VolumeBytesUsed CloudWatch metrik (lihatMemantau Neptunus Menggunakan Amazon CloudWatch).

Faktor lain yang dapat memengaruhi biaya penyimpanan Neptune Anda termasuk snapshot database dan cadangan, yang ditagih secara terpisah sebagai penyimpanan cadangan dan didasarkan pada biaya penyimpanan Neptune (lihatCloudWatch metrik yang berguna untuk mengelola penyimpanan cadangan Neptunus).

Namun, jika Anda membuat Kloning Basis Data di Neptune tiruan database Anda, klon menunjuk ke volume cluster yang sama dengan yang digunakan cluster DB Anda sendiri, sehingga tidak ada biaya penyimpanan tambahan untuk data asli. Perubahan selanjutnya pada klon menggunakan protokol copy-on-write, dan menghasilkan biaya penyimpanan tambahan.

Untuk informasi harga Neptunus selengkapnya, lihat Harga Amazon Neptune di AWS situs web.

Praktik terbaik penyimpanan Neptunus

Karena jenis data tertentu menggunakan penyimpanan permanen di Neptunus, gunakan praktik terbaik ini untuk menghindari lonjakan besar dalam pertumbuhan penyimpanan:

  • Saat merancang model data grafik Anda, hindari sebanyak mungkin menggunakan kunci properti dan nilai yang menghadap pengguna yang bersifat sementara.

  • Jika Anda berencana membuat perubahan pada model data Anda, jangan memuat data ke cluster DB yang ada menggunakan model baru sampai Anda menghapus data di cluster DB tersebut menggunakan API reset cepat. Hal terbaik adalah sering memuat data yang menggunakan model baru ke cluster DB baru.

  • Transaksi yang beroperasi pada sejumlah besar data menghasilkan log internal yang besar, yang secara permanen dapat meningkatkan tanda air tinggi dari ruang log internal. Misalnya, satu transaksi yang menghapus semua data di cluster DB Anda dapat menghasilkan log internal yang besar. Log ini membutuhkan mengalokasikan banyak penyimpanan internal, yang secara permanen mengurangi ruang yang tersedia untuk data grafik.

    Untuk menghindari hal ini, bagi transaksi besar menjadi yang lebih kecil dan berikan waktu di antara mereka sehingga log internal terkait memiliki kesempatan untuk kedaluwarsa dan melepaskan penyimpanan internal mereka untuk digunakan kembali oleh log berikutnya.

  • Untuk memantau pertumbuhan volume cluster Neptunus Anda, Anda dapat mengatur CloudWatch alarm pada VolumeBytesUsed CloudWatch metrik. Ini bisa sangat membantu jika data Anda mencapai ukuran maksimum volume cluster. Untuk informasi selengkapnya, lihat Menggunakan CloudWatch alarm Amazon.

Jika cluster DB Anda memiliki sejumlah besar ruang yang dialokasikan yang tidak terpakai, Anda dapat mengecilkan penyimpanannya. Untuk melakukan ini, ekspor semua data dalam grafik Anda dan kemudian muat ulang ke cluster DB baru. Lihat layanan dan utilitas ekspor data Neptunus untuk cara mudah mengekspor data dari cluster DB, dan pemuat massal Neptunus untuk cara mudah mengimpor data kembali ke Neptunus.

catatan

Membuat dan memulihkan snapshot tidak mengurangi jumlah penyimpanan yang dialokasikan untuk cluster DB Anda, karena snapshot mempertahankan gambar asli dari penyimpanan dasar cluster. Jika sejumlah besar penyimpanan yang dialokasikan tidak digunakan, satu-satunya cara untuk mengecilkan jumlah penyimpanan yang dialokasikan adalah dengan mengekspor data grafik Anda dan memuatnya kembali ke cluster DB baru.

Keandalan penyimpanan Neptunus dan ketersediaan tinggi

Amazon Neptune dirancang agar andal, tahan lama, dan toleran terhadap kesalahan.

Karena salinan data Neptunus Anda disimpan di tiga Zona Ketersediaan (AZ), penyimpanan data sangat tahan lama, dengan kemungkinan kehilangan data yang sangat rendah. Amazon Neptune mereplikasi data secara otomatis di seluruh Availability Zone, terlepas dari apakah ada instans DB di dalamnya. Jumlah replikasi bergantung pada jumlah instans DB dalam klaster Anda.

Ini berarti Anda dapat menambahkan replika baca dengan cepat, karena Neptunus tidak membuat salinan baru dari data grafik. Sebaliknya, baca-replika terhubung ke volume cluster yang sudah berisi data Anda. Demikian pula, menghapus replika baca tidak menghapus data yang mendasarinya.

Anda dapat menghapus volume cluster dan datanya hanya setelah menghapus semua instance DB-nya.

Neptunus juga secara otomatis mendeteksi kegagalan di segmen yang membentuk volume cluster. Ketika salinan data dalam segmen rusak, Neptunus segera memperbaiki segmen itu, menggunakan salinan data lain dalam segmen yang sama untuk memastikan bahwa data yang diperbaiki adalah terkini. Akibatnya, Neptunus menghindari kehilangan data dan mengurangi kebutuhan untuk melakukan pemulihan point-in-time untuk memulihkan dari kegagalan disk.