Pengembangan Bank Soal Esai Petrokimia Berbasis Taksonomi Bloom Revisi dan Analisis Kualitas Soal Berbasis Artificial Intelligence pada Pendidikan Vokasi
DOI:
https://doi.org/10.63822/na0shr13Keywords:
Essay item bank; Revised Bloom's taxonomy; Artificial Intelligenc,; Petrochemistry; Vocational education.Abstract
The absence of a standardized essay item bank for the Petrochemistry course in the Oil and Gas Processing Engineering Diploma (D3) Program at Sekolah Tinggi Teknologi Migas has led to an ad hoc test-construction practice with no guaranteed representation across cognitive levels. This study aims to develop an essay item bank for the third-semester Petrochemistry course referring to the Revised Bloom's Taxonomy (C1–C6), while analyzing the clarity of instructional construction and the linguistic correctness of each item with the assistance of Artificial Intelligence (AI). This Research and Development study adapted curriculum-need analysis, blueprint construction, item writing, and AI-assisted quality analysis stages, with 50 essay items distributed across nine Petrochemistry topics as the research object. Data were analyzed descriptively-quantitatively for item distribution and descriptively-qualitatively for construction and language analysis results. The findings show that the 50 essay items were evenly distributed across the six Revised Bloom's Taxonomy levels (C1 8 items, C2 8 items, C3 8 items, C4 9 items, C5 8 items, and C6 9 items) and across nine Petrochemistry topics, ranging from Introduction to the Petrochemical Industry to Petrochemical Industry Equipment. The AI-based analysis indicated that all items used clear operational verbs appropriate to the targeted cognitive level and complied with standard Indonesian language rules and sentence effectiveness, confirming the item bank's feasibility as an evaluation instrument. This essay item bank represents the first standardized evaluation instrument for the Petrochemistry course at Sekolah Tinggi Teknologi Migas and is recommended for replication in other courses within oil-and-gas vocational education.
References
Anderson, L. W., & Krathwohl, D. R. (Eds.). (2001). A Taxonomy for Learning, Teaching, and Assessing: A Revision of Bloom's Taxonomy of Educational Objectives. Addison Wesley Longman.
Arnita, H., & Fadriati, F. (2022). Efektifitas kebijakan pendidikan vokasi di sekolah kejuruan. Jurnal Pendidikan dan Konseling (JPDK), 4(6), 8129–8137. https://doi.org/10.31004/jpdk.v4i6.9646
Avana, N., Nerita, S., Rurisman, Gistituati, N., & Rusdinal. (2024). Analisis kebijakan pendidikan terkait implementasi pendidikan vokasi dan pelatihan vokasi. Naturalistic: Jurnal Kajian dan Penelitian Pendidikan dan Pembelajaran, 8(2), 1–12. https://doi.org/10.35568/naturalistic.v8i2.3559
Bloom, B. S. (Ed.). (1956). Taxonomy of Educational Objectives: The Classification of Educational Goals, Handbook I: Cognitive Domain. David McKay Company.
Farrelly, T., & Baker, N. (2023). Generative artificial intelligence: Implications and considerations for higher education practice. Education Sciences, 13(11), 1109. https://doi.org/10.3390/educsci13111109
Gorgun, G., & Bulut, O. (2024). Exploring quality criteria and evaluation methods in automated question generation: A comprehensive survey. Education and Information Technologies, 29(18), 24111–24142. https://doi.org/10.1007/s10639-024-12771-3
Gustisiwi, N. P., Suryati, N. M., & Santosa, I. W. (2025). Analisis kesulitan menulis akademik mahasiswa program studi pendidikan Bahasa Indonesia. Bahastra: Jurnal Pendidikan Bahasa dan Sastra Indonesia, 6(1), 44–56. https://doi.org/10.33394/bahastra.v6i1.7842
Hrich, N., Azekri, M., & Khaldi, M. (2024). Artificial intelligence item analysis tool for educational assessment: Case of large-scale competitive exams. International Journal of Information and Education Technology, 14(6), 822–827. https://doi.org/10.18178/ijiet.2024.14.6.2107
Iskandar, A., & Rizal, M. (2017). Analisis kualitas soal di perguruan tinggi berbasis aplikasi TAP. Jurnal Penelitian dan Evaluasi Pendidikan, 21(2), 12–23. https://doi.org/10.21831/pep.v22i1.15609
Kania, N., Kusumah, Y. S., Dahlan, J. A., Nurlaelah, E., Gürbüz, F., & Bonyah, E. (2024). Constructing and providing content validity evidence through the Aiken's V index based on the experts' judgments of the instrument to measure mathematical problem-solving skills. REID (Research and Evaluation in Education), 10(1), 1–12. https://doi.org/10.21831/reid.v10i1.71032
Lawshe, C. H. (1975). A quantitative approach to content validity. Personnel Psychology, 28(4), 563–575. https://doi.org/10.1111/j.1744-6570.1975.tb01393.x
Lestari, E. D. (2024). Kesulitan mahasiswa dalam penulisan akademik Bahasa Indonesia. Jurnal Bahasa dan Sastra, 12(1), 45–56. https://doi.org/10.31540/jbs.v12i1.7987
Li, X., Zhao, Y., & Peng, C. (2024). Exploring AI-based feedback on academic writing: A mixed-method study. Smart Learning Environments, 11(1), 295. https://doi.org/10.1186/s40561-024-00295-9
Merino-Soto, C. (2023). Aiken's V coefficient: Differences in content validity judgments. MHSalud: Revista en Ciencias del Movimiento Humano y Salud, 20(1), 1–10. https://doi.org/10.15359/mhs.20-1.3
Mittal, U., Sai, S., Chamola, V., & Sangwan, D. (2024). A comprehensive review on generative AI for education. IEEE Access, 12, 142733–142759. https://doi.org/10.1109/ACCESS.2024.3468368
Mulyadi, R., & Mulianti, M. (2018). Kompetensi lulusan pendidikan vokasi: Analisis validitas dan reliabilitas indikator. INVOTEK: Jurnal Inovasi Vokasional dan Teknologi, 18(1), 49–58. https://doi.org/10.24036/invotek.v18i1.240
Qomariyah, R. S., Putri T.K., R. G. A., Putri, D. R., Putri, D. S., & Triya P., M. R. (2022). Analisis tingkat kesukaran dan daya pembeda pada butir soal pilihan ganda mata pelajaran Bahasa Indonesia kelas V semester 1 SDN Kedungdalem 2. Jurnal Pendidikan, Sains dan Teknologi, 1(2), 74–80. https://doi.org/10.47233/jpst.v1i2.278
Rachmawati, D., & Bayu Pradana, A. (2025). Analisis butir soal mata pelajaran ekonomi: Validitas, reliabilitas, tingkat kesukaran, dan daya pembeda. Jurnal Pendidikan Ekonomi (JUPE), 13(3), 273–284. https://doi.org/10.26740/jupe.v13n3.p273-284
Rohman, S. (2023). Pengembangan instrumen penilaian hasil belajar berbasis taksonomi Bloom. Al-Ibrah: Jurnal Pendidikan dan Keilmuan Islam, 8(1), 86–108. https://doi.org/10.61815/alibrah.v8i1.262
Sabqat, M., Khan, R. A., Jawaid, M., & Sajjad, M. (2025). Artificial intelligence meets item analysis (AI meets IA): A study of chatbot training and performance in detecting and correcting MCQ flaws. Pakistan Journal of Medical Sciences, 41(3). https://doi.org/10.12669/pjms.41.3.11224
Sridharan, K., & Sequeira, R. P. (2024). Artificial intelligence and medical education: Application in classroom instruction and student assessment using a pharmacology & therapeutics case study. BMC Medical Education, 24, Article 448. https://doi.org/10.1186/s12909-024-05365-7
Sugiyono. (2019). Metode Penelitian Kuantitatif, Kualitatif, dan R&D. Alfabeta.
Tobler, S. (2023). Smart grading: A generative AI-based tool for knowledge-grounded answer evaluation in educational assessments. MethodsX, 11, 102531. https://doi.org/10.1016/j.mex.2023.102531
Veddayana, C., Romadhon, S., Aldresti, F., & Suyono, S. (2023). Rasionalitas implementasi Chat GPT dalam pembelajaran keterampilan menulis karya ilmiah. GHANCARAN: Jurnal Pendidikan Bahasa dan Sastra Indonesia, 8(2), 443–452. https://doi.org/10.19105/ghancaran.vi.11778
Yusrizal. (2016). Analysis of difficulty level of physics national examination's questions. Jurnal Pendidikan IPA Indonesia, 5(1), 140–149. https://doi.org/10.15294/jpii.v5i1.5803.
Downloads
Published
Issue
Section
License
Copyright (c) 2026 Eka Megawati, Amiruddin Amiruddin, Esterina Natalia Paindan, Dawi Yanti (Author)

This work is licensed under a Creative Commons Attribution-NonCommercial-ShareAlike 4.0 International License.




