ชุดข้อมูลการจัดประเภท HereSay Voice AI
เวอร์ชัน
2026-Q2-v2
· ODC-BY 1.0
ชุดข้อมูลการจัดประเภทแบบรวม 10 ชุด ที่คำนวณจากบทสนทนา Voice AI ที่ไม่เปิดเผยตัวตน 54 บท (2,334 เทิร์น) รวมทั้งไตรภาค Asking/Doing/Expressing ของ OpenAI, มิติของเสียงโดยเฉพาะ, ความรู้สึกต่อเทิร์น (VADER), การกระจายของประเภทคำถามและสรรพนาม, การเปลี่ยนผ่านของโครงเรื่องบทสนทนา และรูปแบบตามช่วงเวลาของวัน ไม่มีข้อความบทสนทนาดิบรวมอยู่
สัญญาอนุญาต: ODC-BY 1.0
ใช้ฟรี แจกต่อได้ฟรี แต่ต้องระบุที่มา เมื่อใช้ชุดข้อมูลนี้ในงานวิจัย งานข่าว หรือเชิงพาณิชย์ ให้ใส่:
"Contains information from the HereSay Voice AI Classifications Dataset (2026-Q2-v2) by HereSay (heresay.live), which is made available under the ODC Attribution License (ODC-BY 1.0)."
คุณต้องมีบัญชี HereSay ฟรีเพื่อดาวน์โหลด เพื่อให้เห็นสัญญาอนุญาตตอนดาวน์โหลด
ลงชื่อเข้าใช้หรือสร้างบัญชีฟรีมีอะไรอยู่ใน ZIP
-
01_conversation_stats.csv— workhorse table (turns, char counts, redactions) -
02_asking_doing_expressing.csv— OpenAI taxonomy label per conversation -
03_voice_facets.csv— mic_test / practice / casual / emotional / info_seeking -
04_turn_lengths.csv— char + word counts per turn -
05_voice_signals.csv— filler words, mic-check phrases, ASR garble -
06_question_types.csv— what / how / why / yes-no question counts -
07_pronoun_usage.csv— 1st / 2nd / 3rd person counts per role -
08_arc_transitions.csv— opening facet -> closing facet (Sankey input) -
09_sentiment.csv— VADER compound score per turn -
10_time_of_day.csv— UTC hour bucket counts - พร้อม README, METHODOLOGY, DATASHEET, CODEBOOK, CITATION.cff, LICENSE, CHANGELOG