HereSay وائس AI درجہ بندیوں کا ڈیٹا سیٹ
ورژن
2026-Q2-v2
· ODC-BY 1.0
54 گمنام وائس AI گفتگوؤں (2,334 turns) سے تیار کردہ 10 مجموعی درجہ بندی ڈیٹا سیٹس۔ اس میں OpenAI کی Asking/Doing/Expressing trichotomy، آواز سے متعلق facets، ہر turn کا sentiment (VADER)، سوال کی قسم اور pronoun کی تقسیم، گفتگو کے arc transitions، اور دن کے وقت کے patterns شامل ہیں۔ خام گفتگو کا متن شامل نہیں ہے۔
لائسنس: ODC-BY 1.0
استعمال کے لیے مفت، دوبارہ تقسیم کے لیے مفت، attribution ضروری ہے۔ جب آپ یہ ڈیٹا سیٹ تحقیق، صحافت، یا تجارتی کام میں استعمال کریں، تو یہ شامل کریں:
"Contains information from the HereSay Voice AI Classifications Dataset (2026-Q2-v2) by HereSay (heresay.live), which is made available under the ODC Attribution License (ODC-BY 1.0)."
ڈاؤن لوڈ کرنے کے لیے آپ کو ایک مفت HereSay اکاؤنٹ درکار ہے۔ اس سے آپ کو ڈاؤن لوڈ کے وقت لائسنس نظر آتا ہے۔
سائن ان کریں یا مفت اکاؤنٹ بنائیںZIP میں کیا ہے
-
01_conversation_stats.csv— workhorse table (turns, char counts, redactions) -
02_asking_doing_expressing.csv— OpenAI taxonomy label per conversation -
03_voice_facets.csv— mic_test / practice / casual / emotional / info_seeking -
04_turn_lengths.csv— char + word counts per turn -
05_voice_signals.csv— filler words, mic-check phrases, ASR garble -
06_question_types.csv— what / how / why / yes-no question counts -
07_pronoun_usage.csv— 1st / 2nd / 3rd person counts per role -
08_arc_transitions.csv— opening facet -> closing facet (Sankey input) -
09_sentiment.csv— VADER compound score per turn -
10_time_of_day.csv— UTC hour bucket counts - مزید README، METHODOLOGY، DATASHEET، CODEBOOK، CITATION.cff، LICENSE، CHANGELOG