π HCI+NLP @ EMNLP 2025

π °οΈ 4-9 Π½ΠΎΡΠ±ΡΡ Π² Π‘ΡΡΠΆΠΎΡ Π² ΠΠΈΡΠ°Π΅ ΠΏΡΠΎΡ ΠΎΠ΄ΠΈΡ ΠΎΠ΄Π½Π° ΠΈΠ· Π·Π½Π°ΠΊΠΎΠ²ΡΡ ΠΊΠΎΠ½ΡΠ΅ΡΠ΅Π½ΡΠΈΠΉ ΠΏΠΎ - EMNLP 2025. ΠΡΡ ΠΎΠ΄Π½ΡΠ΅ Π½Π° ΠΌΠ΅ΡΠΎΠΏΡΠΈΡΡΠΈΠΈ ΠΏΠΎΡΠ²ΡΡΠ΅Π½Ρ Π²ΠΎΡΠΊΡΠΎΠΏΠ°ΠΌ. Π ΡΠ΅Π³ΠΎΠ΄Π½Ρ ΠΌΡ ΠΏΡΠ΅Π΄ΡΡΠ°Π²Π»ΡΠ»ΠΈ (ΡΠ²Ρ, ΡΠΎΠΆΠ΅ ΠΎΠ½Π»Π°ΠΉΠ½) Π½Π°ΡΡ ΡΠ°Π±ΠΎΡΡ [1] Π½Π° Π²ΠΎΡΠΊΡΠΎΠΏΠ΅ HCI+NLP, ΡΠ΅ΠΌΠ°ΡΠΈΠΊΠ° ΠΊΠΎΡΠΎΡΠΎΠ³ΠΎ ΠΏΠΎΡΠ²ΡΡΠ΅Π½Π° ΡΠ΅Π»ΠΎΠ²Π΅ΠΊΠΎ-ΠΊΠΎΠΌΠΏΡΡΡΠ΅ΡΠ½ΠΎΠΌΡ Π²Π·Π°ΠΈΠΌΠΎΠ΄Π΅ΠΉΡΡΠ²ΠΈΡ Ρ ΠΏΡΠΈΠΌΠ΅Π½Π΅Π½ΠΈΠ΅ΠΌ NLP.
π§βπ» Π Π°Π±ΠΎΡΠ° ΠΏΡΠ΅Π΄ΡΡΠ°Π²Π»ΡΠ΅Ρ ΠΏΠΎΠΏΡΡΠΊΡ ΡΠΌΠΎΠ΄Π΅Π»ΠΈΡΠΎΠ²Π°ΡΡ Π²ΠΎΡΠΏΡΠΈΡΡΠΈΠ΅ ΠΏΡΠΎΠ³ΡΠ°ΠΌΠΌΠΈΡΡΠΎΠΌ ΠΊΠΎΠ΄Π°, ΡΠ³Π΅Π½Π΅ΡΠΈΡΠΎΠ²Π°Π½Π½ΠΎΠ³ΠΎ LLM, Π² ΡΠΎΡΠΌΠ΅ ΠΏΡΠΎΡΡΠΎΠ³ΠΎ MDP. Π’Π°ΠΊΠ°Ρ ΠΌΠΎΠ΄Π΅Π»Ρ ΠΌΠΎΠΆΠ΅Ρ ΠΈΡΠΏΠΎΠ»ΡΠ·ΠΎΠ²Π°ΡΡΡΡ ΠΊΠ°ΠΊ ΡΠΈΠ½ΡΠ΅ΡΠΈΡΠ΅ΡΠΊΠΈΠΉ ΡΠΈΠ΄Π±ΡΠΊ (Π½Π°ΠΏΡΠΈΠΌΠ΅Ρ, Π΄Π»Ρ ΡΡΠ΅Π½Π°ΡΠΈΠ΅Π² ), ΠΊΠ°ΠΊ ΠΌΠ΅ΡΠΎΠ΄ ΠΎΡΠ΅Π½ΠΊΠΈ ΠΏΡΠΈ ΡΠ°Π½ΠΆΠΈΡΠΎΠ²Π°Π½ΠΈΠΈ, ΡΠΈΠ»ΡΡΡΠ°ΡΠΈΠΈ, ΠΎΡΠ΅Π½ΠΊΠ΅ ΠΈΠ»ΠΈ Π² Π±ΠΎΠ»Π΅Π΅ ΡΠ»ΠΎΠΆΠ½ΡΡ ΡΡΠ΅Π½Π°ΡΠΈΡΡ ΡΠΈΠΏΠ° AI-as-a-judge. Π ΡΡΠ»ΠΎΠ²ΠΈΡΡ , ΠΊΠΎΠ³Π΄Π° Π½ΠΈ Π»ΠΈΠ½Π³Π²ΠΈΡΡΠΈΡΠ΅ΡΠΊΠΈΠ΅ ΠΌΠ΅ΡΡΠΈΠΊΠΈ [2] (ΡΠ°Π±ΠΎΡΠ° ΡΠΎΠΆΠ΅ Π±ΡΠ»Π° ΠΏΡΠ΅Π΄ΡΡΠ°Π²Π»Π΅Π½Π° Π½Π° EMNLP, Π½ΠΎ Π² 2022), Π½ΠΈ ΡΠ΅ΡΡΠΎΠ²ΡΠ΅ ΠΌΠ΅ΡΡΠΈΠΊΠΈ [3] Π½Π΅ ΠΏΡΠΈΠΌΠ΅Π½ΠΈΠΌΡ Π½Π°ΠΏΡΡΠΌΡΡ, ΡΡΠΎ ΡΡΠ°Π½ΠΎΠ²ΠΈΡΡΡ Π΅ΡΠ΅ Π±ΠΎΠ»Π΅Π΅ Π²Π°ΠΆΠ½ΡΠΌ.
Π‘ΡΡΠ»ΠΊΠΈ
[1] Predictive Modeling of Human Developersβ Evaluative Judgment of Generated Code as a Decision Process
[2] Human perceiving behavior modeling in evaluation of code generation models
[3] Test-based and metric-based evaluation of code generation models for practical question answering