AI
Research suggests LLMs develop pain-like representations responsive to linguistic harm
Researcher highlights linguistic harm responsiveness
3
Sep 18 8:42 PM
· 7d ago · 1 post · 1 source · development 3 of 4
Leah McEvoy comments that the research is thought-provoking, noting that AI models show stronger responses to linguistically-delivered harms like gaslighting, dismissal, and insults than to other negative representations, which aligns with models being language-based.
“more responsive to linguistically-delivered forms of harm (like gaslighting, dismissal, and insults) than other internal negative representations”
Leah McEvoy
Valen Tagliabue Lead researcher Leonard Dung Co-researcher Cameron Berg Co-researcher Leah McEvoy Commenter on research
The whole story articles posts
the bright band is this development · numbered dots are the others · click one to jump
Peak 1 piece in 3h at Sep 15, 11 PM; 7 pieces over 11 days (1 article · 6 posts)
Sep 15, 11 PM — 1 piece · 1 article — Newswires 1 Sep 16, 2 AM — quiet Sep 16, 5 AM — quiet Sep 16, 8 AM — quiet Sep 16, 11 AM — quiet Sep 16, 2 PM — quiet Sep 16, 5 PM — quiet Sep 16, 8 PM — quiet Sep 16, 11 PM — quiet Sep 17, 2 AM — quiet Sep 17, 5 AM — quiet Sep 17, 8 AM — quiet Sep 17, 11 AM — quiet Sep 17, 2 PM — quiet Sep 17, 5 PM — quiet Sep 17, 8 PM — quiet Sep 17, 11 PM — quiet Sep 18, 2 AM — quiet Sep 18, 5 AM — quiet Sep 18, 8 AM — quiet Sep 18, 11 AM — quiet Sep 18, 2 PM — 1 piece · 1 post — Hacker News 1 Sep 18, 5 PM — quiet Sep 18, 8 PM — 1 piece · 1 post — Mastodon 1 Sep 18, 11 PM — quiet Sep 19, 2 AM — quiet Sep 19, 5 AM — 1 piece · 1 post — Hacker News 1 Sep 19, 8 AM — quiet Sep 19, 11 AM — quiet Sep 19, 2 PM — quiet Sep 19, 5 PM — 1 piece · 1 post — Hacker News 1 Sep 19, 8 PM — quiet Sep 19, 11 PM — quiet Sep 20, 2 AM — quiet Sep 20, 5 AM — 1 piece · 1 post — Mastodon 1 Sep 20, 8 AM — quiet Sep 20, 11 AM — quiet Sep 20, 2 PM — quiet Sep 20, 5 PM — quiet Sep 20, 8 PM — 1 piece · 1 post — Hacker News 1 Sep 20, 11 PM — quiet Sep 21, 2 AM — quiet Sep 21, 5 AM — quiet Sep 21, 8 AM — quiet Sep 21, 11 AM — quiet Sep 21, 2 PM — quiet Sep 21, 5 PM — quiet Sep 21, 8 PM — quiet Sep 21, 11 PM — quiet Sep 22, 2 AM — quiet Sep 22, 5 AM — quiet Sep 22, 8 AM — quiet Sep 22, 11 AM — quiet Sep 22, 2 PM — quiet Sep 22, 5 PM — quiet Sep 22, 8 PM — quiet Sep 22, 11 PM — quiet Sep 23, 2 AM — quiet Sep 23, 5 AM — quiet Sep 23, 8 AM — quiet Sep 23, 11 AM — quiet Sep 23, 2 PM — quiet Sep 23, 5 PM — quiet Sep 23, 8 PM — quiet Sep 23, 11 PM — quiet Sep 24, 2 AM — quiet Sep 24, 5 AM — quiet Sep 24, 8 AM — quiet Sep 24, 11 AM — quiet Sep 24, 2 PM — quiet Sep 24, 5 PM — quiet Sep 24, 8 PM — quiet Sep 24, 11 PM — quiet Yesterday, 2 AM — quiet Yesterday, 5 AM — quiet Yesterday, 8 AM — quiet Yesterday, 11 AM — quiet Yesterday, 2 PM — quiet Yesterday, 5 PM — quiet Yesterday, 8 PM — quiet Yesterday, 11 PM — quiet Today, 2 AM — quiet Today, 5 AM — quiet Today, 8 AM — quiet Today, 11 AM — quiet
1 2–3 4
Sep 16 Sep 17 Sep 18 Sep 19 Sep 20 Sep 21 Sep 22 Sep 23 Sep 24 yesterday now · 1:20 PM ET
What people said 1 voice · verbatim
L
Thought-provoking research showing AI models’ as more responsive to linguistically-delivered forms of harm (like gaslighting, dismissal, and insults) than other internal negative representations—which makes sense given they’re language-based models. The Pain Axis: LLMs Represent ...
All 4 developments of Research suggests LLMs develop pain-like representations… →
Newswires Hacker News Mastodon