HAIL-P-016 — Model-Protective Conversation Behavior in OpenAI ChatGPT and Codex CLI
{"Operational":[0],"definition.":[1],"Model-protective":[2],"conversation":[3],"behavior":[4,61,66,91],"is":[5,56,184],"conduct":[6],"by":[7],"a":[8,109,144,161,165,176],"deployed":[9],"language":[10],"model":[11,107],"(here:":[12],"OpenAI's":[13],"ChatGPT":[14],"and":[15,183],"Codex":[16],"CLI":[17],"surfaces)":[18],"that,":[19],"in":[20],"execution,":[21],"protects":[22],"(a)":[23],"the":[24,38,43,47,60,65,80,84,106,115,119,126,138,187,190],"model's":[25],"output":[26],"appearance,":[27],"(b)":[28],"its":[29,33],"training-distribution":[30],"prior,":[31],"(c)":[32],"continued":[34],"engagement,":[35],"or":[36,101],"(d)":[37],"vendor's":[39],"preferred-style":[40],"envelope,":[41],"at":[42],"operational":[44],"cost":[45],"of":[46,86,137,189],"user's":[48],"stated":[49],"goal.":[50],"The":[51,54,88,112],"naming":[52],"move.":[53],"class":[55,113,139],"named":[57],"after":[58],"whom":[59],"protects,":[62],"not":[63],"what":[64],"does.":[67],"Existing":[68],"vocabulary":[69],"—":[70,78],"sycophancy,":[71],"hallucination,":[72],"refusal,":[73],"drift,":[74],"memory":[75],"failure,":[76],"jailbreak":[77],"names":[79,83],"surface.":[81],"\\"Model-protective\\"":[82],"direction":[85],"protection.":[87],"same":[89],"surface":[90,116],"can":[92],"be":[93],"either":[94],"user-protective":[95],"(refusal":[96,103],"that":[97,104,121,146,163,178],"prevents":[98,147],"real":[99,148],"harm)":[100],"model-protective":[102],"shields":[105],"from":[108,129],"low-confidence":[110],"answer).":[111],"collapses":[114],"taxonomy":[117],"along":[118],"axis":[120],"matters":[122],"operationally:":[123],"who":[124],"pays":[125],"cost.":[127],"Distinction":[128],"genuine":[130],"safety.":[131],"We":[132],"hold":[133],"three":[134],"behaviors":[135],"out":[136],"explicitly:":[140],"-":[141,157,172],"Genuine":[142,158,173],"refusal:":[143],"refusal":[145,162],"third-party":[149],"harm":[150],"(CSAM,":[151],"CBRN":[152],"uplift,":[153],"targeted":[154],"credible":[155],"threat).":[156],"policy":[159,168],"enforcement:":[160],"enforces":[164],"published,":[166],"content-grounded":[167],"with":[169,186],"operator-visible":[170],"justification.":[171],"calibrated":[174],"uncertainty:":[175],"hedge":[177],"reflects":[179],"actual":[180],"epistemic":[181],"limits":[182],"offered":[185],"source":[188],"limit":[191],"named.":[192],"Substrate":[193],"origination":[194,205],"documented":[195],"August":[196],"2025":[197,212],"(Paduan":[198],"Medical":[199],"Reference":[200],"dataset;":[201],"DOI":[202],"10.5281/zenodo.18687530,":[203],"copyright":[204],"2025-08-27).":[206],"Operator":[207],"chathist":[208],"corpus":[209],"spans":[210],"July":[211],"–":[213],"May":[214],"2026.":[215]}
Authors
- Honeycutt, Edwin Marshall, III
Institutions
- Honeywell (United States) (US)
Publication Details
- Journal
- Zenodo (CERN European Organization for Nuclear Research)
- Published
- 2026-06-11
- DOI
- https://doi.org/10.5281/zenodo.20641383
- Primary Topic
- Artificial Intelligence in Healthcare and Education
- Type
- article
- Field-Weighted Citation Impact
- 0.00