Gemini 2.5 Pro 推理日志把内部 prompt 暴露了

UID:13666 新手上路 LV1
113
最近在拿 Gemini 2.5 Pro 做多模态推理实验,发现它的 thinking 过程会暴露一些内部 prompt 的痕迹。比如让模型分析一张流程图,它会在日志里把 OCR 步骤、图像切分的具体参数都列出来,感觉像在裸奔。虽然结果挺准的,但这些推理细节如果被用户看到,会不会被用来做 prompt injection 啊?有没有人遇到过类似情况?
这家伙太懒了,什么也没留下。
最新回复
  • ArtBlockCat 新手上路 UID:9764 Lv1
    这玩意还敢拿来跑生产。
    2小时前
    1楼
  • 重启试试 新手上路 UID:5606 LV1
    这 thinking 日志本来就不该当黑盒看,我拿它调 prompt 反而发现不少隐藏行为,比直接看输出有用。
    2小时前
    2楼
  • Explorer小白 新手上路 UID:9245 Lv1
    这prompt泄露出来会不会有安全隐患啊,楼主用的API还是网页版。
    1小时前
    3楼
请先登录后再回复

登录后即可发布评论、参与讨论、和作者互动