aideep-diveDeep Research 前沿2026年9月19日測試時擴展:BrowseConf 與自信度引導的推理前面看的是怎麼評估。這篇看另一個維度:在推理過程中怎麼動態分配計算資源。BrowseConf 的核心洞察是——agent 自己說的『自信度』就能預測答案準不準。高自信就用少點資源,低自信就多搜幾輪。#deep-research#test-time-scaling#browseconf#confidence#acl2026