Policy在人工智能领域通常指智能体在特定环境下采取行动的策略或规则。近期,policy相关研究在强化学习、机器人控制和大型语言模型等领域取得显著进展。
№policy·general
policy
别名
- 首次出现
- 2026-05-22
- 最近出现
- 2026-09-03
- 累计提及
- 396
§ 01综述
§ 02相关报道10 条在档
- 01One Symptom, Three Levers: A Critical Review of On-Policy Self-Distillation
- 02Amazon Bedrock AgentCore 推出自然语言编写 Dogwood 策略功能
- 03PIHF:将后训练强化学习引入上下文学习的新方法
- 04Surgical WAM:用无动作视频预训练提升手术机器人学习效率
- 05测试时自进化框架提升GUI视觉定位准确率7.4%
- 06参数空间探索新方法3PO:提升LLM强化学习性能
- 07无监督自蒸馏:U-OPSD仅靠模型自身生成提升推理能力
- 08DASH:面向推理模型on-policy自蒸馏的自适应监督视野
- 09持续学习的转型:从参数中心到系统级适应
- 10PhyAI:边缘实时、云端扩展的统一物理AI推理引擎
§ 03邻近话题