finetuning·general

fine-tuning

别名
首次出现
2026-05-22
最近出现
2026-09-03
累计提及
162
§ 01综述

markdown

Fine-tuning综述


Fine-tuning是人工智能领域中针对预训练大语言模型开展针对性优化调整的技术手段,广泛应用于提升模型在不同任务场景下的适配性与效果。该技术在当前AI模型应用中占据重要位置,成为连接通用预训练模型与实际业务需求的关键环节。

Fine-tuning近期技术进展

Event-triggered Implicit Perturbation for Zeroth-Order Fine-Tuning of Spiking Transformers:2024年8月,研究者提出基于事件触发的隐式扰动零阶fine-tuning方法,针对脉冲变换器模型实现高效优化,为神经形态计算领域的模型微调提供新思路。

Fastino与NVIDIA发布Nemotron 3.5金融及医疗开源模型:2024年10月,Fastino与NVIDIA联合发布Nemotron 3.5金融及医疗开源模型,采用先进fine-tuning技术优化后,在专业领域任务中性能显著提升,为行业应用提供高效解决方案。

LoRA微调中的入侵阈值:一种谱分布定律:2024年7月,研究者提出LoRA微调中的入侵阈值理论,通过谱分布分析优化模型微调过程,为超参数选择提供依据。

用对比信念更新测量奖励寻求行为:2024年7月,相关研究探索对比信念更新在fine-tuning过程中对奖励行为的测量机制,为强化学习结合微调提供新方向。

当前焦点与观察点

当前fine-tuning技术聚焦于效率提升与安全性平衡,一方面通过创新算法降低微调成本,另一方面关注模型微调过程中的安全风险防控。不同领域(如金融、医疗、神经形态计算)的fine-tuning实践呈现差异化趋势,技术向更精准、更安全的方向发展,同时面临数据隐私与模型版权等争议问题。
§ 02相关报道10 条在档
  1. 01
    Event-triggered Implicit Perturbation for Zeroth-Order Fine-Tuning of Spiking Transformers
    arXiv cs.LG
  2. 02
    Fastino与NVIDIA发布Nemotron 3.5金融及医疗开源模型
    NVIDIA AI
  3. 03
    LoRA微调中的入侵阈值:一种谱分布定律
    arXiv cs.LG
  4. 04
    用对比信念更新测量奖励寻求行为
    arXiv: OpenAI
  5. 05
    数字万神殿:用LLM智能体模拟和审计联盟形成
    arXiv cs.AI
  6. 06
    Learning Only What Valid Adapters Can Express: Subspace-Constrained Adaptation Against Fine-Tuning Poisoning
    arXiv cs.LG
  7. 07
    开始微调你自己的模型:开源小模型微调后超越Claude和OpenAI
    Paul Couvert
  8. 08
    Agentic Fine-Tuning 与 PorTAL:微调领域的新方向
    elvis
  9. 09
    CWE-Trace框架揭示微调LLM在漏洞检测中的局限性
    arXiv: DeepSeek
  10. 10
    别给AI拽高级词汇!FaceMind实验证明高频表达更有效
    berryxia
§ 03邻近话题

本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

/topic/fine-tuning