15:33IT之家(博客/媒体)73°五角大楼本周将ChatGPT Mil和Grok for Government加入其GenAI.mil内网门户。ChatGPT Mil主要针对文档阅读和写作任务,可用于物流规划等。Grok for Government提供不同推理模式,专注于供应链跟踪和研究工作。两款模型数据均锁定在内网环境中,OpenAI和xAI不会利用政府数据训练AI模型。两款模型均不允许用于战斗行动或目标锁定任务。AI产品ChatGPTGrok五角大楼10 个信源在谈事件专题推荐理由:五角大楼引入两个定制AI助手,军人们现在能用ChatGPT处理文档,用Grok跟踪供应链,数据还安全不外流。原文稍后读已读值得跟进有用关注 ChatGPT
11:55官方账号arXiv cs.AI@Laurens Samson, Iva Gornishka, Gossa Lô, Yuki M. Asano, Sennay Ghebreab荷兰研究者提出“Grip on LLMs”评估框架,针对政府场景的荷兰语大模型。该框架涵盖事实性、诚实性、社会偏见、能耗、成本和训练数据透明度六个维度,测试了30多个多语言及荷兰语专用模型。结果显示没有模型在所有维度上表现最佳,高质量模型通常伴随更高能耗和成本,而偏见与两者无关。事实性和诚实性由不同属性决定,高事实性不意味着高诚实性。研究团队发布了面向非技术用户的公开模型概览。论文Grip on LLMs荷兰语评估基准推荐理由:荷兰政府项目组做的评估框架,测了30多个模型,告诉你哪个模型在事实性、能耗、成本上表现如何,选型时直接参考。原文稍后读已读值得跟进有用关注 Grip on LLMs