10:45官方一手arXiv: OpenAI@Dmitrij Żatuchin研究团队对ChatGPT网络界面和OpenAI API进行了234次受控测试,涉及4个退出国家和6种查询语言。研究发现,顶级推荐不稳定,在6次相同运行中有4次发生变化。查询语言而非地理位置决定本地供应商是否出现,当查询语言与国家匹配时,全球品牌仅赢得24次运行中的1次。语言和位置是可分离的因素,固定查询语言仅改变退出IP会改变被命名品牌的市场,同时答案保持查询语言不变。论文ChatGPTOpenAI查询语言9 个信源在谈事件专题推荐理由:ChatGPT推荐结果受查询语言和IP位置双重影响,商业决策者需注意此特性。原文稍后读已读值得跟进有用关注 ChatGPT
17:11官方账号Microsoft Research@MSFTResearch精选Vibhasha 是微软研究院发布的多语言 AI 系统构建指南。Vibhasha 指南的核心是语言准确性与文化相关性并重。Vibhasha 提供了从设计到评估的实践流程,适合开发者参考。技巧Vibhasha多语言AI多文化推荐理由:微软给出一份叫 Vibhasha 的实操指南,教你怎么把 AI 做成多语言、多文化的,语言要准,还得合当地习惯。原文稍后读已读值得跟进有用关注 Vibhasha
09:07官方一手GitHub Blog@Natalie GuevaraGitHub发布了一个新的repository-level数据集,许可证为CC0-1.0,包含多语言开发者内容,涵盖README、issues和pull requests。该数据集旨在帮助研究人员和开发者训练或改进多语言AI模型。数据集中于2025年4月发布,可直接下载使用,无需额外申请。AI模型GitHub多语言AI开源数据集推荐理由:GitHub新出的多语言数据集,免费开源,里面各种语言的README和讨论都有,做多语言AI模型训练正好用上。原文稍后读已读值得跟进有用关注 GitHub