Genspark 上线了 GenCode,写代码的智能体,亮点是模型自己挑,开源模型跑任务能省到原来的 1/10 甚至 1/20 花费。
深度求索DeepSeek
中国·Hangzhou
开放权重的 DeepSeek-V 与 R 系列模型
在做什么
深度求索 2023 年在杭州成立,由量化基金幻方孵化,发布 DeepSeek-V 系列和推理模型 DeepSeek-R 系列,以开放权重和较低的训练成本著称。
最近动态
信息流里提到这家公司的条目Genspark 发布 GenCode 编程智能体,可选 Claude、GPT 与开源模型
模型价格战:OpenAI 代币降价 62%,GPU 租金却涨 50%
Ornn 拉了三个月数据:OpenAI 降价 62%,DeepSeek 降 51%,但 B200 租金反涨 50%。想搞清楚钱最后流向谁的,看这篇。
GA-Agent:用 LLM 在元层面配置遗传算法,自动优化 PID 控制器
把 LLM 当遗传算法的调参师用,8 个控制案例全部跑通,成本才 $0.002 一次,做控制或自动化的朋友可以看看这套架构。
MWE-ECL 诊断基准:可检索的远距离上下文未必能改变模型的局部词 prior
这篇论文造了个诊断集,专门测长上下文模型“找到了但没用上”的问题,DeepSeek 两个模型都被测出检索满分但解读掉分,做长文本评测的可以看看。
越南学者用本地部署 LLM 与混合 RAG 自动生成数据处理活动记录
越南 PDPD 合规催生的实用论文:本地跑 Qwen3.5-27B 配混合 RAG,效果追平云端 DeepSeek-V4-Flash,还公开了越南语 RoPA 基准。
研究用贝叶斯模型评估 DeepSeek-R1-Distill 系列:规模越大能力越强但效率不变
这篇用分层贝叶斯方法量化了 DeepSeek-R1-Distill 系列的推理能力与 token 消耗,结论是加大模型只提升能力不提升效率,做选型或研究 scaling 的朋友可以看看。
Bolt Forge 一周数据:GLM 5.3 Flash 与 DeepSeek V4.1 Flash 占八成请求
Bolt 公了一周真实用量:GLM 5.3 Flash 占 63%,DeepSeek Flash 17%,用户宁可要快的也不挑最大的,这个数据挺说明问题。
Genspark 推出 GenCode 编程智能体,支持 Claude、GPT、DeepSeek 自由切换
Genspark 上线了 GenCode 编程智能体,Claude、GPT、DeepSeek 一个账号随便切,开源模型价格只要十分之一,适合想自己挑模型的开发者。