低配显卡党福音:Unsloth 把 Qwen-Image-2.1 量化到 12GB 显存就能本地生图,6GB 显存走 FP8 offloading 也能跑,质量还对标 Nano Banana 2.0。
全部动态
Anthropic拟10月在新加坡设亚太第五个办事处 开放本地招聘 数据显示,按人口比例计算,新加坡的Claude.ai使用水平在121个国家中排名第二。 我们观察到,人工智能公司Anthropic计划于10月在新加坡设立其亚太地区的第五…
谷歌出的新图片工具,用 Nano Banana 模型,能直接改图片里的文字,还能和同事一起做图,比单纯用 prompt 生成图更灵活。
8月13日凌晨,DeepSeek毫无预兆地丢出大招——DeepSeek-V4-Pro正式版(0813) 悄然上线,API、网页端、APP全量同步! 📊 硬核数据:从“吊车尾”到“屠榜王” V4 Pro正式版在Agent能力上的提升,已经不…
微软新出的文生图模型冲到了全球第二,只比 GPT Image 2 差一点,还超过了 Grok 和 Meta,下周就能用 API 了。
中国出口"新新三样":从打火机到爬墙机器人,世界不再只是买便宜货 我们观察到一组清晰的数据信号:中国出口的"新新三样"已经从过去的服装、家具、家电,换成机器人、AI模型和创新药物。这不是产业升级的修辞游戏,而是发生在澳大利亚和巴西的实证样…
Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索…
Hugging Face CEO吐槽谷歌:闭源Gemini和Veo只赚点小钱,开源可能早称霸AI了。你怎么看?
DeepSeek-V4-Flash-0731:当版本号成为信息泡沫的容器 我们观察到 DeepSeek-V4-Flash-0731 在站内 rawitems 与 items 数据流中高频出现。需要先声明一个基本口径:截至本文撰写时,Dee…
Google一口气更新了多个模型,机器人、快模型、修漏洞的,还有能生成地球图片的Nano Banana 2,看看有没有你需要的。
Ideogram新出的物体移除工具,在RemovalBench上拿了第一,价格还最低,想清理图片里杂物可以试试。
Meta 的新图像模型 Muse Image 在权威榜单排第二,仅次于 GPT Image 2,能精准编辑和参考多张图合成,试试看
OpenAI 下周可能发 GPT-5.6,配额更宽松,专门抢 Claude 用户。同时 Gemini 3.5 Pro 也跳票到 7 月 17 日。想了解前沿模型动态的可以关注。
Google 发了两个新 Gemini 媒体模型,Nano Banana 2 Lite 生成图片只要 4 秒,1 美元能买 30 张;Omni Flash 按秒收费 0.1 美元,适合实时处理。
AIE第二天演讲名单很硬核:Anthropic的Fable、DeepMind的Nano Banana/Veo/Omni团队、Amazon AGI,还有RSI自动研究。搞AI工程的人别错过。
Anthropic发了Sonnet 5,Google出了Nano Banana Lite和Omni Flash,还有Claude生成广告的教程,干货满满。
Poe上新了!Anthropic的Sonnet 5编码强还便宜,Google的Nano Banana 2 Lite 4秒出图,快去试试。
Google把Nano Banana 2 Lite和Omni Flash串起来,先4秒出图再直出动画,比主流模型快且便宜。创意迭代更爽。
Google 出了个好玩的多模型演示,上传照片就能让 Nano Banana 2 Lite 和 Omni 合作生成明信片,想看看不同模型怎么配合的可以试试。
Google发了两个新模型:Nano Banana 2 Lite图像模型更快更省钱,还有Gemini Omni Flash能做视频生成和编辑,今天就能在API上用了。
Google 一口气发了两个新东西:一个超快的图像模型 Nano Banana 2 Lite,一个能生成视频的 Gemini Omni Flash API,都是实际能用的。
DeepMind 让 Nano Banana 和 Gemini Omni 能配合干活了,先画图后动画,还能连续改三次,挺实用。
Google DeepMind的Gemini Omni Flash视频编辑能力强,比对手高40分,还发布了更便宜的图像模型Nano Banana 2 Lite。
Google一口气发了两个模型:一个4秒出图,一个直接生成视频,还能连起来用,成本还低,搞创作的可以试试。
Google新出了两个模型:Lite低成本快速出图(4秒/张,千张34美元),Omni Flash视频生成在LMArena登顶,性价比不错。想省钱做图或搞视频的可以关注。
Google今天发了两个新API:一个4秒生图才3分4,另一个能边聊边改视频,价格和Veo 3.1一样。
Google 发了两款新模型:一个 4 秒出图、千张只要 3 分 4;另一个视频编辑达到 SOTA 且和 Veo 3.1 Fast 一样便宜。
Google 上线了 Interactions API,一个 API 就能调用 Gemini 模型和智能体,还有沙箱、图像音乐生成,异步运行很简单。
这份指南把 Gemini 从基础调用到自主智能体的路径讲清楚了,做 AI 应用开发的团队可以直接照着 11 步上手,省去自己摸索的时间。
Google 一周内连发 6 项更新,覆盖企业智能体、科学推理、端侧模型和创意工具,做 AI 应用开发或科学研究的团队值得逐一了解,尤其是 Co-Scientist 和 Gemma 4 12B 的离线能力值得一试。
图像生成赛道竞争白热化,Ideogram 4.0 直接对标 Midjourney v8 和 FLUX,做 AI 绘画的团队值得关注这份横向评测,看看新模型是否值得切换。
文生图竞技场排名大洗牌,做 AI 图像生成或内容创作的团队值得关注——Reve 2.0 的 4K 精度和布局控制能力可能改变高质量图像生成的标准,建议点开看看它如何超越 GPT-Image。
开源图像生成模型终于追上闭源水平了,做 AI 绘画应用或自建图像生成管线的开发者可以直接下载权重和微调,值得试试。
图像编辑模型竞争白热化,微软 MAI-Image-2.5 已超越 Google,做 AI 图像生成或编辑的开发者可以关注这个新选择,看看它和 GPT-Image-2 的差距在哪。