← 全部模型

Gemini · 近 7 天

Gemini 3.8 Flash

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-09-05 14:21 UTC · 2026-08-29 – 2026-09-05 UTC
社区口碑分43.5/100140 条评论 · 近 7 天

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

29 条精选摘录

褒贬兼有速度与延迟

“我觉得它和luna差不多,但更快。而terra显然更智能。Gemini 3.8 flash仍然有老gemini的问题,经常只追求快速的表面解决方案。”

Redditen机器翻译
展开原文

I'd say it's about equal to luna, but FAST. And terra is definitely more intelligent. Gemini 3.8 flash still has that old gemini problem of often just going for the quick surface solution.

正面推理

“它能梳离明白一本时间线混乱,叙述性诡计的十万字推理小说,我试的其他模型都做不到”

正面通用文本

“Gemini 3.8 flash 现在确实挺不错的。”

Redditen机器翻译
展开原文

Gemini 3.8 flash is actually pretty good now.

正面推理

“我用 gem 3.8 flash 处理中等任务,感觉这正好,因为它有时候会想太多。”

Redditen机器翻译
展开原文

I did gem 3.8 flash on medium I feel its the perfect one for that because sometimes it can over think

负面速度与延迟

“依旧流程一长不是流口水就是偷懒,及早放弃用来coding”

正面通用文本

“我觉得3.7 3.8 比3.1要提高不少”

负面通用文本

“这一比gpt不太行”

负面通用文本

“一样的模型,一个号的flash,pro突然变得非常高冷,说话一板一眼的了。而且说话也不爱1,2,3这种方式。类比全部消失。”

负面安全与拒答

“Gemini非常有自信地无视指令。 我以为3.8会改善,但不知为何感觉甚至更糟了。就算我明确告诉它"直接告诉我",它还是直接去编辑文件。”

Redditen机器翻译
展开原文

Gemini confidently ignores instructions. I thought things would get better with 3.8, but somehow it feels even worse. Even when I explicitly tell it something like "just tell me", it goes straight into editing files.

正面编程

“DeepSWE v1.1,3.8 Flash 得分 73.7%,较 3.7 Flash 的 65.3% 提升超过 8 个百分点,Ars Technica 报道称它已登顶该榜单。专注智能体终端编码的 Terminal-bench 2.1 上,它拿到 89.4%,超过了一众旗舰模型。”

正面通用文本

“Luna太烂了。赶紧用Gemini 3.8 flash吧。”

Redditen机器翻译
展开原文

Luna sucks. Use Gemini 3.8 flash ffs

褒贬兼有通用文本

“你说它不行吧,它有海鲜市场几块钱18个月的订阅,我至少撑了3周了已经回本了,它的水平肯定高于10块人民币提供的价值。你说它行吧,30%的情况下需要别的模型擦腚。”

正面编程

“编程肯定3.8flash”

褒贬兼有编程

“gemini 3.8 flash 编程确实非常出色。问题在于指令遵循和做出错误假设,还有就是你给它一个计划它却返回一个更差的计划。但我注意到如果”

Redditen机器翻译
展开原文

gemini 3.8 flash is genuinely excellent at coding. It's the instruction following and making wrong assumptions that suck and the annoying thing where you give it a plan and it comes back with an inferior plan. But one thing i've noticed if

正面速度与延迟

“Gemini 3.8 Flash(尤其是考虑到它的价格和TPS,是一个_出色_的模型!!”

Hacker Newsen机器翻译
展开原文

Gemini 3.8 Flash (which is an _excellent_ model especially for its price and TPS!!

负面通用文本

“不如豆包”

正面速度与延迟

“Gemini 3.8 flash 作为一个小型模型来说非常出色”

Redditen机器翻译
展开原文

Gemini 3.8 flash is amazing for a small model

负面推理

“它的推理与 qat 中的 gemma 4 e2b 相比就是一坨屎”

Redditen机器翻译
展开原文

Son raisonnement est merdique comparé à gemma 4 e2b en qat

负面编程

“3.8 flash 跑分刷到极致,垃圾模型”

Redditen机器翻译
展开原文

3.8 flash is benchmaxxed to hell, garbage model

负面推理

“依旧刷题一流,跑分一流,实际一坨。”

负面速度与延迟

“gemini 3.8 flash 花了 2 分钟写了两屏幕多,我都懒得看它写的重点是什么”

负面速度与延迟

“除了快好像没别的优点了”

负面推理

“无视提示词,agents.md,等文件要求 自作聪明,导致结果看起来很漂亮实际上就是一坨狗屎”

中性通用文本

“Flash的同级别对手是Sonnet/Terra,和Opus/Sol比还真是高看谷歌啊”

正面编程

“基于我的使用体验,它在 coding 方面的提升是非常不错的。对比 3.6 -> 3.7 从不可用到可用,其实我个人觉得 3.7 -> 3.8 可以算是 可用到好用了”

正面推理

“需要你在任务分解和提示词上费功夫,但是相比3.7连写好的计划都无法实现来说,3.8还是强很多”

正面角色扮演/创作

“其他不知道,但rp🦌客狂喜,活人感极强”

中性编程

“Deep SWE 是单任务短编程,而 Terminal Bench 4 是平均五六个小时的长任务编程。Flash 模型,Terminal Bench 4 基本不会很高”

中性速度与延迟

“gemini的输出速度是300t/s”