Gemini · Last 7 days
Gemini 3.8 Flash
0–100 · higher means more positive community experience, not benchmark performance.
Updated 2026-09-05 14:21 UTC · 2026-08-29 – 2026-09-05 UTCCommunity score43.5/100140 comments in 7 days
Gemini · Last 7 days
0–100 · higher means more positive community experience, not benchmark performance.
Updated 2026-09-05 14:21 UTC · 2026-08-29 – 2026-09-05 UTC
Community reviews
Selected comments from the last 7 days. The balance of excerpts does not represent the share of positive reviews.
6 selected excerpts
Show original
它能梳离明白一本时间线混乱,叙述性诡计的十万字推理小说,我试的其他模型都做不到
Show original
依旧流程一长不是流口水就是偷懒,及早放弃用来coding
Show original
我觉得3.7 3.8 比3.1要提高不少
Show original
这一比gpt不太行
Show original
一样的模型,一个号的flash,pro突然变得非常高冷,说话一板一眼的了。而且说话也不爱1,2,3这种方式。类比全部消失。
Show original
DeepSWE v1.1,3.8 Flash 得分 73.7%,较 3.7 Flash 的 65.3% 提升超过 8 个百分点,Ars Technica 报道称它已登顶该榜单。专注智能体终端编码的 Terminal-bench 2.1 上,它拿到 89.4%,超过了一众旗舰模型。
Show original
你说它不行吧,它有海鲜市场几块钱18个月的订阅,我至少撑了3周了已经回本了,它的水平肯定高于10块人民币提供的价值。你说它行吧,30%的情况下需要别的模型擦腚。
Show original
编程肯定3.8flash
Show original
不如豆包
Show original
依旧刷题一流,跑分一流,实际一坨。
Show original
gemini 3.8 flash 花了 2 分钟写了两屏幕多,我都懒得看它写的重点是什么
Show original
除了快好像没别的优点了
Show original
无视提示词,agents.md,等文件要求 自作聪明,导致结果看起来很漂亮实际上就是一坨狗屎
Show original
Flash的同级别对手是Sonnet/Terra,和Opus/Sol比还真是高看谷歌啊
Show original
基于我的使用体验,它在 coding 方面的提升是非常不错的。对比 3.6 -> 3.7 从不可用到可用,其实我个人觉得 3.7 -> 3.8 可以算是 可用到好用了
Show original
需要你在任务分解和提示词上费功夫,但是相比3.7连写好的计划都无法实现来说,3.8还是强很多
Show original
其他不知道,但rp🦌客狂喜,活人感极强
Show original
Deep SWE 是单任务短编程,而 Terminal Bench 4 是平均五六个小时的长任务编程。Flash 模型,Terminal Bench 4 基本不会很高
Show original
gemini的输出速度是300t/s
No selected comments for this filter in the last 7 days.