Gemini · Last 7 days
Gemini 3.8 Flash
0–100 · higher means more positive community experience, not benchmark performance.
Updated 2026-09-05 14:21 UTC · 2026-08-29 – 2026-09-05 UTCCommunity score43.5/100140 comments in 7 days
Gemini · Last 7 days
0–100 · higher means more positive community experience, not benchmark performance.
Updated 2026-09-05 14:21 UTC · 2026-08-29 – 2026-09-05 UTC
Community reviews
Selected comments from the last 7 days. The balance of excerpts does not represent the share of positive reviews.
29 selected excerpts
Show original
它能梳离明白一本时间线混乱,叙述性诡计的十万字推理小说,我试的其他模型都做不到
Show original
依旧流程一长不是流口水就是偷懒,及早放弃用来coding
Show original
我觉得3.7 3.8 比3.1要提高不少
Show original
这一比gpt不太行
Show original
一样的模型,一个号的flash,pro突然变得非常高冷,说话一板一眼的了。而且说话也不爱1,2,3这种方式。类比全部消失。
Show original
DeepSWE v1.1,3.8 Flash 得分 73.7%,较 3.7 Flash 的 65.3% 提升超过 8 个百分点,Ars Technica 报道称它已登顶该榜单。专注智能体终端编码的 Terminal-bench 2.1 上,它拿到 89.4%,超过了一众旗舰模型。
Show original
你说它不行吧,它有海鲜市场几块钱18个月的订阅,我至少撑了3周了已经回本了,它的水平肯定高于10块人民币提供的价值。你说它行吧,30%的情况下需要别的模型擦腚。
Show original
编程肯定3.8flash
Show original
不如豆包
Show original
依旧刷题一流,跑分一流,实际一坨。
Show original
gemini 3.8 flash 花了 2 分钟写了两屏幕多,我都懒得看它写的重点是什么
Show original
除了快好像没别的优点了
Show original
无视提示词,agents.md,等文件要求 自作聪明,导致结果看起来很漂亮实际上就是一坨狗屎
Show original
Flash的同级别对手是Sonnet/Terra,和Opus/Sol比还真是高看谷歌啊
Show original
基于我的使用体验,它在 coding 方面的提升是非常不错的。对比 3.6 -> 3.7 从不可用到可用,其实我个人觉得 3.7 -> 3.8 可以算是 可用到好用了
Show original
需要你在任务分解和提示词上费功夫,但是相比3.7连写好的计划都无法实现来说,3.8还是强很多
Show original
其他不知道,但rp🦌客狂喜,活人感极强
Show original
Deep SWE 是单任务短编程,而 Terminal Bench 4 是平均五六个小时的长任务编程。Flash 模型,Terminal Bench 4 基本不会很高
Show original
gemini的输出速度是300t/s
No selected comments for this filter in the last 7 days.