核心功能
Google出品的个人AI助手,深度融入Google账号与搜索生态。可打字、语音、传图或拍照提问,Android用「Hey Google」唤起;速览Gmail与Drive资料、基于搜索实时作答;Gemini Live实时语音、Deep Research生成报告,付费档解锁更高用量与百万上下文。
功能亮点
屏幕问答
Android上喊「Hey Google」,直接询问当前屏幕内容并执行操作
多应用串联
一条指令跨Gmail、日历、地图取数,办完事不用切App
实时语音
Gemini Live边听边答,适合采访练习、头脑风暴与出行导览
百万上下文
Pro档1M token,一次读完整本长书或整段代码仓库
逻辑图谱
flowchart LR
A[多模态输入] --> B[原生多模态理解]
B --> C[超长上下文推理]
C --> D[跨 Google 生态整合]
D --> E[生成输出]适用 / 不适用场景
✓ 适用
- 图文音视频多模态理解
- 超长文档与代码库分析
- 与 Google Workspace 协作
- 移动端实时 AI 助手
- 科研与数据分析
✗ 不适用
- 中国大陆直接访问(需梯子)
- 完全离线运行
- 对 Google 生态外的隐私敏感场景
- 需要强本地化中文服务
自定义模型 / 模型接入
锁定(官方模型)
仅提供Google自家Gemini模型,默认按问题自动路由Flash/Pro,订阅档位决定模型访问级别与上下文上限。
接入方式
- 官方Web/App直接使用
- 订阅Google AI Plus/Pro/Ultra提升模型权限
- API经Google AI Studio/Vertex AI调用
支持模型
Gemini系列(Flash/Pro自动路由)Imagen图像生成Veo/Omni视频生成
适用场景
• Gmail/Drive资料速览与总结
• 拍照识物与屏幕问答
• 实时语音对话与练习
• 深度调研生成报告
• 行程规划与地图串联
安装配置
浏览器访问 https://gemini.google.com 用Google账号登录;Android/iOS应用商店下载Gemini App;订阅Google AI Plus/Pro/Ultra提升用量
使用方法
bash
1) 打开gemini.google.com或手机App,用Google账号登录 2) 直接打字、说话或拍照提问,如「这张图里的植物是什么」 3) 让Gemini速览Gmail邮件或Drive文档,快速定位关键信息 4) 问「做份关于XX的调研报告」,用Deep Research自动检索数百网页出报告 5) 在Android上把Gemini设为默认助手,喊「Hey Google」询问屏幕内容 6) 用Gems保存常用指令与文件,打造专属AI专家
关键指标
尚未核验对标产品,此处只列本工具自身指标,不做对比结论。
指标Gemini
价格免费增值
开源否
上手难度入门
Token 消耗中
相关工具
同类工具
优点
- 与Google搜索、全家桶深度打通
- 多模态输入方式丰富
- 免费档功能完整
- 语音与屏幕交互自然
缺点
- 部分功能按地区/语言分批开放
- 高级模型与高用量需订阅
- 依赖Google账号生态