Whisper 原始輸出
1
00:00:00,000 --> 00:00:01,000
Hello大家好
2
00:00:01,000 --> 00:00:02,200
欢迎来到创造科技工坊
3
00:00:02,200 --> 00:00:03,000
2023年
4
00:00:03,000 --> 00:00:05,800
Google发布了一款研究使用的笔记产品
5
00:00:05,800 --> 00:00:08,000
那就是Notebook LM
6
00:00:08,000 --> 00:00:12,400
起初这款应用是Google内部的一个20%的创业项目
7
00:00:12,400 --> 00:00:16,000
也就是员工利用闲暇时间自主敷贯项目
8
00:00:16,000 --> 00:00:18,600
但是没有想到一上线就大获好评
9
00:00:18,600 --> 00:00:22,200
它巧妙地把Google生态海量的数据作为信息源
10
00:00:22,200 --> 00:00:25,000
然后将Gemini作为其AI引擎
11
00:00:25,000 --> 00:00:29,800
达到了一款完美的可以帮助用户研究各种主题的笔记工具
12
00:00:29,800 --> 00:00:31,800
它不同于其他的笔记本的应用
13
00:00:31,800 --> 00:00:34,200
它能够消化多模态的数据源
14
00:00:34,200 --> 00:00:36,800
依赖于Gemini的多模态的能力
15
00:00:36,800 --> 00:00:39,200
还能以丰富的形式进行输出
16
00:00:39,200 --> 00:00:45,400
应用场景覆盖了科研、学习、日常工作、资料汇总、生活等等场景
17
00:00:45,400 --> 00:00:47,600
但是就在7月16号
18
00:00:47,600 --> 00:00:52,400
Google突然宣布将Notebook LM改名为Gemini Notebook
19
00:00:52,400 --> 00:00:56,200
正是把这款应用融合进了Gemini的产品线当中
20
00:00:56,200 --> 00:00:58,200
经过将近三年的进化
21
00:00:58,200 --> 00:01:00,200
它终于转正了
22
00:01:00,200 --> 00:01:03,200
我也是经常使用这款超强的笔记软件
23
00:01:03,200 --> 00:01:05,200
今天就借着改名的契机
24
00:01:05,200 --> 00:01:09,200
为大家介绍如何使用这款Notebook应用吧
25
00:01:09,200 --> 00:01:11,200
这次产品名称变更
26
00:01:11,200 --> 00:01:12,600
并不仅仅是修改名称
27
00:01:12,600 --> 00:01:14,600
它同步带来几项更新
28
00:01:14,600 --> 00:01:19,600
原本Notebook LM就具备强大的数据处理跟汇总的能力
29
00:01:19,600 --> 00:01:22,000
它能够把多模态的数据汇总
30
00:01:22,000 --> 00:01:26,000
根据用户的需求分析之后通过图像文字
31
00:01:26,000 --> 00:01:29,000
幻灯片音频视频等等形式输出
32
00:01:29,000 --> 00:01:31,000
本来这些形式就够多了
33
00:01:31,000 --> 00:01:33,000
近期它还增加短视频
34
00:01:33,000 --> 00:01:35,000
也可以输出数百万视频
35
00:01:35,000 --> 00:01:37,000
除此之外
36
00:01:37,000 --> 00:01:38,000
PDF
37
00:01:38,000 --> 00:01:39,000
Excel
38
00:01:39,000 --> 00:01:40,000
图表
39
00:01:40,000 --> 00:01:42,000
报告等等形式都可以适配不同的场景
40
00:01:42,000 --> 00:01:44,000
例如通情的时候可以听音频
41
00:01:44,000 --> 00:01:47,000
做汇报的时候可以用幻灯片和数据报告
42
00:01:47,000 --> 00:01:49,000
演示的时候可以使用视频
43
00:01:49,000 --> 00:01:53,000
或者深入理解的时候可以使用思维导图
44
00:01:53,000 --> 00:01:54,000
第二点
45
00:01:54,000 --> 00:01:57,000
Geminate Notebook增加了深度研究的功能
46
00:01:57,000 --> 00:01:58,000
在启动研究项目的时候
47
00:01:58,000 --> 00:02:02,000
它不再需要用户费尽心思的提供一系列的材料
48
00:02:02,000 --> 00:02:03,000
作为启动的资料
49
00:02:03,000 --> 00:02:06,000
而是可以根据用户简单的描述
50
00:02:06,000 --> 00:02:08,000
进行深度的研究
51
00:02:08,000 --> 00:02:10,000
然后自动搜索一系列的数据材料
52
00:02:10,000 --> 00:02:12,000
作为启动信息
53
00:02:12,000 --> 00:02:14,000
大大降低的使用的门槛
54
00:02:14,000 --> 00:02:15,000
接下来的变化有点厉害了
55
00:02:15,000 --> 00:02:18,000
不过对于普通用户来说可能是不可见的
56
00:02:18,000 --> 00:02:21,000
就是Google为每一个建立的笔记本
57
00:02:21,000 --> 00:02:23,000
都提供一台云电脑
58
00:02:23,000 --> 00:02:24,000
方便在分析过程当中
59
00:02:24,000 --> 00:02:27,000
在云电脑上原生的撰写和运行脚本
60
00:02:27,000 --> 00:02:30,000
它可以允许用户在不同使用场景中进行深度分析
61
00:02:30,000 --> 00:02:31,000
研究
62
00:02:31,000 --> 00:02:34,000
这个功能已经开放给了Eldra计划的用户
63
00:02:34,000 --> 00:02:37,000
和使用了Google Workspace Business的用户
64
00:02:37,000 --> 00:02:40,000
接下来几周也会为Pro计划的用户开放使用
65
00:02:40,000 --> 00:02:41,000
另外
66
00:02:41,000 --> 00:02:43,000
目前Gemini Notebook已经对接了Gemini
67
00:02:43,000 --> 00:02:44,000
而下一步
68
00:02:44,000 --> 00:02:46,000
Google会把Gemini Notebook
69
00:02:46,000 --> 00:02:49,000
接入到Google搜索的AI模式当中
70
00:02:49,000 --> 00:02:54,000
进步让个人数据能够在AI场景下提供个性化的数据支持
71
00:02:54,000 --> 00:02:55,000
除此以外
72
00:02:55,000 --> 00:02:56,000
今天的视频当中
73
00:02:56,000 --> 00:02:59,000
我还会为大家介绍如何搭配MCP服务器
74
00:02:59,000 --> 00:03:04,000
让本地的智能体也能够访问Gemini Notebook
75
00:03:04,000 --> 00:03:05,000
接下来我用一个Leave
76
00:03:05,000 --> 00:03:08,000
也就是一下Gemini Notebook最基础的使用方法
77
00:03:08,000 --> 00:03:10,000
我今天用的Leave
78
00:03:10,000 --> 00:03:13,000
其实就是我想把家里的车折换成一辆电动车
79
00:03:13,000 --> 00:03:16,000
我想选一辆最合适我们家的电动车
80
00:03:16,000 --> 00:03:17,000
我需要调研
81
00:03:17,000 --> 00:03:19,000
最好是能根据实际的情况
82
00:03:19,000 --> 00:03:21,000
请模型给我推荐几款车型
83
00:03:21,000 --> 00:03:24,000
进入Gemini Notebook页面
84
00:03:24,000 --> 00:03:26,000
我们首先建立一个新的笔记本
85
00:03:26,000 --> 00:03:27,000
点击新件
86
00:03:27,000 --> 00:03:29,000
进来之后就会展示到这个一面
87
00:03:29,000 --> 00:03:32,000
通常我们会把自己搜集的材料
88
00:03:32,000 --> 00:03:36,000
UIL文本PDF或者Google Drive文件
89
00:03:36,000 --> 00:03:37,000
关联或者复制进来
90
00:03:37,000 --> 00:03:39,000
这是我们初始化的文件
91
00:03:39,000 --> 00:03:43,000
但是现在由于Google已经提供了初始化搜索功能
92
00:03:43,000 --> 00:03:46,000
我也不用再费心自己去找了
93
00:03:46,000 --> 00:03:49,000
所以我可以直接注明我的需求
94
00:03:49,000 --> 00:03:52,000
让笔记本帮我搜集初始化信息
95
00:03:52,000 --> 00:03:56,000
比如在这里我们就可以输入这样一道指令
96
00:03:56,000 --> 00:04:00,000
接下来我只需要首先先选择来源
97
00:04:00,000 --> 00:04:03,000
我可以选择是网络还是Google Drive
98
00:04:03,000 --> 00:04:07,000
接下来我们可以选择是迅速的调研搜索
99
00:04:07,000 --> 00:04:10,000
还是让它进行深度的搜索跟匹配
100
00:04:10,000 --> 00:04:13,000
这里我选择让Notebook进行深入分析
101
00:04:13,000 --> 00:04:14,000
然后执行
102
00:04:14,000 --> 00:04:16,000
哪怕我们现在关掉整个页面
103
00:04:16,000 --> 00:04:18,000
离开一会也不会有问题
104
00:04:18,000 --> 00:04:22,000
Gemini Notebook会自动完成信息的汇总和初步的
105
00:04:22,000 --> 00:04:23,000
调研工作
106
00:04:23,000 --> 00:04:26,000
这时候我只需要给笔记本取一个名字
107
00:04:26,000 --> 00:04:28,000
购买电动车调研
108
00:04:28,000 --> 00:04:31,000
OK等一会儿Notebook显示材料已经准备好了
109
00:04:31,000 --> 00:04:33,000
我们只需要点击import
110
00:04:33,000 --> 00:04:35,000
就可以把所有资料导入到这个笔记本了
111
00:04:35,000 --> 00:04:39,000
大家可以看到它会进行逐个的导入
112
00:04:39,000 --> 00:04:41,000
扫描这些页面上的内容
113
00:04:41,000 --> 00:04:42,000
然后整理它们
114
00:04:42,000 --> 00:04:43,000
并放到笔记本当中
115
00:04:43,000 --> 00:04:46,000
根据各位订阅的Google AI的计划
116
00:04:46,000 --> 00:04:49,000
Notebook可以容纳资料数量也是有限的
117
00:04:49,000 --> 00:04:51,000
这里我来说明一下各项的限制
118
00:04:51,000 --> 00:04:54,000
免费版本用户允许建立100个笔记本
119
00:04:54,000 --> 00:04:56,500
每个笔记本允许导入50条资料
120
00:04:57,000 --> 00:04:59,000
Plus用户允许建立200个笔记本
121
00:04:59,000 --> 00:04:59,760
200个笔记本
122
00:04:59,760 --> 00:05:00,160
每个笔记本
123
00:05:00,000 --> 00:05:02,240
笔记本能允许导入100条资料
124
00:05:02,240 --> 00:05:05,760
而Pro的用户则允许建立500个笔记本
125
00:05:05,760 --> 00:05:08,000
每个笔记本允许300条资料
126
00:05:08,000 --> 00:05:10,700
最后是eldron用户
127
00:05:10,700 --> 00:05:12,800
允许建立500个笔记本
128
00:05:12,800 --> 00:05:14,540
eldron其实分为两档
129
00:05:14,540 --> 00:05:15,840
一个是100刀的版本
130
00:05:15,840 --> 00:05:19,500
这时候用户允许每个笔记本存储500条记录
131
00:05:19,500 --> 00:05:24,000
而200刀的用户允许每个笔记本存储600条记录
132
00:05:24,000 --> 00:05:28,200
这个就是不同的Plan对应的笔记本数量
133
00:05:28,200 --> 00:05:31,500
以及笔记本里面资料的条目的数量的限制了
134
00:05:31,500 --> 00:05:33,500
大家可以根据自己的需求
135
00:05:33,500 --> 00:05:36,200
比如说你刚开始试用的时候可以先用个免费版本
136
00:05:36,200 --> 00:05:38,500
如果逐步增加体量的话
137
00:05:38,500 --> 00:05:41,500
大家可以提升或者升级自己订阅的普烂
138
00:05:41,500 --> 00:05:42,900
以适配自己的需求
139
00:05:42,900 --> 00:05:44,200
导入所有材料之后
140
00:05:44,200 --> 00:05:48,700
主界面会显示一段对于所有资料的内容汇总和体验
141
00:05:48,700 --> 00:05:51,900
总结下方会有一些建议的问题
142
00:05:51,900 --> 00:05:54,000
方便我们继续推进调研
143
00:05:54,000 --> 00:05:57,200
这里我们还能点击这个自定义的按钮
144
00:05:57,200 --> 00:05:59,500
选择一张图片作为笔记本的封面
145
00:05:59,500 --> 00:06:02,900
这个自定义的按钮和功能能让我们的笔记本美化不少
146
00:06:02,900 --> 00:06:04,500
左边是资料列表
147
00:06:04,500 --> 00:06:06,200
显示我们导入所有资料
148
00:06:06,200 --> 00:06:07,700
如果你希望增加资料
149
00:06:07,700 --> 00:06:09,900
可以点击上面的add sources按钮
150
00:06:09,900 --> 00:06:12,500
资料来源可以是上传文件
151
00:06:12,500 --> 00:06:13,500
网页链接
152
00:06:13,500 --> 00:06:16,300
特别是支持YouTube的页面链接
153
00:06:16,300 --> 00:06:17,500
Google drive
154
00:06:17,500 --> 00:06:19,700
以及拷贝文本文件
155
00:06:19,700 --> 00:06:22,800
也可以通过粘贴在这个地方上传资料
156
00:06:22,800 --> 00:06:25,800
类型上支持PDF图片
157
00:06:26,300 --> 00:06:27,000
Google doc
158
00:06:27,500 --> 00:06:28,000
音频
159
00:06:28,500 --> 00:06:30,100
更多的支持的类型
160
00:06:30,100 --> 00:06:31,400
大家可以点击add more
161
00:06:31,400 --> 00:06:34,800
这里列出了所有支持的文件的格式和类型
162
00:06:34,800 --> 00:06:39,800
下方进度条显示该笔记本还剩于多少资料的额度
163
00:06:39,800 --> 00:06:41,100
资料的左上角
164
00:06:41,300 --> 00:06:42,600
这里有一个按钮
165
00:06:42,600 --> 00:06:45,500
这个按钮是一键切换到标签式图
166
00:06:45,500 --> 00:06:48,000
所有标签式图都是模型自动生成的
167
00:06:48,000 --> 00:06:52,500
所谓标签式图求实其实就是把所有的文章或资料进行分类
168
00:06:52,700 --> 00:06:54,300
打造不同的类目的标签
169
00:06:54,300 --> 00:06:57,500
然后以标签的形式聚合在一起显示出来
170
00:06:57,500 --> 00:06:59,600
大家可以看到这是红色链接的文件
171
00:06:59,600 --> 00:07:00,400
也就是死链
172
00:07:00,400 --> 00:07:03,600
在这里我们可以点击删除这个信息源
173
00:07:03,600 --> 00:07:09,000
那以上就是我们通过自动化标签归类的文档
174
00:07:09,000 --> 00:07:09,500
巨额
175
00:07:09,500 --> 00:07:10,760
我们也可以点击它
176
00:07:10,760 --> 00:07:12,300
切回到原先的视图
177
00:07:12,300 --> 00:07:13,900
最后边这个studio列表里面
178
00:07:13,900 --> 00:07:16,400
列举了所有可以输出的内容格式
179
00:07:16,400 --> 00:07:18,400
包括音频换灯片
180
00:07:18,400 --> 00:07:19,300
视频
181
00:07:19,300 --> 00:07:21,400
视频包括长视频跟短视频
182
00:07:21,400 --> 00:07:22,600
思维导图
183
00:07:22,600 --> 00:07:23,400
报告
184
00:07:23,400 --> 00:07:24,200
闪卡
185
00:07:24,200 --> 00:07:25,400
问答题
186
00:07:25,400 --> 00:07:26,700
信息图谱
187
00:07:26,700 --> 00:07:27,900
以及数据报告
188
00:07:27,900 --> 00:07:29,000
这里有一个小提示
189
00:07:29,000 --> 00:07:30,400
大家生成内容的时候
190
00:07:30,400 --> 00:07:32,700
不要直接点击按钮
191
00:07:32,700 --> 00:07:35,500
而是选择这个向右的箭头
192
00:07:35,500 --> 00:07:39,700
因为直接点击按钮会让notebook直接使用默认的设置生成内容
193
00:07:39,700 --> 00:07:43,400
而点击向右箭头就可以进入内容生成的设置
194
00:07:43,400 --> 00:07:45,700
不同内容设置的项目也不同
195
00:07:45,700 --> 00:07:49,600
但是gmail notebook给我们提供了深度定制的选项
196
00:07:49,600 --> 00:07:53,200
我个人用的比较多的还是音频和信息图谱
197
00:07:53,200 --> 00:07:56,200
前者可以让我在通勤的时候快速了解细节
198
00:07:56,200 --> 00:07:59,100
而后者可以让我高效的掌握全景图
199
00:07:59,100 --> 00:08:02,800
OK这些准备好之后最直接的当然是可以在这里直接提问
200
00:08:02,800 --> 00:08:08,000
比如我来问如果选择一辆电动车给我提供相应的选购的标准
201
00:08:08,000 --> 00:08:15,200
很快呢notebooklm就会从已经收录的所有资料当中分析我的问题
202
00:08:15,200 --> 00:08:16,500
然后找到对应答案
203
00:08:16,500 --> 00:08:18,600
OK大家可以看到花了一定时间之后呢
204
00:08:18,600 --> 00:08:21,400
所有的问题它已经输出了对应的答案
205
00:08:21,400 --> 00:08:23,700
那最有意思的是什么就是这些答案呢
206
00:08:23,700 --> 00:08:26,000
我们还可以把它变成我们的笔记
207
00:08:26,000 --> 00:08:27,900
在这里等它输出完成
208
00:08:27,900 --> 00:08:30,400
大家可以看到在左下角有个save to note
209
00:08:30,400 --> 00:08:31,300
我们点击它
210
00:08:31,300 --> 00:08:34,100
最后在左边呢生成一个笔记本
211
00:08:34,100 --> 00:08:34,800
这个笔记本呢
212
00:08:34,800 --> 00:08:40,100
我们可以直接加到我们的已有的笔记文件当中里面去做一个信息源
213
00:08:40,100 --> 00:08:41,700
我们直接convert to source
214
00:08:41,700 --> 00:08:45,400
你看它就会加到我们总体的信息源里面
215
00:08:45,400 --> 00:08:48,600
另外为了能够让选车更加符合我的需求
216
00:08:48,600 --> 00:08:52,000
我可以通过文本呢添加自身家庭的情况
217
00:08:52,000 --> 00:08:53,400
我们点击add sources
218
00:08:53,400 --> 00:08:55,200
然后呢点击copy text
219
00:08:55,200 --> 00:08:58,300
我们直接把我们家庭情况直接复制粘贴在这个地方
220
00:08:58,300 --> 00:08:59,600
然后点击insert
221
00:08:59,600 --> 00:09:00,400
这样子的话呢
222
00:09:00,400 --> 00:09:05,300
我们就把我们家庭情况作为一个数据员输入到了整个的数据列表当中
223
00:09:05,300 --> 00:09:07,100
然后呢我们再次进行提问
224
00:09:07,100 --> 00:09:09,900
这时候呢我要根据我的需求给我推荐几个车型
225
00:09:09,900 --> 00:09:11,400
然后呢分析优缺点
226
00:09:11,400 --> 00:09:12,300
然后推荐的理由
227
00:09:12,300 --> 00:09:13,700
以及放到一张表格里面
228
00:09:13,700 --> 00:09:16,600
它会结合我刚才提供的家庭的情况
229
00:09:16,600 --> 00:09:19,600
以及所有的关于建筑器材的资料
230
00:09:19,600 --> 00:09:21,900
然后帮我选择最适合匹配的车型
231
00:09:21,900 --> 00:09:23,600
我们看看结果如何
232
00:09:23,600 --> 00:09:24,900
OK内容已经输出了
233
00:09:24,900 --> 00:09:26,800
它贴心的推荐了几款车型
234
00:09:26,800 --> 00:09:30,000
然后呢按照要求进行了内容的整合
235
00:09:30,000 --> 00:09:31,000
非常的高效
236
00:09:31,000 --> 00:09:36,900
同样的我们也可以把它保存到我们的匹当中作为后续的参考
237
00:09:36,900 --> 00:09:38,700
其他的输出形式也是一样的
238
00:09:38,700 --> 00:09:43,100
都可以对于输出内容进入进行高度的自定义
239
00:09:43,100 --> 00:09:45,500
我们也可以生成一段视频或一段音频
240
00:09:45,500 --> 00:09:48,800
那我们这里呢以生成视频为一个例子
241
00:09:48,800 --> 00:09:50,800
我们点击下一个箭头
242
00:09:50,800 --> 00:09:52,100
这时候我们可以定义它
243
00:09:52,100 --> 00:09:54,200
然后大家可以看到这里面有三个选项车
244
00:09:54,200 --> 00:09:55,800
第一个就是电影级别
245
00:09:55,800 --> 00:09:57,700
它可能画质会比较高一些
246
00:09:57,700 --> 00:09:58,700
有些电影感
247
00:09:58,700 --> 00:10:00,000
第二个呢就是Explain的
248
00:10:00,000 --> 00:10:01,360
它是会比起平白
249
00:10:01,360 --> 00:10:03,760
就是平铺直序的
250
00:10:03,760 --> 00:10:06,840
然后非常简重点的把一些关键的介绍给你
251
00:10:06,840 --> 00:10:07,760
然后Short
252
00:10:07,760 --> 00:10:10,840
大家可以看到它有一个数项举行的标志
253
00:10:10,840 --> 00:10:12,640
所以它会生成一个短视频
254
00:10:12,640 --> 00:10:13,840
然后大家可以看到
255
00:10:13,840 --> 00:10:15,880
这是目前Notebook L&M
256
00:10:15,880 --> 00:10:18,320
或者German Notebook新提供的功能
257
00:10:18,320 --> 00:10:20,520
大家在这里根据自己需求选择
258
00:10:20,520 --> 00:10:23,840
大家要注意就是视频目前只支持英文
259
00:10:23,840 --> 00:10:25,280
不支持语言选择
260
00:10:25,280 --> 00:10:28,680
但大家比如选择比如说音频
261
00:10:28,680 --> 00:10:29,680
我们点击
262
00:10:29,680 --> 00:10:30,560
它可以看到这地方
263
00:10:30,560 --> 00:10:32,320
我也可以选择不同的语言
264
00:10:32,320 --> 00:10:34,560
大家可以根据自己的需求选择
265
00:10:34,560 --> 00:10:37,520
而比如说我们再来看一个
266
00:10:37,520 --> 00:10:39,880
我们看幻灯片
267
00:10:39,880 --> 00:10:41,560
它也是可以选择语言的
268
00:10:41,560 --> 00:10:44,560
所以目前在所有输出内容格式里面
269
00:10:44,560 --> 00:10:47,680
目前只是视频还不能生成
270
00:10:47,680 --> 00:10:48,960
还不能选择语言
271
00:10:48,960 --> 00:10:52,640
那其他的其实目前都是可以选择语言的
272
00:10:52,640 --> 00:10:54,000
好为了快速的DEMO
273
00:10:54,000 --> 00:10:58,160
我们先来尝试做一个短视频吧
274
00:10:58,160 --> 00:10:59,440
我们选择短视频
275
00:10:59,800 --> 00:11:02,480
然后它下面会给你一些推荐的关键点
276
00:11:02,480 --> 00:11:05,720
当然你也可以根据自己的需求
277
00:11:05,840 --> 00:11:08,200
然后设置一些指令prompt
278
00:11:08,200 --> 00:11:10,960
其实就是它比较关注的一些重点了
279
00:11:10,960 --> 00:11:13,000
好我们选择比如说
280
00:11:13,000 --> 00:11:15,200
2026年注点SUV
281
00:11:15,200 --> 00:11:16,160
然后Generate
282
00:11:16,160 --> 00:11:21,760
这时候右边就会出现一个生成视频状态的横条
283
00:11:21,760 --> 00:11:23,240
我们需要等一会儿
284
00:11:23,240 --> 00:11:25,960
当然你这时候关掉这个网页是没有问题的
285
00:11:25,960 --> 00:11:30,160
如果你手机上装了Gemla Notebook应用的话
286
00:11:30,280 --> 00:11:32,640
你可以等到它完成之后
287
00:11:32,640 --> 00:11:34,480
等APP通知你
288
00:11:34,480 --> 00:11:36,000
你再进去查看就可以了
289
00:11:36,000 --> 00:11:37,160
通过你手机查看也可以
290
00:11:37,160 --> 00:11:39,560
或者到网上查看也可以
291
00:11:39,920 --> 00:11:40,200
OK
292
00:11:40,200 --> 00:11:41,800
等着大概10分钟左右
293
00:11:41,800 --> 00:11:45,320
我也是从我的手机的应用里面看到这条消息
294
00:11:45,320 --> 00:11:46,640
这个视频已生成好了
295
00:11:46,640 --> 00:11:48,600
我可以看到这是一个短视频
296
00:11:48,600 --> 00:11:51,160
大概是1分17秒
297
00:11:51,160 --> 00:11:53,680
好我们来看一下是什么内容
298
00:11:53,680 --> 00:11:56,240
这是一个竖屏的视频
299
00:11:56,240 --> 00:11:59,680
它既有图像还有一些字幕
300
00:11:59,680 --> 00:12:02,760
然后它的图片其实变化的还蛮频繁的
301
00:12:02,760 --> 00:12:04,160
内容还是蛮丰富的
302
00:12:04,160 --> 00:12:05,760
整个视频不长
303
00:12:05,760 --> 00:12:06,360
它是短视频
304
00:12:06,360 --> 00:12:07,560
大概1分多钟的样子
305
00:12:07,560 --> 00:12:11,160
我前后拉了一下滚动条
306
00:12:11,160 --> 00:12:13,840
我觉得它内容说的还是
307
00:12:13,840 --> 00:12:15,840
就听到了几个点说的还是蛮详劲的
308
00:12:15,840 --> 00:12:21,440
其实这就是Notebook LM或者叫Gemini Notebook的最大的一个优势
309
00:12:21,440 --> 00:12:24,200
它能把所有的内容汇总之后
310
00:12:24,200 --> 00:12:25,760
然后以不同的形式输出
311
00:12:25,760 --> 00:12:28,040
这样子你在你不同的场景来使用的时候
312
00:12:28,040 --> 00:12:30,520
比如说你把短视频可以上传到短视频平台
313
00:12:30,520 --> 00:12:33,040
或者是把长视频存在本地
314
00:12:33,040 --> 00:12:34,800
或者是用音频
315
00:12:34,800 --> 00:12:37,000
然后在通勤的时候进行倾听
316
00:12:37,000 --> 00:12:40,760
都是可以让你快速的去掌握了解这个知识的体系
317
00:12:40,760 --> 00:12:42,360
这是最方便的一个点
318
00:12:42,360 --> 00:12:43,720
不过跟大家可以看到
319
00:12:43,720 --> 00:12:46,320
即使Gemini Notebook升级改名之后
320
00:12:46,320 --> 00:12:49,600
目前它这个水印还是Google Notebook LM
321
00:12:49,600 --> 00:12:51,760
期待后续会更正吧
322
00:12:51,760 --> 00:12:57,400
以上就是我们Gemini Notebook的一些最基本的用法了
323
00:12:57,400 --> 00:12:59,680
下面我们再介绍一下
324
00:12:59,680 --> 00:13:05,920
如何使用Gemini Notebook的MCP功能和本地的Agent进行交互
325
00:13:05,920 --> 00:13:08,800
OK 刚刚分享常规的Gemini Notebook的操作
326
00:13:08,800 --> 00:13:12,080
这些功能能够帮助我们大大提高调研的效率
327
00:13:12,080 --> 00:13:16,040
但是Gemini Notebook是有一个巨大的缺陷
328
00:13:16,040 --> 00:13:19,960
那就是目前还不能原生的融合到Agent的工作流当中
329
00:13:19,960 --> 00:13:23,360
或者说它本身就是一个用来用做调研的Agent
330
00:13:23,360 --> 00:13:27,160
Google并没有打算让它融合到其他的工作流当中
331
00:13:27,160 --> 00:13:29,120
但是这拦不住大家的热情
332
00:13:29,120 --> 00:13:32,920
Claude就为Notebook LM打造了一个MCP的服务器
333
00:13:32,920 --> 00:13:35,800
目前也可以应用到Gemini Notebook上面
334
00:13:35,800 --> 00:13:37,760
只要把它部署在本地
335
00:13:37,760 --> 00:13:39,760
你的Agent就可以随时随地的
336
00:13:39,760 --> 00:13:41,760
同Gemini Notebook进行交互
337
00:13:41,760 --> 00:13:45,360
其中包括上传文件到特定的笔记本
338
00:13:45,360 --> 00:13:47,680
生成材料并且下载
339
00:13:47,680 --> 00:13:49,200
目前主要是音频
340
00:13:49,200 --> 00:13:51,040
管理笔记本的内容等等
341
00:13:51,040 --> 00:13:52,840
你可以通过本地的Agent
342
00:13:52,840 --> 00:13:55,120
将Obsidian的信息
343
00:13:55,120 --> 00:13:57,840
同到特定的线上的Notebook里面
344
00:13:57,840 --> 00:14:02,000
或者利用Notebook的能力进行话题的研究
345
00:14:02,000 --> 00:14:04,000
并且产出多摩它的内容
346
00:14:04,000 --> 00:14:05,840
制作播客等等
347
00:14:05,840 --> 00:14:07,760
配置的过程其实非常简单
348
00:14:07,760 --> 00:14:09,160
目前这个MCP Server
349
00:14:09,160 --> 00:14:10,520
它原生的已经支持
350
00:14:10,520 --> 00:14:12,560
像Cloud Code, Cursor, Codex
351
00:14:12,560 --> 00:14:16,560
或者其他的MCP对接的Agent
352
00:14:16,560 --> 00:14:20,840
目前大概是三个月前进行了一些更新
353
00:14:20,840 --> 00:14:22,880
大家可以根据这里面详细的步骤
354
00:14:22,880 --> 00:14:24,720
去一步步完成整个的配置
355
00:14:24,720 --> 00:14:26,040
更简单的办法是什么
356
00:14:26,040 --> 00:14:28,520
就是打开你的工作台
357
00:14:28,520 --> 00:14:31,000
有可能是Cloud,有可能是Codex
358
00:14:31,000 --> 00:14:32,200
我这里是Codex
359
00:14:32,200 --> 00:14:34,720
直接我们把Github的链接
360
00:14:34,720 --> 00:14:36,720
给到Codex的人告诉他
361
00:14:36,720 --> 00:14:37,680
Please
362
00:14:38,400 --> 00:14:38,880
对吧
363
00:14:38,880 --> 00:14:39,880
Config
364
00:14:40,400 --> 00:14:42,640
MCP for me
365
00:14:42,640 --> 00:14:44,080
让他去帮你去配置
366
00:14:44,080 --> 00:14:45,800
根据流程
367
00:14:45,800 --> 00:14:47,360
其实我也是通过这种方式
368
00:14:47,360 --> 00:14:48,280
完成整个配置的
369
00:14:48,280 --> 00:14:50,680
前后其实用不到
370
00:14:50,680 --> 00:14:52,640
大概10到15分钟左右
371
00:14:52,760 --> 00:14:55,440
他就会把所有的配置帮你处理好
372
00:14:55,440 --> 00:14:56,840
并且帮你去验证
373
00:14:56,840 --> 00:14:58,160
在这个过程当中
374
00:14:58,160 --> 00:14:59,920
如果你首次使用
375
00:15:00,000 --> 00:15:00,880
配置过程当中
376
00:15:00,880 --> 00:15:03,320
它会弹出一个浏览器的窗口
377
00:15:03,320 --> 00:15:05,960
然后这时候需要你人工进行操作授权
378
00:15:05,960 --> 00:15:08,440
因为它其实MCP的原理
379
00:15:08,440 --> 00:15:11,600
是在本地的启动一个headless的browser
380
00:15:11,600 --> 00:15:14,040
然后通过这个browser去访问
381
00:15:14,040 --> 00:15:15,680
German notebook
382
00:15:15,680 --> 00:15:17,760
那这个browser首次启动的时候
383
00:15:17,760 --> 00:15:21,920
就需要你授权生成你自己的cookie
384
00:15:21,920 --> 00:15:24,760
然后给到这个无头和headless的browser
385
00:15:24,760 --> 00:15:25,760
后续进行使用
386
00:15:25,760 --> 00:15:26,680
所以第一次的话
387
00:15:26,680 --> 00:15:28,280
需要你人工操作进行授权
388
00:15:28,280 --> 00:15:29,280
授权完成之后
389
00:15:29,280 --> 00:15:32,080
就再也不需要你人工进行干预了
390
00:15:32,080 --> 00:15:33,760
它后续的每次调用的时候
391
00:15:33,760 --> 00:15:36,240
大家会自动启动本地的MCP服务器
392
00:15:36,240 --> 00:15:38,720
然后和远程的
393
00:15:38,720 --> 00:15:43,000
German notebook的页面进行相应的交互
394
00:15:43,000 --> 00:15:43,600
使用方法
395
00:15:43,600 --> 00:15:46,400
首先我们需要去注册一个notebook
396
00:15:46,400 --> 00:15:47,640
就是生成这个notebook
397
00:15:47,640 --> 00:15:49,280
目前还不能通过MCP
398
00:15:49,280 --> 00:15:52,000
那我们直接点击创建一个notebook
399
00:15:52,000 --> 00:15:53,360
然后在这里我们可以命名
400
00:15:53,360 --> 00:15:54,680
好这时候我们建立完之后
401
00:15:54,680 --> 00:15:56,360
我们点击share
402
00:15:56,360 --> 00:15:59,240
然后我们选择anyone with a link
403
00:15:59,240 --> 00:16:01,080
然后copy link
404
00:16:01,080 --> 00:16:01,640
然后save
405
00:16:01,640 --> 00:16:03,640
获得这个链接之后
406
00:16:03,640 --> 00:16:05,960
我们再回到我们的codex
407
00:16:05,960 --> 00:16:07,080
然后我们告诉他
408
00:16:07,080 --> 00:16:09,240
好一定要把这个链接分享给他
409
00:16:09,240 --> 00:16:14,680
他就会自动把这个链接的注册在本地的notebook的列表当中
410
00:16:14,680 --> 00:16:16,360
你之后在使用的时候
411
00:16:16,360 --> 00:16:18,600
他就会根据你的要求
412
00:16:18,600 --> 00:16:21,320
然后选取对应的notebook
413
00:16:21,320 --> 00:16:22,840
然后进行相应的操作了
414
00:16:22,840 --> 00:16:26,120
好了大家可以看到目前这个注册已经完成了
415
00:16:26,120 --> 00:16:26,840
完成之后的话
416
00:16:27,160 --> 00:16:30,680
我们就可以通过本地的MCP服务器进行操作了
417
00:16:30,680 --> 00:16:32,920
比如说我需要往里面增加一条资料
418
00:16:32,920 --> 00:16:35,080
我一定要告诉他是哪个notebook
419
00:16:35,080 --> 00:16:36,520
因为我们有多个notebook
420
00:16:36,520 --> 00:16:41,000
好大家看他其实是在本地维护了一个notebook的列表
421
00:16:41,000 --> 00:16:43,000
然后和远端其实是同步的
422
00:16:43,000 --> 00:16:44,680
就你分享完链接之后
423
00:16:44,680 --> 00:16:45,720
然后每次操作的时候
424
00:16:45,720 --> 00:16:48,680
他会从本地拿到远端notebook的信息
425
00:16:48,680 --> 00:16:53,160
然后的话通过无头的浏览器进行操作
426
00:16:53,160 --> 00:16:55,400
比如增加文件或者生成音频
427
00:16:55,400 --> 00:16:56,920
或者拉取相应资料
428
00:16:56,920 --> 00:16:59,320
然后操作完之后再反馈对应的信息
429
00:16:59,320 --> 00:17:02,440
到我们这个交互的窗口里面
430
00:17:02,440 --> 00:17:04,920
好大家可以看到他显示这么一条
431
00:17:04,920 --> 00:17:07,720
就是因为目前我们的notebook升级了
432
00:17:07,720 --> 00:17:09,240
升级成了这个
433
00:17:09,240 --> 00:17:11,240
比如说 证明的notebook
434
00:17:11,240 --> 00:17:13,480
它里面有些前端的css
435
00:17:13,480 --> 00:17:16,120
或者javascript的文件有些去改变
436
00:17:16,120 --> 00:17:17,720
所以它处理网页select
437
00:17:17,720 --> 00:17:19,000
有时候会失效
438
00:17:19,000 --> 00:17:21,000
这时候它会有一个fallback
439
00:17:21,000 --> 00:17:25,480
就是它mcp会打开一个可见性的浏览器的页面
440
00:17:25,480 --> 00:17:27,480
然后通过可见性浏览器页面
441
00:17:27,480 --> 00:17:29,320
再去进行实际的操作
442
00:17:29,320 --> 00:17:31,000
相当于直接打开浏览器
443
00:17:31,000 --> 00:17:33,320
去 insert相应的内容
444
00:17:33,320 --> 00:17:34,280
或者处理相应内容
445
00:17:34,280 --> 00:17:37,880
出现一个非常棒的一个就是托底的流程
446
00:17:37,880 --> 00:17:39,400
ok 飞了一番周折
447
00:17:39,400 --> 00:17:44,760
然后目前看到信息源已经加到了notebook里面了
448
00:17:44,760 --> 00:17:46,360
其实刚才
449
00:17:46,360 --> 00:17:50,600
这 mcp服务器在处理远端的网页的时候
450
00:17:50,600 --> 00:17:52,280
其实中间出现失败
451
00:17:52,280 --> 00:17:56,520
最后是kodex利用自己的浏览器的功能
452
00:17:56,520 --> 00:17:59,160
然后手工的把内容加到了对应的地方
453
00:17:59,160 --> 00:18:03,640
这就是我刚才谈到的目前notebooklm
454
00:18:03,640 --> 00:18:05,480
从升级到Jerm9 Notebook之后
455
00:18:05,480 --> 00:18:07,480
它的后端的代码发生一些变化
456
00:18:07,480 --> 00:18:08,680
所以目前这个lcp
457
00:18:08,680 --> 00:18:09,960
它是三个月之前更新的
458
00:18:09,960 --> 00:18:11,800
它可能需要近期更新之后
459
00:18:11,800 --> 00:18:14,200
有些功能才能完全的可用
460
00:18:14,200 --> 00:18:18,120
那么再尝试一下能不能让远端生成一个audio review
461
00:18:18,120 --> 00:18:19,640
然后我们拉到本地我们试一下
462
00:18:19,640 --> 00:18:21,880
好 大家看到目前的audio review的生成
463
00:18:21,880 --> 00:18:22,760
也在其中当中了
464
00:18:22,760 --> 00:18:25,720
看起来这个工具目前调用上是没有问题的
465
00:18:25,720 --> 00:18:29,160
所以我们需要耐心等待一下等待完成之后
466
00:18:29,160 --> 00:18:31,320
OK 好了 大概花了10多分钟
467
00:18:31,320 --> 00:18:34,520
目前生成了一个音频文件
468
00:18:34,520 --> 00:18:39,160
这音频文件也是从远端的notebook上面下载下来了
469
00:18:39,160 --> 00:18:41,240
然后大概35兆大小
470
00:18:41,240 --> 00:18:42,840
我们可以直接点击在这里
471
00:18:42,840 --> 00:18:46,840
可以让工具打开
472
00:18:46,840 --> 00:18:49,160
就可以听取它的对应的内容
473
00:18:49,160 --> 00:18:50,840
Imagine a piece of software that
474
00:18:50,840 --> 00:18:52,280
well it doesn't just act like a hammer
475
00:18:52,280 --> 00:18:54,280
but actually picks up the hammer
476
00:18:54,280 --> 00:18:55,400
reads the blueprints
477
00:18:55,400 --> 00:18:57,400
所以如果把通过mcp
478
00:18:57,400 --> 00:19:01,480
把远端的notebook和本地的agent进行融合
479
00:19:01,480 --> 00:19:03,640
把它放到我们的整个工作流域当中
480
00:19:03,640 --> 00:19:05,640
也会方便我们进行一些外题调研
481
00:19:05,640 --> 00:19:07,480
或者自动化的生成一些内容
482
00:19:07,480 --> 00:19:10,280
方便我们去了解整个知识体系
483
00:19:10,280 --> 00:19:11,080
不过呢
484
00:19:11,080 --> 00:19:12,520
目前mcp还是有一小问题
485
00:19:12,520 --> 00:19:13,480
就刚才提到的
486
00:19:13,480 --> 00:19:15,720
因为目前gm notebook的更新
487
00:19:15,720 --> 00:19:19,320
它更新了很多前端的操作的UI的代码
488
00:19:19,320 --> 00:19:22,200
所以目前它的mcp有某一个功能
489
00:19:22,200 --> 00:19:23,720
工作还不是特别好
490
00:19:23,720 --> 00:19:25,720
因为它不是google官方的mcp
491
00:19:25,720 --> 00:19:27,720
所以它会受到比较大的影响
492
00:19:27,720 --> 00:19:28,200
其次呢
493
00:19:28,200 --> 00:19:29,960
这个mcp启动还是比较重的
494
00:19:29,960 --> 00:19:31,560
它依赖于浏览器
495
00:19:31,560 --> 00:19:33,400
前后端的操作比较花时间
496
00:19:33,400 --> 00:19:36,840
所以如果只是提问或者上传一两条资料的话
497
00:19:36,840 --> 00:19:38,360
就觉得性价比太低了
498
00:19:38,360 --> 00:19:41,160
最好是把它融到一个相对比较重的agent
499
00:19:41,160 --> 00:19:42,200
自动化流程当中
500
00:19:42,200 --> 00:19:43,640
就会方便很多
501
00:19:43,640 --> 00:19:44,200
那好了
502
00:19:44,200 --> 00:19:49,800
以上呢就是我借由今天notebooklm更名为gm notebook之后
503
00:19:49,800 --> 00:19:52,520
介绍的应用的使用的流程
504
00:19:52,520 --> 00:19:58,920
就我个人使用起来真的能够对你学习跟调研的效率提升的非常多
505
00:19:58,920 --> 00:19:59,960
那希望我的分享呢
506
00:19:59,960 --> 00:20:17,800
也就是复杂之ood
507
00:20:17,800 --> 00:20:17,940
相优
508
00:20:17,940 --> 00:20:20,140
好的
509
00:20:20,140 --> 00:20:21,560
tes
510
00:20:21,560 --> 00:20:23,520
我们
511
00:20:23,520 --> 00:20:23,840
其实
512
00:20:00,000 --> 00:20:01,200
能够帮助大家
513
00:20:01,200 --> 00:20:03,720
如果你觉得我的分享有意思的话呢
514
00:20:03,720 --> 00:20:05,080
欢迎点赞和转发
515
00:20:05,080 --> 00:20:06,360
也欢迎关注我的频道
516
00:20:06,360 --> 00:20:07,800
我们下期节目再见
517
00:20:07,800 --> 00:20:08,460
拜拜