歸藏的AI工具箱

阿里“闪电战”再发力,这次是千问APP

阿里在海内外 AI 圈内的影响力可以说是非常顶。

基本上是唯一一个在模型种类和模型能力 两个方面同时可以跟谷歌和 Open AI 掰手腕的团队。

在模型能力上刚发布的 Qwen3-Max 模型能力非常强悍,仅次于海外三巨头的头部模型,而且开源模型 Qwen3-235B 在 Lmarena 上也是开源第一。

Image

除了测评以外 Huggingface 的下载量也是衡量一个模型受欢迎程度的一个重要指标,前十里面超过一半全是 Qwen 的模型非常离谱了。

Image

在模型的种类上我感觉更是只有他能跟谷歌掰手腕了,你能够想到的生成模型种类他都有。

除了 LLM 以外,视频生成、深度研究、翻译模型、图片生成、图片编辑(Qwen-Edit)、语音转录、音频生成、代码生成(Qwen-Coder)、音视频通话(Qwen3-Omni),基本可以覆盖你能想到的任何 AI 产品能力。

你瞅这 Huggingface 页面的数量看着都害怕。

Image

你可以发现,阿里目前已经有了构建一个可以跟 ChatGPT 掰手腕的超级 AI APP 的所有必要元素,包括丰富的模型类型、强悍的质量以及无敌的社区和海外知名度。

此外,还有阿里生态的夹持,淘宝、高德、钉钉、飞猪,想象空间很大。

三年之期已到,模型技术上搞扎实之后,阿里终于想通了,他们要跟 GPT 干,你有的我都有为啥不干。

这两天发布的千问 APP直接升级为 Qwen 模型的第一入口。

主要的对话模型用的 Qwen3-闭源,集成了上面提到的所有其他领域的通义顶级模型,基本可以完成所有你认知里面常见的 AI 任务。

Image

我这几天也体验了一下。

首先整体的设计风格相当简洁而且一致,完全不像其他阿里产品的风格,恍惚间好像看到了当时让我非常惊艳的夸克的设计。

所有的主要功能都集中在主页以及下面的胶囊区域里面,非常直观好理解,很多能力都可以用自然语言直接触发让他操作,这个挺重要的,毕竟不是所有人都像我们一样对各种模型如数家珍。

Image

作为一个面向大众的 AI 应用,用户没有我们那样在意是否是顶尖模型以及模型质量,他们更在意的是能力的广度,以及是否收费。

我试了一圈之后发现,千问这两点都做的挺好的。

免费这个不用说,背靠阿里所有的功能目前都是免费的,我没找到啥付费点。

即使是视频生成这种非常消耗资源的功能,每天也有 15 次的额度,这个量级对于大部分普通用户来说非常够用了。

在模型能力上,我找了几个日常常见的任务需求,进行测试。

作为一个 i 人我很少出去玩,但前几天出门发现 AI 识图以及讲解的需求还是挺多的,比如一些人文古迹的信息问一下 AI 的话,能增加很多谈资,然后也能让你更好地了解这个地方。

这里我找了一张前几天去拍的牌匾,因为有个字说实话不认识。

然后我问一下,他回答得非常牛逼,他不止把文字的意思说出来了,而且他还知道这是哪个地方的牌匾。

Image

这个能搞定我们来个比较复杂的。

我找了一个几乎完全没有文字信息和内容的图片,识别物可能只有银杏树和古建筑。

没想到他很快就搞定了,而且这种复杂任务会自动调用深度研究能力,即使我没有勾选深度研究。

Image

我在点开拍照的时候发现他还有拍照翻译的能力。

而且非常牛批的是不止会输出文字版本的翻译还会帮你输出翻译后的图片,排版都是对的只是外语换成了中文,这个太好用了,不止可以翻译药品之类的,搬运海外的图片或者信息的时候也很有用。

Image

作为对比我也试了一下 GPT 和 Gemini 都只能翻译文字版本,没办法在图片上翻译。

Image

搞定了图片识别之后我们再来看一个日常非常常见的场景就是文章总结。

我这里选了一个比较复杂的,找到了我今年六月份的体检报告让他分析,应该我们很多朋友都有这种需求,一堆数确实看不懂,自带的分析又过于简单。

可以看到整个分析比体检中心自带的清晰和直观多了,他会将有关联的部分整合到一起给你解释。

比如高尿酸这里会告诉你数值是多少、有啥风险以及你应该如何改善这个问题。

血脂这里直接把相关的胆固醇、甘油三酯、低密度脂蛋白放在一起给你介绍,还会告诉你要定期检测,感觉阿里在健康数据这部分下了不少功夫。

Image

除了正常的提问以外,深度研究这个我们常用的资料搜集工具也是有的。

选择输入框上方的对应胶囊按钮就可以触发,这里我选择让他调研最近热度比较高的影视飓风相亲角事件。

他们这个 UI 设计的非常好,比 Gemini 和 GPT 那种只有个进度条的清晰非常多,你可以清楚的看到他会规划大纲之后进行多次搜索和总结,而且每次搜索都是有目的的为结果服务的。

尤其是最后甚至开始搜索其他 UP 主的类似事件,来辅助提供论据。

Image

深度研究的结果展示页面也是专门设计过的,不像一些产品随便弄一个 Markdown 展示的项目就不管了,字号、换行逻辑、行高之类的都不处理,千问这个看起来非常舒服,常用按钮也都很直观。

结果上直接给了一个 8000 字的报告,可以说非常详细了,从开头的概览到事件细节梳理,再到最后的,反思以及各方影响和观点都照顾到了。

生成的结果也支持下载成 PDF 和 Word 格式,可以说吃瓜必备了。

说明确实是想过需求的,不像一些产品直接给个 Markdown 文档,普通用户知道到啥叫 Markdown 吗?

Image

除了上面这些之外,最近也有非常多的图像和视频玩法,这个会给产品带很多量,尤其是某个玩法在社交媒体火了之后。

千问也支持图像生成和图像的编辑,比如常见的图像编辑需求,让他帮你给照片调色或者 P 掉景区照上的无关人物都是可以的,甚至支持连续编辑,多次处理同一张照片。

Qwen-Image 的模型能力也是相当不错的,阿里的人透露,AI 创作这一块会很快优化迭代变得更强。

Image

视频生成也是可以的, Wan 视频模型在发布之后应该已经是现在开源领域占有量最大的视频模型了,侧面说明了模型质量。

而且新的 Wan 模型在图像推理上很强,同时支持直接生成音效和音乐。

我用我随手拍的一张照片让他生成视频,真实感非常强,分辨率也超级高还有音效,我没有写任何提示词,他自己加了运镜,这也是大部分普通用户用这种功能的状态,大概都只会说“帮我把这张图片生成视频”。

而且他这个每天免费 15 次,还有个很吊的点是,这玩意没有水印,圈子里的朋友应该知道给视频去水印有多麻烦。

最后再介绍一个我觉得非常强大的功能,甚至是我最近用过最强的类似功能「实时记录」也可以在输入框上方胶囊按钮找到。

它可以实时转录你现在的环境声音,转录的时候区分发言人。

更强的是他还支持实时的英文翻译,你可以当他是个文本的同声传译了,生成和翻译的速度相当快,而且准确性很高。

对于学生党以及频繁开会的用户相当有用。

而且在保存后他也会问你这是会议还是课堂笔记,会根据场景总结分析你的录音,比如如果你选的这个录音是课堂记录的话他就会给你总结对应的知识点,还可以生成思维导图。

Image

好了这就是藏师傅的千问体验了。

我只是挑选了一些我觉得非常好的功能,其实千问还有专门的分一能力、AI PPT 生成、AI 视频通话、智能写作等一堆好用的能力,基本上你想到的他都有。

谁说阿里没有产品经理不会做产品的,这不挺好的嘛,操作简单、逻辑清晰、功能全面再加上世界领先的模型能力,这次其他类似产品终于迎来了一个非常强力的对手。

卷起来对于用户也是好事情,我们谁不喜欢白嫖牛皮模型呢,真的很强,推荐试试,各大应用商店搜索“千问”即可安装,希望在评论区看到你发现的其他宝藏用法。

如果觉得内容对你有帮助的话欢迎帮我点赞👍或者喜欢🩷,也可以转发✈️给你需要的朋友,这个产品很适合作为普通人接触 AI 的第一款应用。