歸
公众号

歸藏的AI工具箱

产品设计师AI画图工具操作员AI课程撰写与信息收集整理致力于发掘借助AI工具改善

790 篇已收录文章

这个来源的文章

按发布时间排序

腾讯开源生图模型3.0,世界知识媲美Banana!

腾讯开源生图模型 3.0,试了一下世界知识可以媲美 Banana,甚至可以图解中学几何题!美学和文字排版也达到了一流水平,太顶了。 模型参数高达 80B,这次的升级主要特点是: 1. 可以生成较长的文字,包括中文; 2. 了解世界知识并且可以进行一定程度的推理; 3. 美学表现相较于之前提升较大。 我也做了一下详细的…

阅读全文 :腾讯开源生图模型3.0,世界知识媲美Banana!

Kimi上新OK Computer Agent能力,打赏用户优先体验

Kimi 终于带来了他们的Agent 模式「OK Computer」,而且给了所有之前打赏过的用户提前体验的资格。 从官方推文来看,这个Agent的定位是全栈助理,直接瞄准生产力场景: 支持使用文件系统、浏览器、终端、代码编写、图片音频生成等 20 多种工具。 支持完成调研、产品方案、交互设计和前端开发的完整过程,也…

阅读全文 :Kimi上新OK Computer Agent能力,打赏用户优先体验

阿里发布顶尖模型 Qwen3-Max,接近 Claude 4 和 GPT-5

阿里这也太猛了一口气在云栖大会发了超多模型。 其中最重要的是 Qwen3-Max,目前通义规模最大能力最强的模型,包含 instruct 和 thinking 两个模型。 测试集的数据有点可,根据他们的测试能力水平已经接近 Claude 4 Opus 和 GPT-5。 在 LMArena 上人工评价结果仅次于 Gem…

阅读全文 :阿里发布顶尖模型 Qwen3-Max,接近 Claude 4 和 GPT-5

你是不是曾经像我一样思考过,现在的 AI 视频到底距离那些顶尖的 CG 渲染艺术还差多远。 \n刚好可灵 2.5 发布和第一世界世界渲染大赛结束,我就让他们做了个对比测试。 \n这里直接说一下结论,如果你想要看具体对比视频可以看我这篇内容: 可灵2.5Turbo实测|顶尖AI视频模型,真能打平CG吗?\n\n过去我们说 AI 视频抽卡和玄学,本质上是模型对因果逻辑以及世界上的物理表现的理解不够。 \n\n但是从这次的对比来看现在的顶级 AI 视频模型在 5 秒这个时间段,对于因果逻辑和物理表现的理解已经想到到位了,甚至有些瞬间可以做的比顶级的 CG 表现更好。 \n\n而且 AI 视频的创作方式更接近我们人类原始的绘画创作逻辑,与 CG 和 3D 制作那种层层叠加的精确控制有本质不同,它跳过了精确,直接抵达了“传神”,类似原始人看到狼并且画出来一样。\n \n目前来看我们可能更需要增加的是 AI 视频模型关于叙事逻辑或者叙事重点的强化,可能我们过于注重真实的物理表现,忽略了创作中的不真实。 \n目前的 AI 视频汽车飞过悬崖和漂移他分配的重心是一致的,但是如果是导演的话,在飞跃悬崖的时候就会通过慢放增加紧张感。\n\n另外我们现在可以获得 5 秒的超高速动态视频而且不崩,以前的 AI 视频模型 5 秒智能做一件事情,现在可以做很多,这时候我们现有的在时间轴上的控制手段就显得相当贫瘠了,我们需要更细的时间粒度和画面控制。

阅读全文 :你是不是曾经像我一样思考过,现在的 AI 视频到底距离那些顶尖的 CG 渲染艺术还差多远。 \n刚好可灵 2.5 发布和第一世界世界渲染大赛结束,我就让他们做了个对比测试。 \n这里直接说一下结论,如果你想要看具体对比视频可以看我这篇内容: 可灵2.5Turbo实测|顶尖AI视频模型,真能打平CG吗?\n\n过去我们说 AI 视频抽卡和玄学,本质上是模型对因果逻辑以及世界上的物理表现的理解不够。 \n\n但是从这次的对比来看现在的顶级 AI 视频模型在 5 秒这个时间段,对于因果逻辑和物理表现的理解已经想到到位了,甚至有些瞬间可以做的比顶级的 CG 表现更好。 \n\n而且 AI 视频的创作方式更接近我们人类原始的绘画创作逻辑,与 CG 和 3D 制作那种层层叠加的精确控制有本质不同,它跳过了精确,直接抵达了“传神”,类似原始人看到狼并且画出来一样。\n \n目前来看我们可能更需要增加的是 AI 视频模型关于叙事逻辑或者叙事重点的强化,可能我们过于注重真实的物理表现,忽略了创作中的不真实。 \n目前的 AI 视频汽车飞过悬崖和漂移他分配的重心是一致的,但是如果是导演的话,在飞跃悬崖的时候就会通过慢放增加紧张感。\n\n另外我们现在可以获得 5 秒的超高速动态视频而且不崩,以前的 AI 视频模型 5 秒智能做一件事情,现在可以做很多,这时候我们现有的在时间轴上的控制手段就显得相当贫瘠了,我们需要更细的时间粒度和画面控制。

居然收到了 Kimi 送给打赏用户的会员!

Kimi居然上了Agent会员服务! 昨晚打开Kimi的时候,界面突然弹出了一封给打赏用户的感谢信。点开后,是给打赏用户的会员福利。 你以前打赏的金额会在首次订阅Agent会员后全额返还,作为会员的时间。我试着冲了一个月,直接送了我九个月的会员,这也太好了! 之前打赏过的朋友可以去看一下,顺便看看自己的打赏序号。 说…

阅读全文 :居然收到了 Kimi 送给打赏用户的会员!

谷歌这招狠啊,推出了一个用 Agent 之间支付的开放协议 AP2。\n支持信用卡、借记卡甚至稳定币和实时转账等渠道。\n\n基于 A2A 和 MCP 之上进行拓展,解决了三个核心问题:授权(证明用户授予代理的具体购买权限)、真实性(让商家确信代理的请求反映用户真实意图)与问责(交易出错或欺诈时的责任界定)。\n\n户的意图与规则被记录为加密签名、不可篡改的数字合同,构成可审计证据链;\n\n在“实时购买(人在场)”中,交互先生成 Intent Mandate,确认购物车时签署 Cart Mandate,锁定商品与价格;在“委派任务(无人值守)”中,用户预先签署包含价格上限、时间等约束的详细 Intent Mandate,条件满足后 Agent 可自动生成 Cart Mandate。\n\n整个“意图→购物车→支付”的闭环将支付方式与已验证的购物车内容安全绑定,形成不可抵赖的审计轨迹,从而在机制上落实授权、真实性与问责。\n协议也面向新型支付体系:与 Coinbase、以太坊基金会、MetaMask 等合作推出 A2A x402 扩展,为 Agent驱动的加密支付提供可投产方案。\n\n生态层面,AP2 已获 60+ 机构参与与背书,涵盖国际卡组织、收单与支付服务商、加密与钱包、风控与身份、SaaS 与电商平台、咨询与系统集成商等,比如 PayPal、Coinbase 登公司。\n\n详情:cloud.google.com/blog/products/ai-machine-learning/announcing-agents-to-payments-ap2-protocol

阅读全文 :谷歌这招狠啊,推出了一个用 Agent 之间支付的开放协议 AP2。\n支持信用卡、借记卡甚至稳定币和实时转账等渠道。\n\n基于 A2A 和 MCP 之上进行拓展,解决了三个核心问题:授权(证明用户授予代理的具体购买权限)、真实性(让商家确信代理的请求反映用户真实意图)与问责(交易出错或欺诈时的责任界定)。\n\n户的意图与规则被记录为加密签名、不可篡改的数字合同,构成可审计证据链;\n\n在“实时购买(人在场)”中,交互先生成 Intent Mandate,确认购物车时签署 Cart Mandate,锁定商品与价格;在“委派任务(无人值守)”中,用户预先签署包含价格上限、时间等约束的详细 Intent Mandate,条件满足后 Agent 可自动生成 Cart Mandate。\n\n整个“意图→购物车→支付”的闭环将支付方式与已验证的购物车内容安全绑定,形成不可抵赖的审计轨迹,从而在机制上落实授权、真实性与问责。\n协议也面向新型支付体系:与 Coinbase、以太坊基金会、MetaMask 等合作推出 A2A x402 扩展,为 Agent驱动的加密支付提供可投产方案。\n\n生态层面,AP2 已获 60+ 机构参与与背书,涵盖国际卡组织、收单与支付服务商、加密与钱包、风控与身份、SaaS 与电商平台、咨询与系统集成商等,比如 PayPal、Coinbase 登公司。\n\n详情:cloud.google.com/blog/products/ai-machine-learning/announcing-agents-to-payments-ap2-protocol

套出了 (即梦)Seedream 4 的系统提示

居然能通过提示词套出 (即梦)Seedream 4.0 系统提示! 早上看到 Fofr(X)在尝试用提示词让Seedream 4 生成包含自己系统提示文字的图片。我自己也试了一下确实可以,而且跟他的差不多。 我结合我自己套出来的和Fofr原来的让 AI 还原了完整的系统提示。 整个系统提示词包含角色、输入、输出、任务…

阅读全文 :套出了 (即梦)Seedream 4 的系统提示

拯救废片!将任何照片变成酸性设计海报!

太好玩了!突发奇想能不能让 Seedream 4.0 帮我们把日常拍摄的废片用排版处理拯救一下。 于是我真分析了一些常见的海报设计方法,把这些方法整理成提示词,果然可以将任何照片转换成Y2K 酸性设计的海报。 再也不怕拍了一堆废片没不能发了,提示词在最后一张图

阅读全文 :拯救废片!将任何照片变成酸性设计海报!

试了Minimax的Music 1.5音乐模型|相当不错啊

MiniMax 居然发了一个音乐模型 Music 1.5,试了一下真不错,解决了没有好用的音乐生成 API 的问题 最长生成时间超过了四分钟; 相较于之前的版本在人声、器乐、演奏和歌曲结构上都有优化; 感觉跟 Suno 已经差不多了,而且价格比 Suno 便宜的多,C 端单价一首歌只需要一毛钱; 支持简洁模式,也支持…

阅读全文 :试了Minimax的Music 1.5音乐模型|相当不错啊

又搞出一个Seedream 4神级国风提示词

刚才看到一句古诗,然后就想 Seedream 4.0 这么好的提示词理解和世界知识,这次终于能把古诗词的意境表现出来了吧。 于是就试了一下,一顿探索过后发现,真的可以了! 你只需要更改后面的诗词内容不需要描述画面信息,Seedream 4.0 就会帮你生成符合诗词意境的图片,而且图片上还有诗词原文。 提示词:根据这句…

阅读全文 :又搞出一个Seedream 4神级国风提示词