据 The Information 报道,特斯拉于昨日起对员工的 AI 开支实施限额管理。一份内部备忘录显示,从 7 月 6 日开始,特斯拉员工每人每周的 AI 支出上限被设定在 200 美元。报道指出,此次限额措施出台前,特斯拉内部经历了一段 AI 使用量激增的时期。在过去几个月中,部分软件工程师每周消耗的 Token 价值高达数千美元。根据新规定,员工若需超过每周 200 美元的限额,必须获得上级批准。不过,据知情人士透露,该统计不包括 xAI 产品的测试版本。
阿里巴巴昨日确认,正对其旗下三款企业级 AI 智能体产品进行战略整合。此次调整以桌面 AI 智能体工具 QoderWork 为基础,深度融合钉钉孵化的企业协同办公 AI 平台「悟空」以及阿里云内部创业的 AI 执行引擎 MuleRun 的核心能力。整合后的全新 AI 产品将面向企业生产力场景,由今年 6 月中旬刚刚接任悟空事业部 CEO 兼钉钉 CEO 的「90后」陈宇森全面负责。36 氪报道称,阿里此举旨在结束内部赛马,集中资源应对来自字节跳动「扣子」及飞书 Agent、腾讯 WorkBuddy 等同行的竞争压力。未来,陈宇森或将对三款产品采取能力分层融合的架构:由 QoderWork 提供桌面交互与本地执行的前台能力,MuleRun 负责 Agent 自进化与流程复用的中台引擎,而悟空则作为后台底座,提供钉钉的企业数据、协同关系及组织架构支持。目前,阿里官方已对此回应称,QoderWork、悟空、MuleRun 的现有产品服务未来将实现无缝升级,所有用户权益不会受到影响。
据《商业内幕》报道,软件工程领域的传奇人物 Kent Beck 昨日在「The Pragmatic Engineer」节目中表示,随着 AI 技术的普及,软件工程师必须学习沟通与共情等「软技能」以在行业中生存。Kent Beck 指出,软件工程师往往缺乏良好的情绪调节能力和共情心,表达方式有时过于直接。他认为在 AI 能够自动生成大量代码的当下,这种传统的「孤狼式」工作模式即将终结。目前,软件行业已开始流行「Vibe-Coding」实践,这使得资深开发者能更快速地构建原型,也让非编程人员能够将创意转化为试点项目。这种趋势正在模糊工程与产品工作之间的界限。为了应对这一变化,Anthropic 等公司已要求工程师在小型项目中担任「微型产品经理(Mini PM)」,不仅负责代码,还要承担利益相关者协调和跨职能协作的职责。Kent Beck 将这种职业技能的转型形容为一种「宇宙级的恶作剧」。你刚开始学编程时,别人告诉你只要掌握关于计算机的一切就万事大吉了。但随后你会发现,你改变世界的能力其实受限于你的沟通和共情能力。这种「产品工程师」角色的兴起表明,未来最有价值的工程师将是那些能够将技术实力与产品判断力、人际交往能力相结合的人才。
Google Gemini Omni Flash 登顶视频盲测榜,超越 Seedance-2.0
昨天,Video Arena 排名数据显示,Google DeepMind 旗下的 Gemini Omni Flash 文生视频模型目前以 1527 Elo 的成绩位列文生视频竞技场榜首。在最新的排名中,Google 的 Gemini Omni Flash 展现出显著的领先优势,其 Elo 分数超出排名第二的字节跳动 dreamina-seedance-2.0-720p(1466 Elo)达 61 分。阿里巴巴旗下的 happyhorse-1.0 则以 1437 Elo 的成绩位居第三。整体榜单呈现出 Google、字节跳动与阿里巴巴三强争霸的格局。在前十名中,Google 占据了五个席位,其 Veo 3.1 系列的不同规格模型(包括 1080p 版、音频增强版及快速版)表现稳健,Elo 分数集中在 1362 至 1369 之间。字节跳动旗下的 Seedance 系列模型此前长期保持领先,目前 2.0 版本依然稳居第二梯队。
三星 Galaxy Glasses 渲染图曝光:对标 Meta,采用常规眼镜造型
据 SamMobile 报道,三星预计将于今年年底前发布首款智能眼镜产品 Galaxy Glasses。渲染图及视频显示,该产品在设计上采用了类似普通黑框眼镜的传统造型,与 Meta 的 Ray-Ban 智能眼镜高度相似。交互方面,眼镜右侧镜腿顶部设有电源键,音量键位于镜腿后部。此外,右镜腿还支持触控操作,用户可以通过单指或双指滑动来导航界面。软件层面,Galaxy Glasses 将搭载基于 Android XR 的 One UI XR 系统,并深度集成 Google 的 Gemini AI 智能体。功能上,该产品支持拍摄照片、录制视频、实时翻译、音乐播放及语音导航。硬件配置方面,眼镜内置了 12MP 摄像头、麦克风和扬声器,但并未配备内置显示屏。曝光的相关软件界面截图还显示,Galaxy Glasses 能够与 Galaxy Ring 或 Galaxy Watch 联动控制。为了保持佩戴的轻便性,大部分数据处理工作将由连接的手机完成。此外,该眼镜还配备了光致变色镜片,可根据光线环境自动调节深度。
生数科技发布 Vidu S1 实时交互模型
生数科技昨日在 2026 全球数字经济大会上正式发布新一代实时交互模型 Vidu S1。据介绍,该模型主打实时可交互的视频生成能力,推动 AI 视频从离线生成迈向持续互动阶段。官方信息显示,Vidu S1 支持实时视频通话和语音控制视频走向。用户可以通过语音指令实时控制数字人的行为、表情及全身动作,实现无限时长的连续互动。技术参数方面,Vidu S1 支持 540P(960x540)高清分辨率,默认帧率为 25FPS,最高可达 42FPS。该模型能够基于真人、动漫或萌宠等单张初始图片快速创建专属交互角色,无需进行复杂的离线建模与训练。生数科技表示,Vidu S1 的实时交互特性使其具备进入 AI 情感陪伴、虚拟偶像、互动直播、游戏 NPC 及 XR 等场景的技术基础。目前,Vidu S1 已开启内测,用户可通过 Vidu 官网、API 平台或「Vidu AI Pro」移动端应用进行体验。
腾讯元宝搜索功能升级,复杂问题可直接看图解
腾讯混元昨日宣布旗下 AI 智能体元宝的搜索功能完成重大升级,引入「图解」能力,可通过图文搭配的形式,将原本复杂的搜索结果直观化,提升信息获取效率。例如,在区分「五条悟、五条人、告五人」等名称相近但领域完全不同的对象时,元宝能够自动匹配动漫角色、独立乐队与流行乐团的形象图,帮助用户快速识别。针对口红色号的区别,元宝可以将烂番茄红、枫叶红、砖红、豆沙红等色值直接展示,减少用户对文字描述的想象偏差。在旅游推荐方面,如搜索上海暑期亲子博物馆,元宝会根据自然科普、科技互动、历史文化等分类,配以场馆实景图、标本模型图及预约提示,提供结构化的图文攻略。此外,元宝还强化了视觉素材的搜索与整合能力。用户可以直接搜索表情包合集,元宝将汇总展示相关系列素材。目前,用户可以在元宝对话框中打开「快速思考」模式体验上述功能。