本周,Instagram 的标志性文字标识迎来了更新,但新设计却让许多人困惑不已:它看起来既不像旧版,甚至不像拼写正确的“Instagram”。在最新一期《The Vergecast》播客中,主持人 David Pierce 和 Nilay 探讨了这一变化背后的动机,并顺带聊了聊 Meta 首席执行官马克·扎克伯格发布的关于 AI 未来的长篇宣言。 ## 新标志:是创新还是多余? Instagram 的文字标识曾是品牌识别的经典,但公司似乎认为它“过时了”,于是推出了全新设计。然而,新标识不仅失去了原有风格,连拼写都变得难以辨认。这不禁让人质疑:为什么 Instagram 要这么做?在节目中,两位主持人讨论了企业高管为何总热衷于不断重塑一切,以及“新”是否总是意味着“更好”。 ## 扎克伯格的 AI 宣言 除了标志,本周 Meta 的另一大动作是扎克伯格发表了一篇数千字的 AI 愿景文章。其核心论点非常具有“扎克伯格风格”:如果将所有技术开放给所有人,一切都会变好。这一观点在一位每天都能看到 Facebook 上各种乱象的人口中说出来,显得颇为讽刺。节目中还提到了 Meta 设计博客的相关文章,以及著名的百事品牌文档。 ## AI 新闻速览 随后,节目讨论了多项 AI 相关新闻:一种新的 AI 生成文本“水印”技术、苹果的“现实认证”、Spotify 对 AI 艺术家的限制(但不禁 AI 音乐),以及吉他行业的一些混乱。最后进入快问快答环节,涉及 Brendan Carr、ChatGPT、Flock、廉价手机等话题。 如果你错过了本周的其他内容,节目还聊了 vibe-coding 项目、史上第一个聊天机器人、新款 Google Pixel 以及机器人割草机的现状。欢迎通过热线电话或邮件分享你的看法!
谷歌近日宣布,允许用户关闭Gemini及Flow等AI工具生成内容上的可见水印。这一更新意味着,由Nano Banana和Omni模型生成的图片、视频和音乐,将不再强制显示右下角的“闪光”水印。用户只需在设置中关闭“媒体水印”选项即可。 尽管可见水印变为可选,谷歌仍会在AI生成内容中嵌入隐形的SynthID水印和C2PA元数据。谷歌实验室、Gemini和AI Studio副总裁Josh Woodward表示,这些隐形标记可帮助用户通过询问Gemini或Search来验证内容是否由AI生成。 这一变化可能让快速识别AI内容变得更加困难,但许多用户此前已自行编辑掉可见水印。其他AI图像生成器,如OpenAI和Meta的,也并未应用可见水印,而是依赖SynthID和C2PA,Meta还推出了自己的Content Seal标准。Anthropic本周也宣布为AI生成的文本和图像添加隐形水印。 谷歌计划将这一水印设置推广到Search,但不会在要求可见水印的国家推出。这一举措反映了AI行业在内容透明度和用户体验之间的平衡,也引发了关于AI内容标识有效性的讨论。
据路透社报道,苹果已与阿里巴巴合作,为中国市场开发了一款定制AI大语言模型。这一罕见的跨境合作,发生在中美科技紧张关系加剧的背景下,也标志着苹果在华AI战略的重大转变。 ## 从“借力”到“自研” 此前,苹果在中国销售的设备上使用本土AI模型,因为ChatGPT等美国模型无法在中国使用。如今,苹果选择与阿里合作开发自有模型,意味着其将拥有更多产品控制权,在竞争激烈的中国智能手机市场占据更有利位置。 ## 监管与市场双重考量 中国规定AI模型在公开发布前必须向政府注册并通过审批。苹果上月已向中国网信办注册其设备端生成式AI服务,扫清了主要监管障碍。若进展顺利,苹果将成为首家获准在华提供专有AI模型的美国公司。 ## 苹果智能即将落地中国 消息人士称,苹果智能(Apple Intelligence)将在未来几个月内,随着iOS系统更新在中国上线。苹果官方未立即回应置评请求。 ## 行业影响 此次合作不仅帮助苹果应对复杂的监管环境,也为中美科技企业在AI领域的合作提供了新范例。随着全球AI竞争加剧,苹果与阿里的联手,或将为其他跨国科技公司提供参考。
微软的 Copilot 聊天机器人将不再在其语音模式中显示那个富有情感表现的黄色小精灵 Mico。根据微软的支持页面,Mico 将被移至 Learn Live 平台,在那里它会有“更多可以回应的内容”。这一变化标志着 Mico 在 Copilot 中不到一年的短暂任期结束,同时也让这个虚拟助手加入了微软已退役的助手行列,如 Clippy、Cortana 和 Rover。 ## Mico 的短暂旅程 Mico 于去年十月首次出现在 Copilot 的语音模式中,微软 AI CEO Mustafa Suleyman 曾将其定位为给聊天机器人一个“身份”的尝试。这个黄色的小精灵能够实时对用户的发言做出反应,并配有面部表情和动画。微软在支持页面中表示:“Mico 帮助我们了解了温暖、表现力以及人们如何与 AI 交谈。这些经验正在塑造 Copilot 的未来。” ## 变化背后的战略调整 微软将 Mico 从 Copilot 中移除是分阶段进行的,这一举措与微软计划合并 Copilot 和 Microsoft 365 Copilot 应用有关。此外,这也发生在一次 AI 重组之后,Jacob Andreou 接任 Copilot 负责人,而 Suleyman 则专注于开发新的 AI 模型。 ## 虚拟助手的退休传统 Mico 的离开并不令人意外,微软在虚拟助手领域有着“退休”的传统。从 Clippy 到 Cortana,再到 Rover,微软一直在尝试不同的虚拟形象,但最终都未能长期保留。Mico 的此次调整,或许意味着微软正在探索更符合用户需求和 AI 发展的新方向。 ## 对用户的影响 对于喜欢 Mico 的用户来说,这一变化可能会带来一些失落。然而,微软强调,Mico 的退出是为了让 Copilot 变得更好。随着 Copilot 的持续演进,用户将看到更多由 Mico 时代积累的经验所塑造的新功能。 总之,Mico 的退役是微软 AI 战略调整的一部分,旨在优化 Copilot 的体验并整合资源。未来,Copilot 将如何发展,我们拭目以待。
OpenAI正经历一场高层震荡。继本周早些时候特别项目负责人、前首席运营官Brad Lightcap宣布离职后,首席营收官Denise Dresser也于近日宣布将离开公司。Dresser在2025年12月加入OpenAI,此前担任Slack的CEO。她在LinkedIn上发布的一封团队信中提到,她将在“未来几周”内离职,以“寻求其他机会”。OpenAI表示,Wiz的总裁兼首席运营官Dali Rajic将接任CRO一职。 Dresser的离职并非孤立事件。近期,OpenAI已有多位高管离开,包括前AGI负责人Fidji Simo和前首席营销官Kate Rouch。这一系列变动发生在OpenAI筹备IPO的关键时期——该公司已于6月向美国证券交易委员会秘密提交了S-1文件。 OpenAI在一份声明中表示:“我们正处于一个转折点:下一代模型将不仅改变工作方式,还将改变公司的构建和运营方式。Dali将构建所需的收入运营系统,以扩展这一新阶段。”这句话既是对新CRO的期待,也暗示了公司未来的战略重点。 此次高层变动引发外界对OpenAI治理和领导层稳定性的关注。作为AI领域的领头羊,OpenAI的每一次人事变动都可能影响其商业策略和行业格局。Dresser的离职是否与公司IPO进程有关,目前尚不得而知,但这一消息无疑为OpenAI的未来增添了更多不确定性。
Suno 发布了 Studio 2.0,带来一系列重大升级,使其更接近真正的数字音频工作站(DAW),而非简单的生成式 AI 音频编辑器。最引人注目的新增功能是 MIDI 支持,这是用户最期待的功能,也是现代 DAW 的标配。然而,Suno Studio 目前不支持第三方插件或 VST,用户只能使用内置的合成器。该合成器是基础的双振荡器波表插件,带有三个包络和四个包络。其重点不在于使用你喜爱的 Arturia 复古合成器模拟,而在于将 MIDI 数据作为提示。你可以弹奏一些和弦,然后要求 Suno 将 MIDI 转换为音频、扩展旋律或根据你的演奏编写 B 段。Studio 2.0 还加入了自动化功能,可以调整各轨道的声像和音量。此外,Suno 在 Studio 界面中新增了聊天机器人,可以提示歌词或新的吉他线,并会结合当前项目的音乐上下文。你可以告诉它“让这段人声更好听”,它就会添加混响、压缩和 EQ。Suno Studio 现在内置了简单的效果器套件,包括失真、延迟、混响、压缩和 EQ。最有趣的是,聊天界面可以创建自定义效果插件,这些效果会保存到你的账户中供以后使用。Studio 2.0 功能比第一版丰富得多,但聊天测试版让用户需要动手操作的部分更少了。
想象一下,三个笨手笨脚的英国小伙子,在伦敦某家肮脏的酒吧里喝着啤酒,幻想自己成为超级巨星。他们互相打趣,争先恐后地描绘着未来,那些幻想越来越浮华——名气带来的不仅是粉丝,还有豪华派对和游艇上的狂欢。再想象这些家伙其实是电影里的角色——一部充满了快速剪辑的动作片,他们在其中与持枪的暴徒搏斗或逃亡。 这样的电影可能会让人联想到埃德加·赖特或盖·里奇的作品。但事实上,这一切都出自《Cully Hill Boys》——这是AI电影制作平台**Higgsfield**的最新项目。 ## AI电影的新尝试 《Cully Hill Boys》是今年少数几部在视觉和感觉上接近传统制作的AI电影之一。它的成功很大程度上归功于对赖特和里奇风格的深度借鉴,这不仅仅是视觉上的灵感。Higgsfield不仅在线上发布了这部电影,还公开了许多用于制作它的提示词。其中一些提示词直接提到了赖特和里奇的名字,再加上由真人编剧撰写的剧本,这凸显了这些电影中最好的部分无疑来自真实的人类艺术家。 ## 故事与制作 《Cully Hill Boys》讲述了三个来自东伦敦的说唱歌手,他们意外偷走了犯罪头目的钱,从而生活天翻地覆的故事。该项目由**Adilet Abish**和**Aitore Zholdaskali**联合执导,他们之前还执导了Higgsfield的《Hell Grind》。剧本最初由**Tim Planagan**撰写,并曾登上剧本提交服务Black List,这是一个专门推荐未制作剧本的平台。 Higgsfield在获得剧本的AI制作权后,邀请了主播**Mikyle “N3on” Rafiq**、篮球内容创作者**Matt Kiatipis**以及UFC选手**Israel Adesanya**来“主演”这部电影。 ## 人类创造力的核心 尽管AI技术在电影制作中的应用越来越广泛,但《Cully Hill Boys》的成功提醒我们,AI仍然需要人类的指导。从剧本到视觉风格,再到演员的选择,每一个环节都有人类的参与。AI只是一个工具,而真正的创意和情感仍然来自人类。 正如我们所见,AI电影的未来可能不是AI取代人类,而是人类与AI的合作。那些最动人的瞬间,往往是由人类艺术家精心设计的,而AI则负责将这些想法以惊人的效率转化为视觉呈现。 **《Cully Hill Boys》不仅是一次技术展示,更是对人类创造力的致敬。** 它让我们看到,即使是最先进的AI,也无法替代人类独有的想象力和情感表达。
上周,谷歌对其AI部门进行了一次大规模重组,引发了业界热议:谷歌是否正在输掉AI竞赛?这次重组中,首席科学家Jeff Dean离职创业,DeepMind联合创始人Demis Hassabis则转向长期研究。本文深入分析了这一变动背后的信号,以及谷歌在AI领域的真实处境。
微软终于开始将其面向消费者和商业用户的 Copilot AI 助手整合到一个统一的“超级应用”界面中,首先从 Copilot 和 Microsoft 365 Copilot 应用开始。个人和工作账户都将迁移到新的统一应用中,该应用沿用了“Microsoft Copilot”的名称,但采用了全新的应用图标。这一整合也意味着系统托盘或任务栏中将不再出现两个令人烦恼的 Copilot 图标。 微软在更新公告中表示:“新应用采用全新外观,融合了 Copilot 聊天和图像创建的最佳功能,以及 Microsoft 365 的强大工作能力。”这些更新是微软计划于今年晚些时候推出的“超级应用”的技术里程碑,为 Copilot 产品的未来变化奠定基础。 据微软称,移动端和网页版应用的全球推广将于“8月中旬”开始,Windows 和 Mac 应用的更新则定于“9月中旬”。移动应用用户将被提示下载新的 Copilot 应用,部分 Windows Insider 用户本周将开始看到更新。 具体变化取决于用户当前使用的 Copilot 应用。现有 Microsoft Copilot 用户将迁移到更新版本,并保留其聊天记录和内容;而 Microsoft 365 Copilot 应用用户将看到“细微的导航变化”、更新的 Copilot 图标,并可使用 Copilot 聊天功能。如果用户同时使用两款应用,微软表示其聊天记录和内容将合并到统一的 Copilot 应用中,但不同账户类型之间的聊天记录、内容和数据将保持分离。企业安全、合规性和政府控制方面没有变化。
Twitch近日推出了一项新设置,允许主播选择退出,禁止自己的内容被用于训练亚马逊的生成式AI模型。这一举措在AI训练数据合规性日益受到关注的背景下显得尤为重要。 ## 新设置详解 根据Twitch的支持页面,主播可以在“安全与隐私”选项卡中找到“生成式AI训练”开关。关闭该开关后,主播的**直播、VOD、剪辑、聊天记录以及频道上的图片和文字**将不会被用于亚马逊AI模型的“未来训练”,这些模型旨在生成或合成文本、音频、图像或视频。 值得注意的是,即使选择退出,Twitch和亚马逊仍可使用主播内容来支持AI辅助功能,如**实时赞助活动协助、推荐、AutoMod等**,这些功能旨在促进主播增长、观众发现和社区安全。 ## 默认开启与潜在争议 The Verge的记者Jay Peters发现,该开关在他查看时是**默认开启**的。他已向亚马逊询问这是否为默认设置,但尚未得到回复。如果默认开启,意味着主播需要主动关闭才能保护自己的内容不被用于AI训练,这可能会引发关于**用户知情同意**的讨论。 ## 跨频道聊天数据的处理 Twitch还明确,如果主播在**他人的直播间**参与聊天,那么该聊天内容是否被用于训练,取决于该频道主播的退出偏好。这意味着,即使主播自己选择了退出,其聊天内容仍可能因参与其他频道的直播而被使用,这增加了数据控制的复杂性。 ## 行业背景与影响 这一举措反映了在生成式AI快速发展的背景下,平台和创作者之间关于**数据权利**的博弈。此前,已有多个平台因未经许可使用用户数据训练AI而遭到批评。Twitch的退出选项为创作者提供了一定的控制权,但**默认开启**的做法也提示我们,用户需要主动关注并管理自己的数据隐私。 对于主播而言,如果担心自己的内容被用于AI训练,现在可以前往设置中关闭该开关。不过,他们也需要权衡,因为关闭后仍会使用AI支持的社区功能,这些功能可能有助于其频道成长。 随着AI技术的普及,如何平衡创新与隐私保护,将是所有平台面临的长期挑战。
在数周的争议和猜测之后,乐器公司D'Addario终于承认其近期宣传视频中使用了AI音乐,具体是Suno。此前近两周,该公司一直否认相关指控,尽管证据不断出现。它曾给出多种解释,从低质量导出,到AutoTune等插件组合引入数字噪声,再到使用LANDR和Logic的AI辅助母带处理工具。但现在,该公司已编辑其原始Instagram帖子,承认错误。在7月29日帖子的长篇更新中,它表示:“我们搞错了。我们已完成全面审查,确认Suno Studio被用来重新生成原始音轨。我们分享了不准确的信息,非常抱歉……我们不支持AI生成的音乐,未来我们的流程将反映这一点。我们将要求员工和创意合作伙伴披露任何生成式AI的使用,并将更仔细地审查我们发布的一切。”该帖子还为严厉的评论审核道歉,这些审核删除了批评者的帖子并屏蔽了用户。该公司没有发布新声明,而是简单地在五天前编辑了原始帖子,距离最初发布已有10天。原始视频是用于展示新型琴弦的演示,这些琴弦专为扩展音域吉他和低音调音设计。人们立即指出录音可疑。当D'Addario发布了一段声称是演示曲目Logic录音会话的剪辑时,情况变得更糟,但完成曲目与Logic会话之间存在明显的旋律和节奏差异。吉他手兼YouTuber Rhett Shull设法直接从D'Addario获取了原始Logic文件,这进一步加剧了争议。最终,公司承认使用了Suno,并承诺未来将要求披露任何生成式AI的使用。这一事件凸显了在音乐行业中使用AI的敏感性和透明度的重要性。
Google 最新发布的 Pixel Watch 5 在硬件上似乎变化不大,但真正的升级在于软件层面的 AI 与健康功能。这款售价 **399 美元** 的智能手表,新增了离线 Gemini 支持、主动式 AI 建议、改进的 GPS 地图和胰岛素抵抗趋势追踪,同时价格比上一代上涨了 **50 美元**。 ## 硬件小幅升级,价格却涨了 Pixel Watch 5 的硬件更新相对保守:新增了缎面黄铁矿表壳配色、几款新表带颜色,以及一款斯蒂芬·库里特别版。内部搭载了稍快的骁龙处理器,电池容量有小幅提升。不过,价格从去年的 349 美元涨至 399 美元,涨幅约 14%,这或许与全球内存成本上涨(所谓的“RAMageddon”)有关。 ## AI 是核心:离线 Gemini 与主动建议 今年最大的亮点是 AI 功能的深化。**Gemini 现在支持离线使用**,可以执行启动计时器、打开应用等简单任务,不过在演示中,离线模式下的响应速度明显较慢。此外,Gemini 变得更加主动,例如当收到询问空闲时间的短信时,手表会主动提供查看日历的选项。表盘上也新增了实时信息图标,可显示计时器、Uber 预计到达时间、锻炼状态等。 去年 12 月通过软件更新加入的捏合手势和手腕轻拂功能,在 WearOS 7 中得到了更全面的 UI 集成。 ## 健康追踪:从心率到胰岛素抵抗 健康功能是本次更新的重点。Pixel Watch 5 新增了 **胰岛素抵抗趋势** 追踪,这对关注代谢健康的用户来说是个新工具。此外,GPS 地图功能得到改进,提供更准确的路线和位置信息。这些功能延续了 Google 在今年早些时候推出的 Fitbit Air 所强调的主动健康管理理念。 ## 小结 Pixel Watch 5 的迭代表明,Google 正将重心从硬件转向软件和服务,通过 AI 和健康数据的深度整合来提升用户体验。虽然价格上涨可能让部分消费者犹豫,但如果你重视 AI 辅助和健康追踪,这款手表或许值得考虑。不过,离线 Gemini 的性能和胰岛素抵抗功能的准确性尚需实际测试验证。
还记得那条关于澳大利亚科技企业家利用 ChatGPT、Grok 等 AI 工具为爱犬定制个性化癌症疫苗的新闻吗?如今,这位企业家宣布成立初创公司 Gamgee,致力于为狗提供个性化 mRNA 癌症疫苗,并计划将技术扩展至人类。 Paul Conyngham 在 X 上宣布 Gamgee 成立,声称使用 ChatGPT 和计算基因组学为他的斯塔福德郡斗牛梗混血犬 Rosie 设计了 mRNA 疫苗,并观察到肿瘤缩小。Gamgee 的网站上强调 Conyngham 并非生物学家,但公司使命是将这一成功规模化。网站还展示了多只狗狗的照片和诊断信息,以强调其服务对象。 然而,科学界对此持谨慎态度。此前《The Verge》的报道指出,AI 在其中的具体作用并不明确,且 Rosie 的治疗同时使用了其他疗法,无法确定疫苗的独立效果。尽管如此,Gamgee 已获得 Y Combinator 等知名孵化器的支持。 这一事件凸显了 AI 在医疗领域的潜力与争议,也引发了关于技术宣传与科学严谨性的讨论。
SpaceXAI 推出了 Grok Bot,这是一种常驻的 AI 代理服务,旨在像独立的“AI 队友”一样工作,帮助用户处理工作任务。这些机器人共享一个基于云的计算机环境,能够登录用户已有的应用、工具和网站,完成多步骤的工作任务,仅在任务完成或需要批准时才返回。 Grok Bot 是 Elon Musk 的 AI 公司为了与竞争对手(如 OpenAI 的 ChatGPT Work、Anthropic 的 Claude Cowork 和微软的 Copilot Tasks)竞争而推出的最新服务。SpaceXAI 表示,Grok Bot 是基于公司内部原型开发的,该原型已被用于处理销售外联、营销、办公室运营和错误修复等工作。 用户可以通过手机或桌面端像与同事一样与这些机器人交流,无需预先构建工作流程。多个机器人可以并行运行,其中一个机器人可以负责管理其他机器人。这些机器人还能“独立地相互沟通”以共享上下文,甚至可以在群聊环境中协调工作。 Grok 的机器人可以学习和保存用户的工作流程,保留关于用户如何执行任务的上下文,以保持用户的个人风格。它们还能跟进中断的对话和交接线程,从旧聊天中恢复工作,并逐渐变得更加主动。 从今天开始,Grok Bot 进入 beta 测试阶段,适用于桌面端和 iOS 系统,面向 SuperGrok Heavy、Cursor Ultra 和 Cursor Teams Premium 订阅用户。团队和企业用户可加入等待列表,以获取未来版本。
近期,游戏开发公司Saber Interactive陷入了一场关于AI取代人类编剧的争议。前首席编剧Stella Sacco在Bluesky上发文称,她在开发《Rideshare模拟器》期间被公司用ChatGPT取代,且游戏中的乘客语音也由AI生成。然而,Saber CEO Matthew Karch则坚决否认,声称“Saber和Unigine都没有用AI取代任何编剧”,游戏故事“完全由真人撰写”,仅有一个实验性免费模式因无限乘客数量而“必然”使用AI。 Sacco对此反驳称,如果游戏中既有她撰写的部分,又有AI生成的内容,那么AI确实被使用了,而她确实被取代了。她还透露,公司早在2023年12月就已告知她这一决定。 这场争议不仅关乎个人职业命运,更折射出AI在游戏产业中日益增长的渗透力。Saber自2001年成立以来一直倡导使用AI工具提升游戏体验,但此次事件引发的核心问题是:AI究竟是辅助工具还是替代者?当AI能够生成文本和语音时,编剧的角色边界在哪里? 目前,《Rideshare模拟器》的Steam页面尚未披露任何关于生成式AI使用的信息,这也引发了关于透明度的讨论。随着AI技术不断进步,游戏行业如何在创新与伦理之间找到平衡,将成为未来必须面对的课题。
AI聊天领域的竞争正在进入一个全新的阶段。就在最近,谷歌CEO桑达尔·皮查伊在X上宣布,其AI助手Gemini的月活跃用户数已达到**10亿**,并且是谷歌历史上增长最快的产品。而在此之前,OpenAI的ChatGPT也刚刚跨过了这一里程碑,尽管官方公告显得有些低调。 ## 双双破亿,但增长节奏不同 谷歌的皮查伊在X上发文称,Gemini每月有**10亿人使用**,这标志着谷歌旗下第14个达到10亿用户的产品。谷歌发言人亚历克斯·约瑟夫表示,Gemini在上周就已达到这一数字,并在8月11日正式对外公布。值得注意的是,这一数据仅指Gemini应用本身,不包括谷歌将其嵌入其他产品的用户,但**预装在Android手机上的Gemini**似乎被计算在内。Gemini负责人乔什·伍德沃德还透露,Gemini在iOS上的活跃用户已超过1亿。 相比之下,OpenAI的ChatGPT在8月6日的一篇博客中“轻描淡写”地提到“超过10亿人正在使用ChatGPT”,并未大张旗鼓。OpenAI发言人林赛·麦卡勒姆证实,ChatGPT的月活跃用户数在更早前就已突破10亿,并在7月达到每周10亿用户。不过,这一里程碑的达成速度似乎有所放缓——OpenAI曾在今年2月公布ChatGPT的周活跃用户为9亿,五个月后达到10亿,对于曾被誉为“增长最快软件”的ChatGPT来说,这一增速的下降颇为明显。 ## 用户数据背后的复杂图景 直接比较月活与周活并不容易,但最直观的解读是:**ChatGPT的体量更大,而Gemini的增长势头更猛**。谷歌在2月宣布Gemini月活为7.5亿,7月底财报电话会上报告为9.5亿,如今达到10亿,增长轨迹清晰可见。而ChatGPT虽然仍是聊天机器人领域的领导者,但外部数据早在6月就预测其月活可能已破10亿,官方直到8月才确认。 此外,Anthropic的Claude虽然增长迅速,但该公司不公开用户数据,外界估计其用户数仍在数千万级别,尚难与两大巨头抗衡。 ## 竞争格局:双雄争霸,还是变局前夜? 从目前的态势看,AI聊天应用已进入**双寡头时代**。谷歌凭借Android系统的预装优势,为Gemini带来了巨大的流量入口,而OpenAI则依靠ChatGPT的品牌效应和技术积累,维持着用户粘性。然而,增速的差异可能预示着未来的变局:Gemini的快速崛起意味着谷歌在AI消费端的布局正在奏效,而ChatGPT的增长放缓则可能让OpenAI面临压力。 对于普通用户而言,10亿用户意味着AI聊天已成为主流应用,而不仅仅是极客的玩具。未来,谁能更好地平衡创新与商业化,谁能在多模态、个性化等方向上持续突破,或许将决定下一个10亿用户的归属。
**OpenAI 再失一位核心高管。** 公司特别项目负责人、前首席运营官 Brad Lightcap 在任职八年后宣布离职。他在内部备忘录中表示将开启“新的事业”,并称未来几周仍会协助交接。 Lightcap 的职责在过去一年半中经历了多次调整。2025年3月,他的 COO 职责扩展至监督公司日常运营与全球部署。2026年1月,他退出企业产品与工程领导,但仍负责商业职能。4月,他正式卸任 COO,转而负责“特别项目”,直接向 CEO Sam Altman 汇报,其大部分原职责由首席营收官 Denise Dresser 接任。 Lightcap 并非近期唯一离开的高管。7月,AGI 负责人 Fidji Simo 因健康原因离职;4月,CMO Kate Rouch 也因健康问题卸任。此外,公司总裁 Greg Brockman 接管产品业务,并承诺削减“支线任务”。 这一系列变动正值 OpenAI 经历重大重组,业界关注其领导层稳定性。Lightcap 在备忘录中未透露新去向,但表示将从“不同视角”支持公司使命。
谷歌将于 8 月 12 日举办年度硬件发布会 Made by Google,预计将推出多款 Pixel 新设备。根据发布会前的泄露信息,Pixel 11 系列将提供多种颜色选择,Pro 型号可能配备内置补光灯;此外,新一代 Pixel Fold、Pixel Watch 5(四种配色)以及 Pixel Tag 追踪器也有望亮相。值得注意的是,谷歌官网的预购倒计时将于美国东部时间 8 月 12 日上午 10 点结束,比发布会直播(下午 6 点)提前 8 小时,这意味着新设备可能会在发布会前就正式公布。今年的发布会由喜剧演员 Trevor Noah 主持,嘉宾阵容包括 NBA 球星 Stephen Curry、播客主 Alex Cooper、印度板球运动员 Shubman Gill 和日本女演员中条あやみ。 去年的 Made by Google 活动因采用类似深夜脱口秀的形式而引发争议,但 YouTube 观看量达到 840 万,远超前一年的 140 万。今年谷歌继续走明星路线,但泄露信息已让发布会悬念大减。本文汇总了所有关于 Pixel 设备的新闻和动态,并持续更新。
苹果正在开发一项iOS功能,让用户可以验证照片是否由iPhone相机拍摄,以对抗深度伪造。据9to5Mac报道,iOS 27测试版5中的代码引用了“Apple Reference Image”系统,该系统能在拍摄时嵌入来源元数据,从而证明照片的真实性。 该功能默认关闭,但可在“设置 > 相机 > 参考图像 > 参考模式”中启用。启用后,仅使用“参考”模式拍摄的照片才会包含验证所需的信息。验证过程并非自动,用户需点击照片上的“参考”徽章,系统会将原始图像及嵌入的元数据(包括传感器签名、拍摄时间、唯一硬件标识符)发送至苹果的私有云计算服务器进行验证,并返回带唯一ID的认证版本。苹果在此过程中不会访问原始照片,但可能会获取传感器数据,以防止被篡改传感器的图像通过认证,或追溯撤销相关认证。 该功能与C2PA内容凭证标准类似,旨在追溯图像的来源和生成方式。目前苹果尚未正式发布该功能,但这一动向表明科技公司正积极应对深度伪造带来的挑战。
**Zoom 近日修复了一个严重的安全漏洞,该漏洞可能允许攻击者在会议期间劫持任何人的设备。** 安全研究公司 A Security 在周二发布的一篇博客文章中透露,他们利用“公开可用的 AI 模型上的不到 20 条提示”发现了这一漏洞,据 Wired 早前报道。 该漏洞涉及 Zoom 的注释功能,该功能允许用户在共享屏幕时进行绘制。攻击者可以利用该漏洞加入或主持一个会议,并在受害者的设备上运行恶意代码,从而窃取数据、打开摄像头或麦克风,甚至安装恶意软件。攻击过程无需受害者进行任何操作,且“没有显示任何视觉线索表明设备已被入侵”。 A Security 的漏洞研究员 Idan Levcovich 在博客中写道:“针对这一漏洞的利用通常属于国家级的攻击行为:精英团队、数月努力、政府管控的预算。但 A Security 在一天之内,借助 AI 代理和任何人都能访问的模型,就实现了这一点。” Zoom 已于周二针对该漏洞发布了修复补丁,该漏洞影响了 Windows、macOS、Linux、Android 和 iOS 平台的 Zoom 应用。 ## 事件背景 这次发现凸显了 AI 在网络安全领域的双刃剑效应。一方面,AI 可以快速识别和利用漏洞,帮助安全研究人员更高效地发现潜在风险;另一方面,攻击者也可能利用相同的技术进行恶意攻击。A Security 的研究表明,即使是复杂的漏洞利用,如今也可能通过现成的 AI 工具在短时间内实现,这大大降低了攻击的门槛。 ## 影响与建议 对于普通用户而言,及时更新 Zoom 应用至最新版本是防范此类风险的最有效手段。此外,在会议中谨慎使用注释功能,尤其是来自不可信来源的会议邀请,也能降低被攻击的风险。 这一事件也为整个行业敲响了警钟:随着 AI 技术的普及,安全防御措施必须与时俱进,否则将面临更大的挑战。