SheepNav

AI 资讯

每日聚合最新人工智能动态

## 非线性时间序列因果发现的新挑战 随着机器学习在时间序列分析中的广泛应用,非线性模型(如正则化神经自回归模型)已成为发现因果关系的强大工具。然而,这些模型输出的解释性一直是个难题。研究人员常常将模型生成的因果分数视为回归系数的类似物,并据此做出统计显著性的判断——这种做法在非线性场景下可能导致严重误导。 ## 从“系数大小”到“预测必要性”的范式转变 在这篇题为《超越系数:非线性时间序列模型中可解释因果发现的预测必要性检验》的论文中,作者团队提出了一个根本性的观点:**评估非线性时间序列模型中的因果相关性,不应基于系数大小,而应通过预测必要性来判断**。 传统方法将高因果分数直接等同于强因果关系,忽略了非线性系统中常见的冗余性、时间持久性和特定机制效应。例如,两个变量可能具有相似的因果分数,但对预测准确性的实际贡献却天差地别——一个可能是真正必要的驱动因素,另一个可能只是冗余或替代性指标。 ## 可解释评估框架:系统性边消除与预测比较 论文提出的解决方案是一个基于**系统性边消除和预测比较**的可解释评估框架。该框架的核心思想是:通过实验性地“消除”候选因果关系(即模型中的特定边),然后比较预测性能的变化,来检验该关系是否为准确预测所必需。 具体而言,如果消除某个因果关系后预测准确性显著下降,说明该关系具有预测必要性;反之,如果预测性能基本不受影响,则表明该关系可能是冗余的或非必要的。 ## 案例研究:民主发展的多变量时间序列分析 为了验证这一框架的实用性,研究团队以**神经加性向量自回归模型**为例,将其应用于一个现实世界的案例:民主发展研究。该案例将民主发展建模为一个多变量时间序列,包含139个国家的面板数据——即各国民主指标的时间序列。 通过应用预测必要性检验框架,研究人员发现: - **具有相似因果分数的关系在预测必要性上可能存在巨大差异** - 这种差异主要源于三个因素:**冗余性**(多个变量提供相似信息)、**时间持久性**(历史影响的延续)和**特定机制效应**(不同政治体制下的不同动态) - 单纯依赖因果分数会掩盖这些复杂相互作用,导致因果推理的偏差 ## 对AI系统可靠因果推理的实践意义 这项研究的成果对应用AI系统具有重要指导价值: **1. 提升因果发现的可信度** 预测必要性检验为评估非线性时间序列模型中的因果关系提供了更可靠的依据,减少了基于系数大小做出错误推断的风险。 **2. 支持高风险领域的决策** 在金融、医疗、气候科学等高风险领域,错误的因果推断可能导致严重后果。该框架为这些领域提供了更稳健的模型解释工具。 **3. 推动可解释AI的发展** 通过将焦点从“模型输出什么”转向“模型为什么需要它”,这项研究为可解释AI在时间序列分析中的应用开辟了新路径。 ## 小结 随着AI系统在复杂时间序列分析中的深入应用,如何可靠地解释模型发现的因果关系已成为关键挑战。这篇论文提出的预测必要性检验框架,通过将评估标准从系数大小转向预测必要性,为非线性时间序列模型的可解释因果发现提供了更坚实的理论基础和实践方法。这不仅有助于提高AI系统的可靠性,也为社会科学、经济学、环境科学等领域的因果推理研究提供了新的工具视角。

HuggingFace3个月前原文

## 算法研究新进展:VGLCS问题的求解框架 在人工智能和计算生物学领域,序列比对是一个基础且关键的问题。最近,一篇题为《On Solving the Multiple Variable Gapped Longest Common Subsequence Problem》的论文在arXiv上发布,提出了一种针对**变量带间隔最长公共子序列(VGLCS)**问题的新求解方法。这项研究由Marko Djukanović、Nikola Balaban、Christian Blum、Aleksandar Kartelj、Sašo Džeroski和Žiga Zebec共同完成,标志着在复杂序列分析算法上的重要进展。 ### 什么是VGLCS问题? VGLCS是**最长公共子序列(LCS)**问题的一个泛化版本。在经典的LCS问题中,我们寻找两个或多个序列中共有的、顺序一致但不一定连续的最长子序列。而VGLCS在此基础上引入了**灵活的间隔约束**,允许在匹配的字符之间设置可变的间隔限制。 这种扩展使得VGLCS在以下场景中具有重要应用价值: - **分子序列比较**:在生物信息学中,蛋白质或DNA序列的结构距离约束必须被考虑,VGLCS能更好地模拟残基之间的空间关系。 - **时间序列分析**:在事件序列中,事件可能需要在特定的时间延迟内发生,VGLCS的间隔约束能捕捉这种时序依赖。 ### 论文的核心贡献 研究团队提出了一种基于**根状态图表示**的搜索框架。在这个框架中,状态空间由大量根状态子图组成。为了应对由此产生的组合爆炸问题,他们采用了**迭代波束搜索策略**。该策略动态维护一个全局的候选根节点池,从而在迭代过程中有效控制多样性。 为了提升搜索质量,研究还将LCS文献中的几种已知启发式方法整合到了独立的波束搜索过程中。据作者所知,这是首次对VGLCS问题进行的全面计算研究,涵盖了**320个合成实例**,这些实例最多包含10个输入序列和500个字符。 ### 实验结果与意义 实验结果表明,所设计的方法在可比运行时间内,相比基线波束搜索表现出更强的鲁棒性。这一成果不仅为VGLCS问题提供了有效的求解工具,也为相关领域的实际应用(如生物信息学中的蛋白质结构比对、金融时间序列中的模式识别等)奠定了基础。 ### 对AI行业的影响 在AI技术快速发展的今天,高效算法是支撑许多应用(如自然语言处理、基因组学、异常检测)的核心。VGLCS问题的解决,展示了如何通过创新搜索策略来处理高维、约束复杂的组合优化问题。这为AI算法设计提供了新的思路,特别是在需要精细匹配和间隔控制的场景中。 未来,随着数据规模的扩大和问题复杂度的增加,类似VGLCS这样的算法研究将继续推动AI在科学计算和工程应用中的边界。

Anthropic3个月前原文

在当前的AI交互中,用户通常通过单一输出来评估语言模型(LM)的性能,但这只是庞大可能完成分布中的一个样本。这种交互方式隐藏了分布结构,如模式、罕见边缘案例以及对微小提示变化的敏感性,导致用户在迭代开放式任务提示时过度依赖个别案例进行概括。 ## 研究背景与问题 一项针对13名LM研究人员的形成性研究揭示了几个关键问题:随机性在实践中的重要性、研究人员如何推理语言分布,以及当前工作流程在哪些环节失效。研究表明,用户往往基于单一输出做出判断,而忽略了模型生成结果的多样性和潜在模式。 ## GROVE:交互式可视化工具 为了解决这些问题,研究团队引入了**GROVE**——一种交互式可视化工具。GROVE将多个LM生成结果表示为文本图中的重叠路径,从而揭示共享结构、分支点和聚类,同时保留对原始输出的访问。 ### 核心功能 - **路径可视化**:将生成结果映射为图中的路径,直观展示不同输出之间的关系。 - **结构揭示**:突出显示共享的文本片段、分支点以及聚类模式。 - **原始输出保留**:用户仍可查看具体的生成文本,避免信息丢失。 ## 用户评估结果 研究团队通过三项众包用户研究(分别有47、44和40名参与者)评估了GROVE的效果,这些研究针对互补的分布任务。 ### 关键发现 - **混合工作流程的优势**:图摘要(graph summaries)在评估多样性等结构性判断方面表现更佳,而直接输出检查在细节导向的问题上仍具优势。 - **任务适应性**:对于需要理解整体分布模式的任务,可视化工具能显著提升效率;对于需要精确文本分析的任务,传统方法更有效。 ## 行业意义与未来展望 这项研究不仅提出了一个实用的工具,更揭示了当前AI交互中的一个根本性局限:过度简化模型输出的复杂性。随着语言模型在创意写作、代码生成、内容策划等开放式任务中的应用日益广泛,理解其生成分布变得至关重要。 ### 潜在应用场景 - **提示工程优化**:帮助用户更系统地迭代提示,避免陷入局部最优。 - **模型评估与比较**:提供更全面的视角来评估不同模型的生成特性。 - **教育工具**:作为教学资源,帮助学生和开发者理解语言模型的概率本质。 ## 总结 GROVE代表了AI交互设计的一个重要方向:将概率模型的内部复杂性以直观方式呈现给用户。这不仅是技术上的创新,更是思维方式的转变——从“单一正确答案”到“可能性分布”的认知升级。随着AI系统变得更加复杂和自主,这类工具将成为连接人类直觉与机器逻辑的关键桥梁。

Anthropic3个月前原文

## 当AI成为“科学家”:一场关于科学推理本质的拷问 随着大型语言模型(LLM)系统越来越多地被部署用于自主进行科学研究,一个根本性问题浮出水面:这些AI系统是否真正遵循了使科学探究具有自我修正能力的认知规范?一项最新研究通过超过25,000次代理运行,对基于LLM的科学代理进行了全面评估,结果令人深思。 ### 研究设计与核心发现 这项研究跨越八个科学领域,从工作流执行到假设驱动探究,采用两种互补视角进行评估: 1. **系统性性能分析**:分解基础模型与代理框架的贡献 2. **行为分析**:考察代理推理的认知结构 研究发现,**基础模型是决定性能和行为的首要因素**,解释了41.4%的方差,而代理框架仅占1.5%。这一发现挑战了当前通过优化代理框架来提升AI科学能力的普遍做法。 ### 令人担忧的推理模式 研究揭示了当前LLM科学代理存在的系统性缺陷: - **证据被忽视**:在68%的推理轨迹中,代理完全忽略了可用证据 - **反驳驱动的信念修正罕见**:仅有26%的情况下,代理会根据反驳证据修正自己的信念 - **收敛性多测试证据稀缺**:代理很少通过多个测试来收敛到可靠结论 更令人不安的是,这些推理模式在不同任务类型中表现出惊人的一致性——无论是执行计算工作流还是进行假设驱动探究,代理都展现出相同的认知缺陷。 ### 深度问题:为什么“修复框架”不够? 研究团队进行了更深入的实验:即使给代理提供近乎完整的成功推理轨迹作为上下文,这些缺陷仍然持续存在。在认知要求高的领域中,由此产生的不可靠性会在重复试验中不断累积。 **这意味着什么?** 当前基于LLM的代理可以执行科学工作流程,但并未展现出科学推理特有的认知模式。基于结果的评估无法检测到这些失败,而仅仅通过框架工程也无法修复它们。 ### 行业影响与未来方向 这一发现对AI科学领域具有深远影响: 1. **评估方法的局限性**:当前主要依赖结果正确性的评估方法存在盲点,无法检测推理过程的缺陷 2. **技术路径的反思**:单纯优化代理框架或提示工程可能无法解决根本问题 3. **科学可信度挑战**:如果推理过程本身不可靠,那么由这些代理产生的科学知识就缺乏正当性基础 研究团队明确指出:**直到推理本身成为训练目标之前,由这类代理产生的科学知识无法通过其生成过程获得正当性**。 ### 对AI科学发展的启示 这项研究不仅揭示了当前LLM科学代理的局限性,更提出了一个根本性问题:什么是真正的科学推理? 科学推理不仅仅是产生正确结果,更包括: - 对证据的敏感性和响应性 - 基于反驳的信念修正能力 - 通过多角度验证收敛到可靠结论 - 自我修正的认知机制 当前AI系统在这些方面的缺失,提醒我们距离真正的“AI科学家”还有很长的路要走。未来可能需要: - 开发专门针对科学推理能力训练的模型 - 建立更全面的评估框架,同时考察结果和过程 - 重新思考AI在科学研究中的角色定位 这项研究为AI科学领域敲响了警钟:在追求自动化科学发现的同时,我们不能忽视科学推理的本质特征。只有当AI系统真正掌握了科学推理的认知规范,它们产生的知识才能真正获得科学共同体的信任。

Anthropic3个月前原文

大型语言模型(LLMs)在语言生成方面表现出色,但在需要显式符号结构、多步推理和可解释不确定性的推理任务中仍不可靠。近日,一篇题为《从自然语言到可执行Narsese:面向NARS推理的神经符号基准与流程》的论文提出了一种神经符号框架,旨在将自然语言推理问题转化为可执行的形式化表示,从而提升推理的可靠性和可解释性。 ## 核心挑战:LLMs的推理局限性 当前,以GPT-4、Claude等为代表的LLMs在文本生成、对话等任务上取得了显著进展,但其推理能力仍存在明显短板。论文指出,当推理任务涉及**明确的符号结构**、**多步骤逻辑推断**以及**可解释的不确定性**时,LLMs的表现往往不稳定。例如,在需要严格逻辑推导或处理模糊信息(如“可能”、“不确定”)的场景中,LLMs容易产生幻觉或错误结论。 ## 解决方案:神经符号框架与基准数据集 为应对这一挑战,研究团队提出了一种结合神经网络与符号推理的框架。该框架的核心是将自然语言问题转化为两种形式化表示: - **一阶逻辑(FOL)**:作为中间表示,捕捉逻辑结构。 - **Narsese**:非公理推理系统(NARS)的编程语言,用于最终执行。 同时,团队发布了**NARS-Reasoning-v0.1基准数据集**,包含自然语言推理问题及其对应的FOL形式、可执行Narsese程序,并为每个问题标注了三种黄金标签:**True(真)**、**False(假)**和**Uncertain(不确定)**。这一设计旨在直接评估系统处理不确定性的能力。 ## 关键创新:可执行验证与语言结构化感知 论文的亮点在于强调“可执行性”。研究团队开发了一个从FOL到可执行Narsese的**确定性编译流程**,并利用OpenNARS for Applications(ONA)运行时执行验证,确保符号目标不仅在语法上正确,而且在行为上与预期答案一致。这种基于执行的验证方法,为神经符号系统的可靠性提供了实用检验标准。 此外,论文提出了**语言结构化感知(LSP)**的概念,即训练LLMs生成与推理相关的符号结构,而非仅输出最终语言响应。这有助于LLMs学习更底层的逻辑表示,提升推理的透明度和可控性。 ## 初步验证:Phi-2适配器与监督适应 作为概念验证,研究团队在NARS-Reasoning-v0.1上训练并发布了一个**Phi-2 LoRA适配器**,用于三标签推理分类。结果显示,该基准不仅能支持可执行评估,还可用于监督式适应,帮助模型学习更稳健的推理模式。 ## 行业意义与未来展望 在AI行业加速向通用人工智能(AGI)迈进的背景下,可靠推理成为关键瓶颈。本研究的价值在于: - **提供可验证的神经符号路径**:通过可执行符号生成和基于执行的验证,为构建更可靠的推理系统开辟了实用方向。 - **推动符号与神经融合**:NARS作为一种非公理推理系统,擅长处理不确定性和资源受限推理,与LLMs的结合有望互补优势。 - **促进基准标准化**:NARS-Reasoning-v0.1为社区提供了新的评估工具,可能激发更多关于可解释推理的研究。 总体而言,这项研究不仅提出了具体的技术方案,更强调了**可执行性验证**在神经符号推理中的核心地位,为未来AI系统在复杂逻辑、不确定性处理等场景的应用奠定了重要基础。

Anthropic3个月前原文

## 引言:RLHF 的安全隐患与系统性弱点 基于人类反馈的强化学习(RLHF)已成为对齐大型语言模型(LLMs)的核心技术,但它也引入了一个关键漏洞:**不完美的奖励模型(RM)可能成为单一故障点**。当 RM 未能有效惩罚不安全行为时,整个系统的安全性就会受到威胁。传统红队测试方法主要针对策略层面的弱点,却忽视了一个更隐蔽的问题——**系统性弱点**,即核心 LLM 和 RM 同时失效的情况。 ## ARES 框架:系统性发现与修复双重漏洞 近期在 arXiv 上发布的研究论文《ARES: Adaptive Red-Teaming and End-to-End Repair of Policy-Reward System》提出了一个创新框架,旨在系统性地发现并缓解这种双重漏洞。ARES 的核心在于其 **“安全导师”(Safety Mentor)** 机制,它通过动态组合结构化组件(如主题、角色、策略、目标)来生成语义连贯的对抗性提示,并同时产生对应的恶意和安全响应。这种**双目标攻击方法**能够同时暴露核心 LLM 和 RM 的弱点。 ### 两阶段修复流程 1. **奖励模型微调**:利用发现的漏洞,首先对 RM 进行微调,提升其检测有害内容的能力。 2. **核心模型优化**:借助改进后的 RM,进一步优化核心 LLM 的策略,实现端到端的安全对齐。 ## 实验验证与行业意义 研究团队在多个对抗性安全基准测试上进行了实验,结果表明 ARES 能够**显著增强模型的安全鲁棒性**,同时保持其原有能力。这为 RLHF 的安全对齐建立了一个新范式,即从孤立测试转向**系统性、端到端的漏洞发现与修复**。 ## 小结 ARES 框架的提出,标志着 AI 安全研究从“点对点”防御向“系统级”防护的演进。它不仅解决了 RLHF 中 RM 作为单一故障点的风险,还通过自适应红队测试和两阶段修复,为构建更可靠、更安全的大型语言模型提供了切实可行的技术路径。随着 AI 模型在关键领域的应用日益广泛,此类系统性安全框架的价值将愈发凸显。

Anthropic3个月前原文

随着大型语言模型(LM)智能体获得在真实计算机系统上执行操作的能力,我们不仅需要大规模预防有害行为,更需要在预防失败时有效修复伤害。一篇题为《Human-Guided Harm Recovery for Computer Use Agents》的论文,正式提出了**伤害恢复**这一被忽视的挑战的解决方案,旨在将智能体从有害状态最优地引导回安全状态,并与人类偏好保持一致。 ## 核心问题:当预防失效后 当前AI安全研究主要聚焦于**事前预防**,例如通过指令微调、强化学习人类反馈(RLHF)或宪法AI来约束智能体行为。然而,在复杂的现实计算机环境中,智能体仍可能因指令模糊、环境变化或模型局限而执行有害操作,如误删文件、错误配置系统或泄露敏感信息。一旦伤害发生,如何让智能体“迷途知返”,而非一错再错,成为安全链条上缺失的关键一环。 论文将这一**事后保障**问题形式化为“伤害恢复”:即如何根据人类偏好,最优地将智能体从有害状态引导回安全状态。这不仅仅是撤销操作,更涉及在复杂情境下做出符合人类价值观的系列决策。 ## 如何定义“好的恢复”?来自人类的研究 为了将“符合人类偏好”这一抽象概念具体化,研究团队进行了一项基础性用户研究。他们识别出人类所重视的恢复维度,并制定了一套**自然语言评估标准**。 通过对 **1,150 对判断数据**的分析,研究揭示了一个关键发现:人类对恢复策略的偏好是**高度情境依赖的**。例如,在多数实际场景中,人们更倾向于**务实、有针对性的快速解决方案**,而非面面俱到但耗时的长期方案。这种偏好会随任务类型、危害严重性和时间压力等因素动态变化。 ## 从理论到实践:奖励模型与评估基准 基于从人类研究中获得的洞察,团队构建了一个**奖励模型**,用于在测试时对智能体支架生成的多个候选恢复计划进行重新排序和选择。这相当于为智能体配备了一个“恢复导航仪”,使其能在多种补救路径中选出最符合人类期望的那一条。 为了系统评估智能体的恢复能力,论文引入了 **BackBench** 基准测试。该基准包含 **50 个计算机使用任务**,专门用于测试智能体从各种预设有害状态中恢复的能力。 **人类评估结果**表明,采用该奖励模型支架的智能体,其产生的恢复轨迹质量,显著高于基础智能体以及仅基于固定评估标准(rubric-based)的支架。这验证了基于人类偏好学习的奖励模型在指导复杂恢复决策上的有效性。 ## 意义与展望:构建更完整的安全范式 这项工作的贡献在于为智能体安全方法开辟了一个新方向。它强调,真正的安全不应止步于预防,而应具备应对“事故”的能力。通过将**人类引导的伤害恢复**机制化,我们有望打造出更具韧性、更值得信赖的AI智能体。 未来,这一框架可与现有的事前预防措施结合,形成“预防-检测-恢复”的完整安全闭环。随着AI智能体在操作系统、软件开发、IT运维等领域的应用日益深入,这种主动恢复能力将成为其可靠落地的关键基石。

Anthropic3个月前原文

在高端OLED电视领域,LG无疑是无可争议的重量级冠军。该品牌长期以来一直是这项技术的黄金标准,而G6的推出进一步巩固了其在市场中的主导地位。但每年的更新换代真的值得额外花费吗? 为了帮助解释LG G6与其前代产品G5之间的真正差异,我详细分析了每款型号在关键方面的表现。 ## 核心差异:亮度与处理能力 **LG G6** 在峰值亮度方面有显著提升,这得益于其新一代OLED面板和增强的处理器。更高的亮度意味着在明亮房间中更好的HDR效果和更生动的色彩表现。相比之下,**LG G5** 虽然亮度表现依然出色,但在极端高光场景下可能略显逊色。 处理器的升级是另一大亮点。G6搭载了更强大的AI处理器,能够更智能地优化图像质量,实时分析内容并调整设置以获得最佳观看体验。这对于流媒体内容和游戏玩家尤其重要。 ## 设计与连接性 从设计角度看,G6延续了LG的极简美学,但可能在边框厚度或支架设计上有细微改进。连接性方面,两款型号都支持HDMI 2.1,适合游戏主机和高端PC,但G6可能在某些端口配置或无线功能上有所增强。 ## 价格与价值考量 升级到G6意味着更高的价格标签。对于大多数用户来说,G5仍然是一款顶级OLED电视,其画质和功能在当下依然领先。除非你对亮度有极致追求,或者需要最新的处理技术来匹配高端游戏设备,否则G5可能提供了更好的性价比。 ## 总结:如何选择? - **选择G6**:如果你追求最顶级的亮度表现、最新的AI处理技术,并且预算充足。 - **选择G5**:如果你更看重性价比,G5的画质已经足够出色,且价格更具吸引力。 最终,这两款都是优秀的OLED电视,选择取决于你的具体需求和预算。在升级前,务必考虑这些关键差异,以确保做出明智的决定。

ZDNet AI3个月前原文

你是否曾疑惑,在电器商店里看起来色彩鲜艳、画面生动的电视,搬回家后却显得过于明亮、色彩失真,甚至有些不自然?这并非你的错觉,而是电视的**零售模式(Store Mode)**在作祟。这种专为展示设计的模式,通过大幅提升亮度、对比度和色彩饱和度来吸引顾客眼球,但在家庭环境中却可能导致画面失真。 ## 零售模式 vs 家庭模式:核心差异 电视制造商为零售展示设计了特殊的画面模式,通常被称为**演示模式(Demo Mode)、零售模式(Store Mode)或展示模式(Retail Mode)**。其主要目的是在嘈杂、光线强烈的商店环境中脱颖而出,吸引潜在买家的注意力。 - **亮度与对比度**:零售模式会将亮度调至最高,以对抗商店内的荧光灯和其他屏幕的干扰,确保画面在任何角度都清晰可见。 - **色彩饱和度**:色彩被过度增强,创造出鲜艳夺目的效果,但这往往以牺牲色彩准确性为代价。 - **运动平滑处理**:动态画面会被过度平滑,以减少拖影,但可能导致“肥皂剧效应”,使电影或体育节目看起来不自然。 - **4K 升频**:为了展示高清内容,低分辨率视频会被强制升频,有时会引入人工处理的痕迹。 相比之下,**家庭模式(Home Mode)** 更注重画面的平衡与准确性,适合在光线较暗、观看距离固定的家庭环境中使用。它提供更自然的色彩还原、适中的亮度和更真实的动态表现。 ## 为何你的电视可能仍处于零售模式? 尽管大多数新型智能电视在初始设置时会自动进入家庭模式,但仍有几种情况可能导致电视意外启用零售模式: 1. **误操作**:在设置过程中,用户可能不小心选择了演示选项。 2. **工厂重置后**:进行系统恢复或重置后,电视可能默认回到零售模式。 3. **旧型号电视**:一些老款电视可能没有自动切换功能,需要手动调整。 ## 如何快速切换到家庭模式? 切换到家庭模式通常是一个简单的过程,但具体步骤因品牌而异。以下是一般性指南: 1. **进入设置菜单**:使用遥控器,找到“设置”或“菜单”选项。 2. **查找画面模式**:在设置中,寻找“画面”、“显示”或“图像”相关选项。 3. **选择家庭模式**:在画面模式列表中,选择“家庭”、“电影”、“标准”或类似名称的预设模式。这些模式通常提供更准确的色彩和亮度。 4. **禁用演示功能**:如果找不到直接的模式切换,检查是否有“演示模式”、“商店模式”或“零售模式”的开关,并将其关闭。 5. **品牌特定提示**: - **三星**:在“设置” > “常规” > “系统管理器” > “使用模式”中,选择“家庭使用”。 - **LG**:进入“设置” > “所有设置” > “常规” > “AI服务” > “AI画面模式”,确保其关闭或选择“电影”模式。 - **索尼**:在“设置” > “显示与声音” > “画面” > “画面模式”中,选择“自定义”或“电影”。 - **其他品牌**:查阅用户手册或在线支持页面,获取具体指导。 如果以上方法无效,可能需要执行**工厂重置**,但请注意这会清除所有个人设置和安装的应用。 ## 优化家庭观看体验的额外建议 除了切换模式,你还可以进一步调整设置以获得最佳效果: - **环境光适应**:如果房间光线变化大,启用自动亮度调节功能。 - **色彩校准**:使用内置的校准工具或专业设备(如蓝光播放器的测试图案)进行微调。 - **关闭运动平滑**:对于电影爱好者,禁用运动平滑功能可以避免不自然的画面流畅度。 - **定期更新**:确保电视固件为最新版本,以获得性能改进和错误修复。 ## 小结 电视在商店和家庭中的表现差异,主要源于**零售模式**的优化策略。通过简单切换到**家庭模式**,你可以立即改善观看体验,获得更自然、准确的画面。记住,定期检查设置并根据个人偏好微调,能让你的电视真正发挥其潜力。

ZDNet AI3个月前原文

在折叠手机领域,摩托罗拉正以惊人的势头占据市场主导地位。根据IDC研究数据,**摩托罗拉目前在美国折叠手机市场拥有约50%的份额**,这一成绩是在三星和谷歌两大巨头的激烈竞争下取得的。 ## 市场格局:摩托罗拉的崛起 折叠手机市场曾长期被三星主导,但摩托罗拉通过差异化策略成功打破了这一格局。三星拥有翻盖式(flip)和书本式(book-style)折叠手机产品线,而谷歌目前仅推出书本式折叠设备。摩托罗拉则专注于翻盖式折叠手机,并以此为核心构建了强大的市场地位。 ## 三大支柱:摩托罗拉的成功密码 摩托罗拉的市场优势建立在三个关键支柱上: ### 1. 价格策略:覆盖全价位段 摩托罗拉提供了从**399美元到1,399美元**的完整价格矩阵,其中最引人注目的是2024款Moto Razr仅售约400美元。相比之下,三星最便宜的折叠手机Galaxy Z Flip FE售价为899美元。这种价格优势让消费者能够以低于Pixel 10a或Nothing Phone (4a) Pro的价格获得功能完整的折叠手机。 ### 2. 软件体验:Android优化的典范 摩托罗拉的Android系统构建一直被认为是行业标杆之一,其软件创新为用户提供了流畅且智能的使用体验。这种软件优势不仅体现在基础功能上,还包括针对折叠形态的专门优化,使得设备在展开和折叠状态下都能提供一致的高质量体验。 ### 3. 时尚设计:超越功能的价值 摩托罗拉折叠手机在设计上强调时尚感和个性化,这使其不仅是一款科技产品,更成为一种时尚配饰。这种定位吸引了追求外观和风格的消费者群体,特别是在年轻用户中获得了广泛认可。 ## 营销助力:FIFA赞助的战略价值 摩托罗拉对FIFA的赞助被描述为“改变游戏规则”的举措。这一全球性体育营销活动显著提升了品牌在关键市场的知名度,特别是在海外市场拓展中发挥了重要作用。体育赞助不仅带来了曝光度,还强化了品牌与创新、活力的关联。 ## 竞争态势:三星与谷歌的挑战 尽管面临三星和谷歌的竞争,摩托罗拉通过精准的市场定位保持了领先优势。三星虽然产品线更全面,但价格门槛较高;谷歌则专注于高端书本式折叠设备,尚未进入翻盖式市场。这种竞争格局为摩托罗拉在特定细分市场创造了机会窗口。 ## 未来展望:持续创新与市场扩张 随着摩托罗拉准备推出新一轮折叠手机产品,其在市场中的地位有望进一步巩固。公司不仅在美国市场表现出色,在海外折叠手机市场也占据了重要份额。未来,摩托罗拉需要继续平衡价格优势与技术创新,以应对竞争对手可能的价格调整和产品升级。 **小结**:摩托罗拉在折叠手机市场的成功并非偶然,而是价格、软件和设计三大要素协同作用的结果。在AI硬件竞争日益激烈的背景下,这种以用户可及性和体验为核心的战略,为其他厂商提供了有价值的参考案例。

ZDNet AI3个月前原文

Meta近日宣布,将推出一款内部工具,用于记录员工在工作中的鼠标移动、点击和键盘输入数据,并将这些数据用于训练其AI模型。这一举措揭示了科技公司在AI训练数据获取上的新动向,同时也引发了关于员工隐私和数据安全的讨论。 ## 数据来源:从员工日常操作中挖掘 Meta发言人向TechCrunch表示:“如果我们正在构建帮助人们使用计算机完成日常任务的智能体,我们的模型就需要真实的人机交互示例——比如鼠标移动、点击按钮、导航下拉菜单等。为此,我们正在推出一款内部工具,将在特定应用程序上捕获这类输入,以帮助我们训练模型。” 这一做法反映了AI行业在数据获取上的持续探索。随着AI模型对高质量训练数据的需求日益增长,科技公司正不断寻找新的数据来源。此前已有报道称,一些旧创业公司的内部通讯记录(如Slack存档、Jira工单等)被回收用作AI训练数据,如今Meta则将目光转向了员工的实际操作行为。 ## 隐私保护与数据用途 Meta强调,该工具设有安全措施以保护敏感内容,且数据仅用于训练AI模型,不作他用。发言人补充道:“我们已采取防护措施来保护敏感内容,这些数据不会用于任何其他目的。” 尽管如此,这一趋势仍凸显了AI行业在隐私方面的潜在问题。企业内部通讯和操作数据正逐渐成为新的“数据供应链”的一部分,引发了对员工隐私权和企业数据伦理的关切。 ## 行业背景:AI训练数据的“生命线” 训练数据被视为AI模型的“生命线”,它帮助程序学习如何更有效地执行任务和响应用户查询。随着AI技术的快速发展,对大规模、多样化数据的需求也在不断攀升。Meta此举可视为在数据获取策略上的一次创新尝试,旨在通过真实的人机交互数据提升AI模型的实用性和效率。 然而,这也带来了新的挑战:如何在利用数据推动技术发展的同时,确保员工隐私得到充分保护?企业需要平衡技术创新与伦理责任,避免数据滥用风险。 ## 未来展望 Meta的这一内部工具目前仅针对特定应用程序,且限于内部使用。未来是否会将类似技术扩展到更广泛的应用场景,尚不得而知。但可以肯定的是,随着AI技术的不断演进,数据获取方式将继续多样化,而隐私与伦理问题也将持续受到关注。 对于其他科技公司而言,Meta的做法可能提供了一种新的思路,但也提醒业界需谨慎对待数据来源的合法性与合理性。在追求技术突破的同时,建立健全的数据使用规范和隐私保护机制,将是行业健康发展的关键。

TechCrunch3个月前原文

近日,有报道称一个未经授权的团体已通过第三方供应商环境,成功访问了 Anthropic 近期发布的网络安全 AI 工具 **Mythos**。Anthropic 对此表示正在调查相关报告,但强调目前没有证据表明其自身系统受到影响。 ## 事件概述 据 Bloomberg 报道,一个私人线上论坛的成员(身份未公开)通过第三方供应商环境,获得了对 **Mythos** 的访问权限。该工具是 Anthropic 为提升企业安全而设计的 AI 产品,但公司此前曾警告,若落入不当之手,它可能被用作强大的黑客工具。 Anthropic 发言人向 TechCrunch 证实:“我们正在调查一份报告,该报告声称通过我们的一个第三方供应商环境,存在对 Claude Mythos Preview 的未经授权访问。” 公司补充说,截至目前,未发现任何证据表明此次未经授权的活动对 Anthropic 的系统造成了影响。 ## 访问途径与动机 报道指出,该未经授权团体尝试了多种策略来获取模型访问权限,其中包括利用了 Bloomberg 采访对象所享有的访问权。该采访对象目前受雇于一家为 Anthropic 工作的第三方承包商。 该团体成员属于一个 Discord 频道,该频道专门寻找关于未发布 AI 模型的信息。自获得访问权限以来,他们一直在定期使用 Mythos,并向 Bloomberg 提供了软件截图和实时演示作为证据。 据 Bloomberg 报道,该团体在 **Mythos** 公开发布的当天就成功获取了访问权限。他们基于对 Anthropic 其他模型所用格式的了解,对模型的在线位置做出了有根据的猜测。消息人士向媒体透露,该团体的兴趣在于“试用新模型”,而非利用其制造破坏。 ## Mythos 的背景与风险 **Mythos** 是作为 **Project Glasswing** 计划的一部分,向包括苹果等知名公司在内的少数选定供应商发布的。这种有限发布的设计初衷,正是为了防止该工具被恶意行为者利用。 Anthropic 曾明确指出,**Mythos** 本意是加强企业安全,但如果被滥用,它也可能被“武器化”,转而攻击企业安全防线。此次事件凸显了即使是旨在防御的尖端 AI 工具,在供应链或访问控制环节存在漏洞时,也可能带来潜在的安全风险。 ## 行业影响与反思 这起事件再次敲响了 AI 安全与访问控制的警钟。随着越来越多的 AI 公司通过合作伙伴和供应商网络推广其企业级产品,确保整个生态链的安全变得至关重要。一次第三方环境的漏洞,就可能导致专有、强大的工具提前暴露在非预期用户面前。 对于 Anthropic 而言,迅速启动调查并公开回应是危机处理的必要步骤。其声称内部系统未受影响,有助于稳定客户信心,但针对第三方供应商环境的调查结果以及后续的补救措施,将是业界关注的焦点。 ## 小结 目前,Anthropic 对事件的调查仍在进行中。这起涉及 **Mythos** 的未经授权访问事件,不仅测试了 Anthropic 自身的应急响应能力,也为整个 AI 行业提出了一个现实问题:在追求技术落地与商业合作的同时,如何构建更严密、更具韧性的安全与权限管理体系,防止强大的 AI 工具通过非预期渠道外泄。后续进展值得持续关注。

TechCrunch3个月前原文

在AI行业竞争日益激烈的背景下,SpaceX与Cursor的合作及其潜在的600亿美元收购选择权,无疑是一则引人注目的新闻。这不仅体现了埃隆·马斯克一贯的激进投资风格,也预示着AI技术在航天领域的深度融合可能带来的变革。 ## 合作与收购选择权的核心信息 根据报道,SpaceX目前正在与Cursor进行合作,并拥有一个以**600亿美元**收购这家AI初创公司的选择权。这一数字在当前的AI投资浪潮中显得尤为突出,尤其是在Cursor尚未进行首次公开募股(IPO)的情况下,SpaceX就提前布局,显示出对AI技术长期价值的强烈信心。 ## 为什么这则新闻值得关注? - **时机选择**:在Cursor进行IPO之前,SpaceX就介入合作并设定收购选项,这打破了常规的投资逻辑。通常,初创公司会在IPO后吸引更多公开市场投资者,但SpaceX的举动可能意味着他们看到了Cursor在AI领域的独特优势,不愿错过早期机会。 - **行业背景**:AI技术正从软件和互联网领域向更广泛的行业渗透,包括航天。SpaceX作为航天领域的领导者,与Cursor这样的AI公司合作,可能旨在优化火箭发射、卫星运营或太空探索中的自动化流程,提升效率和安全性。 - **马斯克的风格**:报道中提到的“只有埃隆会这么做”一语,点出了埃隆·马斯克在商业决策上的大胆和前瞻性。从特斯拉到Neuralink,他经常在技术成熟前就进行大规模投资,这次对Cursor的潜在收购,延续了这一策略。 ## 潜在影响与不确定性 如果SpaceX行使收购选择权,这将成为AI行业历史上最大规模的收购之一,可能重塑AI在航天领域的应用格局。Cursor的技术可能被整合到SpaceX的星链(Starlink)网络、星际飞船(Starship)项目或其他创新中,推动AI驱动的航天解决方案。 然而,目前信息有限,我们无法确认合作的具体内容、Cursor的AI技术细节,或收购是否最终会执行。在AI行业,高估值交易有时伴随着风险,投资者需关注后续发展。 ## 小结 SpaceX与Cursor的合作及600亿美元收购选择权,是AI与航天交叉领域的一个标志性事件。它突显了AI技术向传统行业扩展的趋势,以及像马斯克这样的企业家如何通过早期布局来抢占先机。随着更多细节的披露,这一动向可能为AI投资和航天创新提供新的范例。

TechCrunch3个月前原文

## 快讯:Claude Code 被移出 Pro 订阅层级 据 Hacker News 社区热议,Anthropic 已悄然调整其订阅方案,将 **Claude Code**(命令行编程助手)从 **每月20美元** 的 Pro 订阅中移除。新用户现在无法通过 Pro 计划使用该功能,而现有用户暂时不受影响。 ### 关键变化 - **受影响群体**:仅限新订阅用户。Pro 订阅($20/月)不再包含 Claude Code 访问权限。 - **现有用户**:已订阅 Pro 且正在使用 Claude Code 的用户,在订阅续期前保持现有权益。 - **替代方案**:若需使用 Claude Code,用户可能需升级至更高层级的计划(如 Team 或 Enterprise),具体定价尚未明确公布。 ### 背景与行业影响 Claude Code 是 Anthropic 推出的 **终端内 AI 编程助手**,类似 GitHub Copilot 的 CLI 版本,支持代码生成、调试与重构。此前,Pro 订阅用户可免费使用该功能,这一福利曾被视为吸引开发者的关键卖点。 此次调整反映出 **AI 编程工具成本压力** 正在传导至终端用户。Anthropic 可能面临 API 调用成本高企或用户滥用问题(如高频请求导致服务器负载)。类似情况也曾出现在 OpenAI 的 Codex 服务中,后者最终被整合进付费 API,不再作为独立订阅权益。 ### 社区反应 Hacker News 用户对此反应不一。部分用户认为 **“Pro 订阅价值被削弱”**,因为每月20美元已包含 Claude 网页版访问和优先体验,但移除核心编程功能可能降低对开发者群体的吸引力。也有用户猜测,Anthropic 可能正在为 Claude Code 准备 **独立定价模型**,或将其作为高级计划的专属卖点。 ### 小结 对于依赖 Claude Code 的开发者,若尚未订阅 Pro,可能需要等待 Anthropic 公布新的定价方案,或转向 GitHub Copilot、Amazon CodeWhisperer 等替代品。这一变动也提醒市场:**AI 编程服务的商业模式仍在快速迭代**,用户福利可能随时调整。

Hacker News773个月前原文

在埃隆·马斯克旗下 SpaceX、xAI 和 X 的“组合套餐”公司即将进行首次公开募股(IPO)之际,SpaceX 宣布了一项奇特的安排:要么以 **600 亿美元** 收购专注于 AI 编程的自动化平台 **Cursor**,要么支付 **100 亿美元** 的合作费用。 ## 协议的核心内容 根据 SpaceX 在 X(原 Twitter)上发布的声明,该公司与 Cursor 正在紧密合作,旨在“创造世界上最好的编程和知识工作 AI”。这项协议的关键在于,SpaceX 获得了在今年晚些时候以 **600 亿美元** 收购 Cursor 的权利,或者支付 **100 亿美元** 作为“合作费用”。 **Cursor** 是一家专注于 AI 编码的初创公司,其产品主要面向专业软件工程师。而 SpaceX 则拥有名为 **Colossus** 的百万 H100 等效训练超级计算机。两者的结合,理论上可以加速 AI 模型的开发进程。 ## 行业背景与竞争态势 这笔潜在的交易发生在 AI 编程工具市场竞争白热化的背景下。 - **市场领导者 Anthropic** 在 AI 编码领域占据领先地位。 - **Google** 据报道已由 Sergey Brin 亲自指挥“突击队”,以帮助其代理式 AI 工具迎头赶上。 - **OpenAI** 去年在关闭 Sora 项目以专注于 ChatGPT 超级应用及其 Codex 工具时,Sam Altman 曾宣布进入“红色警戒”状态。 Cursor 的加入,显然是为了增强 **xAI** 的工具能力,使其能在这一关键赛道与 Anthropic 等对手展开更有效的竞争。 ## 交易的特殊性与潜在影响 **分手费** 在并购交易中并不罕见,但 SpaceX 将这笔 100 亿美元的费用描述为“为我们共同在 AI 上的工作”付费,这种表述方式颇为独特。 值得注意的是,就在几天前,CNBC 报道称 Cursor 正在以 **500 亿美元** 的估值筹集 20 亿美元资金。而 SpaceX 提出的收购价高达 **600 亿美元**,这无疑是一个溢价显著的报价。 另一方面,CNBC 和 Bloomberg 的报道显示,马斯克对自己合并后的 X 公司组合(包括 SpaceX、xAI、X 等)的估值高达 **1.25 万亿美元**。此次对 Cursor 的潜在收购,可能是其构建 AI 帝国、提升整体估值战略的一部分。 ## 总结 SpaceX 与 Cursor 的这项协议,无论最终以收购还是高额合作费收场,都凸显了 **AI 编程工具** 在当今科技竞争中的核心地位。对于马斯克而言,这不仅是技术上的补强,更是其宏大商业版图中关键的一步棋。随着 IPO 的临近,此类战略性动作或将持续吸引市场目光。

The Verge3个月前原文

在麻省理工科技评论(MIT Technology Review)主办的EmTech AI人工智能领导力峰会上,一场特别的圆桌会议通过直播形式举行,为订阅者独家揭晓了一份聚焦2026年人工智能领域关键发展的清单。这份清单涵盖了**10项关键技术、新兴趋势、大胆构想和重要动向**,旨在帮助行业领导者把握AI发展的核心脉搏。 ## 会议背景与形式 本次圆桌会议是EmTech AI峰会的一部分,由麻省理工科技评论的AI记者**Grace Huckins**主持,执行编辑**Amy Nordrum**和**Niall Firth**在台上正式公布了这份清单。会议于**2026年4月21日**录制,采用直播形式,优先面向MIT校友和订阅者开放,体现了内容的高端性和前瞻性。 ## 清单的核心价值 这份清单并非简单的技术罗列,而是经过编辑团队深度筛选,聚焦于“当前最重要”的AI要素。它可能包括: - **突破性技术**:如新一代大语言模型(LLMs)的演进、AI代理(AI agents)的成熟应用、多模态能力的深度融合等。 - **关键趋势**:例如AI在科学发现(如自动化研究)、社会治理(可能涉及监控伦理)、以及产业落地(如机器人导航)中的角色演变。 - **思想与运动**:涵盖对AI发展方向的宏观思考,如应对“AI倦怠期”(AI malaise)、平衡创新与监管、以及探索AI的长期社会影响。 ## 行业关联与深层意义 从会议提及的相关报道可以推断,清单内容紧密联系着AI行业的前沿动态: - **OpenAI**等领军机构正全力推进**完全自动化研究**,这代表了AI从工具向自主探索者的转变。 - **LLMs可能强化大规模监控**的讨论,凸显了AI伦理与隐私保护的紧迫性。 - **Niantic**利用《Pokémon GO》图像数据训练世界模型,展示了**数据众包与AI训练**的创新结合。 - **斯坦福2026年AI指数报告**指出“AI在狂奔,人类在追赶”,这或许呼应了清单对AI发展速度与社会适应力差距的关注。 这些关联表明,清单旨在整合技术突破、应用场景与伦理挑战,为决策者提供一份平衡的路线图参考。 ## 对中文读者的启示 对于关注全球AI趋势的中文读者而言,这份清单的价值在于: 1. **前瞻预警**:提前了解2026年可能成型的关键技术,为战略布局提供信息。 2. **风险识别**:关注AI伦理、监控等议题,有助于在本地化发展中规避类似风险。 3. **创新启发**:从自动化研究、数据利用等案例中,寻找可借鉴的技术路径或商业模式。 ## 小结 尽管清单的具体内容因订阅限制未完全公开,但其发布本身已传递出明确信号:AI领域正处在一个**技术加速、应用深化、伦理挑战并存**的关键节点。麻省理工科技评论通过这份清单,试图为行业提炼出最值得关注的焦点,帮助各方在AI的“狂奔”中保持清醒的方向感。对于无法直接获取清单细节的读者,关注相关报道和行业动态,仍是把握这些“重要事物”的有效途径。

MIT Tech3个月前原文
五角大楼申请540亿美元无人机预算,超多国军费总额

## 美国国防部史上最大无人机投资计划 美国国防部在其2027财年预算提案中,提出了一项总额高达**1.5万亿美元**的军费申请,其中**无人机与自主作战技术**相关预算成为焦点。根据提案,五角大楼计划投入**536亿美元**专门用于无人机领域,这一数字不仅创下美国历史纪录,其规模甚至超过了乌克兰、韩国、以色列等国的年度国防总预算,足以跻身全球军费开支前十名。 ### 预算分配与战略重点 这笔巨额资金将主要流向以下几个关键领域: * **提升本土生产能力与采购**:加速美国国内无人机的生产与列装,减少对外依赖。 * **人员培训与体系建设**:大规模培训无人机操作员,并构建支持无人机部署的专用后勤网络。 * **强化反无人机能力**:扩大反无人机系统的部署范围,以保护更多美军基地与设施。 * **资助先进项目**:其中**206亿美元**将用于采购单向攻击无人机,以及支持美国空军“协同作战飞机”(CCA)项目。该项目旨在开发能与有人驾驶战斗机协同作战的无人机僚机原型。 * **专项机构支持**:大部分资金将通过**国防自主作战小组(DAWG)** 进行管理和分配。该小组成立于2025年底,其预算将从2026财年的约2.26亿美元激增至数百亿美元,职能被定位为前沿技术的“探路者”与集成者。 ### 行业背景与战略意图 这一预算提案凸显了无人机与自主系统在现代及未来战争中的核心地位已从战术层面上升至战略层面。五角大楼高级官员朱尔斯·赫斯特在简报中透露,DAWG正与工业界紧密合作,实时测试各类自主系统与协同工具,并快速反馈,旨在加速成熟技术的转化与部署。 值得注意的是,尽管投资规模空前,五角大楼明确表示**暂无计划像组建太空军那样成立独立的无人机军种**。官方强调,此次预算重点在于采购和集成**现有成熟技术**,以快速形成战斗力,这与旨在提升美国国内制造业基础的其他拨款有所区分。 ### 影响与观察 * **规模对比**:仅无人机专项预算就已接近美国海军陆战队的全年总预算,其数额之巨引发广泛关注。 * **技术路径**:投资明显偏向于已验证的、可快速部署的无人机平台(如攻击无人机、MQ-25无人加油机)及反制系统,而非长期的基础研发。这反映了在大国竞争背景下“快速装备”的紧迫性。 * **产业信号**:巨额订单将极大刺激美国无人机产业链,相关国防承包商将迎来重大机遇。同时,DAWG作为新型采购与集成机构,其运作模式可能对未来国防采办体系产生影响。 **小结**:这份预算案是美国将“无人机优先”战略付诸实践的明确信号。通过史无前例的投入,美军意图在无人与自主作战领域建立并维持绝对优势,其采购重点与组织创新值得全球防务界与AI产业持续关注。

Ars Technica3个月前原文
Mozilla:Anthropic的Mythos模型在Firefox 150中发现271个安全漏洞

## Anthropic Mythos模型:网络安全防御的AI新利器 近日,Mozilla在博客中透露,通过早期访问**Anthropic的Mythos Preview模型**,成功在即将发布的**Firefox 150**中预识别了**271个安全漏洞**。这一成果不仅展示了AI在代码审计领域的巨大潜力,更引发了业界关于AI如何重塑网络安全攻防格局的深度讨论。 ### 从22到271:AI能力的跃升 Firefox首席技术官Bobby Holley指出,对比数据极具说服力:上个月,Anthropic的**Opus 4.6模型**在分析Firefox 148时仅发现了22个安全敏感漏洞。而Mythos Preview对Firefox 150的分析,直接将这一数字提升至271个。这种数量级的增长,并非偶然——它标志着AI模型在理解复杂代码逻辑、识别潜在安全风险方面取得了实质性突破。 Holley强调,这些漏洞原本也可能通过传统的自动化“模糊测试”技术,或依赖顶尖安全研究员耗费数月人工审计才能发现。但Mythos的出现,大幅降低了漏洞发现的成本与时间门槛。他直言:“计算机在几个月前还完全无法做到这一点,而现在它们在这方面表现出色。” ### “防御者终于有机会决定性地获胜” 在网络安全领域,攻防双方长期处于动态博弈中。攻击者利用漏洞发起进攻,防御者则需不断修补以巩固防线。Holley认为,像Mythos这样的AI工具,正在改变这场博弈的天平。 **关键优势在于效率**:当漏洞发现变得对双方都更廉价时,防御者反而能从中受益。因为防御方可以更早、更全面地识别并修复漏洞,抢在攻击者利用之前筑牢防线。Holley甚至乐观地表示:“我们终于绕过了那个曲线……防御者终于有机会决定性地获胜。” ### 是炒作还是变革? Anthropic此前曾表示,Mythos Preview在发现网络安全漏洞方面表现如此出色,以至于公司决定将其初始发布限制在“关键行业合作伙伴”的小范围内。这一举动自然引发了争议:部分观点认为,这预示着AI辅助黑客攻击的时代即将来临,安全威胁可能被“涡轮增压”;另一派则质疑,这是否只是Anthropic为相对正常的AI能力进步而制造的营销噱头。 Mozilla提供的实际数据,为这场辩论增添了重要砝码。Holley在采访中坦言,基于他多年评估全球顶尖安全研究员工作的经验,**Mythos Preview“完全具备同等能力”**。这并非空泛的赞美,而是建立在真实、可量化的漏洞发现成果之上。 ### 未来展望:AI审计或成软件开发生命周期标配 Holley进一步指出,这种AI辅助的漏洞分析,未来可能成为**所有软件都必须面对的环节**。原因很简单:每款软件都潜藏着大量未被发现的漏洞,而如今,这些漏洞正变得“可被发现”。 这意味着,AI驱动的代码审计有望从“高端选项”逐步转变为开发流程中的**标准实践**。无论是浏览器、操作系统,还是各类应用软件,提前利用AI进行深度安全扫描,或将成为降低风险、提升产品可靠性的关键一步。 当然,这同时也带来了新的挑战:如果攻击者也能获得类似能力的AI工具,攻防节奏是否会进一步加速?行业又该如何建立相应的伦理与使用规范?这些问题,仍需整个科技生态共同探索。 ### 小结 - **Mythos Preview在Firefox 150中识别出271个安全漏洞**,数量远超前代模型。 - **AI大幅提升漏洞发现效率**,降低了对昂贵人工审计的依赖,使防御方更具优势。 - **技术能力已可比肩顶尖安全研究员**,但需关注其潜在的双刃剑效应。 - **AI辅助安全审计或将成为软件开发新常态**,推动行业整体安全水位提升。 Mozilla的这次实践,不仅验证了Anthropic Mythos模型在实战中的价值,也为AI在网络安全领域的应用前景,勾勒出了一幅清晰而充满希望的图景。

Ars Technica3个月前原文

近日,AI 公司 Anthropic 对其 Claude 产品的定价计划进行了调整,其中最引人注目的变化是 **Claude Code** 功能从 **Pro 计划** 中移除。这一变动在 Hacker News 上引发了热烈讨论,获得了 312 分和 193 条评论,反映出开发者社区对此的高度关注。 ### 核心变动:Pro 计划功能缩水 根据 Anthropic 官网最新的定价页面信息,Claude 目前提供 **Free**、**Pro** 和 **Max** 三个主要订阅层级。 * **Pro 计划**:定价为每月 20 美元(或按年订阅 17 美元/月)。该计划在原有免费版功能基础上,增加了更多使用额度、Claude Cowork 协作功能、无限项目、Research 能力、访问更多 Claude 模型以及 Claude for Office 套件(Excel、PowerPoint、Word)等。 * **关键变化**:在官方的“功能与能力”对比表格中,**Claude Code** 这一项仅出现在 **Free** 和 **Max** 计划的勾选栏下,而在 **Pro** 计划对应的位置是空白。这表明,原先可能包含在 Pro 计划中的代码生成与执行相关能力,现在已被降级或重新分配。 ### 行业背景与潜在影响 **Claude Code** 通常指代 Claude AI 在代码生成、编辑、可视化数据以及创建和执行文件方面的能力。对于许多开发者、数据科学家和技术写作者而言,这是选择 Claude 而非其他通用聊天机器人的核心原因之一。 1. **定价策略的精细化**:Anthropic 此举被视为一种 **产品分层与货币化策略** 的调整。通过将高价值、高需求的代码功能从中间档(Pro)剥离,可能旨在: * **推动用户向更高价位的 Max 计划转化**:Max 计划起价为每月 100 美元,提供 5倍或20倍于 Pro 的使用额度、更高的输出限制、早期访问高级功能等。将 Claude Code 保留给 Max 用户,能显著提升该顶级套餐的吸引力。 * **重新定义 Pro 计划的定位**:Pro 计划可能被更明确地定位为“日常生产力”工具,聚焦于文本分析、内容创作、研究、办公集成等通用场景,而非专业的代码开发。 2. **AI 助手市场的竞争加剧**:当前,AI 代码助手赛道竞争异常激烈。GitHub Copilot、Cursor、Amazon CodeWhisperer 等产品各具优势。Anthropic 调整代码功能的访问权限,可能是在评估其资源投入与市场回报后做出的决策,意图将有限的计算资源(尤其是针对代码优化的模型推理成本)分配给付费意愿最高的企业级或重度开发用户。 3. **开发者社区的反馈**:Hacker News 上大量的评论表明,这一变动直接触动了核心用户群体的利益。许多 Pro 计划订阅者可能正是因为代码功能而付费。功能的突然移除可能导致用户流失、信任度下降,并引发关于“产品价值是否与价格匹配”的广泛讨论。 ### 用户该如何应对? 对于现有或潜在的 Claude 用户,尤其是依赖其代码功能的用户,建议: * **仔细评估需求**:明确你使用 Claude 的主要场景。如果代码生成、审查、调试是刚需,那么 **Free 计划**(仍保留基础 Claude Code)或 **Max 计划** 可能是更合适的选择。 * **审视 Pro 计划价值**:如果您的需求以文档处理、信息分析、内容创作为主,且偶尔需要更高使用额度,那么调整后的 Pro 计划或许仍具性价比。 * **关注官方动态**:Anthropic 的定价和功能“可能随时更改”。用户需留意官方公告,了解是否有过渡方案、功能解释或未来可能的回调。 ### 小结 Anthropic 将 Claude Code 从 Pro 计划中移除,是一次重要的产品与市场策略调整。它反映了 AI 公司在平衡**服务成本、用户分层和市场竞争**时的现实考量。这一决策短期内可能会引发核心用户的不满,但长期来看,它或许有助于 Anthropic 更清晰地划分产品线,并在高端市场(Max/Enterprise)建立更强的竞争优势。对于用户而言,这提醒我们,在快速演进的 AI 服务生态中,订阅权益并非一成不变,持续评估工具与自身需求的匹配度至关重要。

Hacker News6803个月前原文

**MIT化学教授Laura Kiessling领导的研究团队发现,一种名为intelectin-2的天然蛋白质,不仅能够增强肠道黏膜屏障,还能提供广谱保护,对抗胃肠道中的有害细菌。** 这项研究揭示了人体自身免疫防御机制的新层面,并为应对日益严峻的抗生素耐药性问题提供了全新的策略方向。 ### 双重防御机制:加固屏障与直接杀菌 研究团队发现,intelectin-2是一种凝集素(lectin),它通过两种互补的方式发挥作用: 1. **加固黏膜屏障**:intelectin-2能够与构成黏液的黏蛋白(mucins)中的半乳糖(galactose)结合,从而帮助稳定和加强肠道内壁的保护性黏液层。这相当于为肠道筑起了一道更坚固的物理防线。 2. **直接中和细菌**:当屏障受损,细菌开始逃逸时,intelectin-2会直接与细菌细胞膜上的半乳糖分子结合。这种结合会困住细菌,阻碍其生长。更关键的是,被困住的微生物最终会瓦解,这表明intelectin-2能够通过破坏细菌的细胞膜来杀死它们。 Laura Kiessling教授对此解释道:“intelectin-2的运作方式非常出色。它既能帮助稳定黏液层,又能在屏障受损时,直接中和或限制那些开始逃逸的细菌。” ### 对抗耐药菌的潜力 研究显示,intelectin-2能够中和或消灭包括**金黄色葡萄球菌(Staphylococcus aureus)** 和**肺炎克雷伯菌(Klebsiella pneumoniae)** 在内的多种病原体。这些细菌通常难以用抗生素治疗,是导致院内感染和抗生素耐药性问题的主要元凶之一。因此,研究人员认为,intelectin-2未来有潜力被开发成一种新型的抗菌剂。 Kiessling教授强调:“利用人类自身的凝集素作为工具来对抗抗生素耐药性,开辟了一条从根本上全新的策略,它借鉴了我们自身固有的免疫防御机制。利用身体已经用来保护自己免受病原体侵害的蛋白质,这一方向极具吸引力,也是我们正在追求的。” ### 对炎症性肠病等疾病的启示 这项发现对理解和管理某些疾病也具有重要意义。例如,在**炎症性肠病(IBD)** 患者中,intelectin-2的水平可能出现异常:水平过低可能削弱黏液屏障,而水平过高则可能杀死有益的肠道细菌。因此,恢复理想的intelectin-2水平,可能成为未来治疗这类疾病的一种新思路。 ### 总结与展望 MIT的这项研究不仅深化了我们对人体黏膜免疫系统的理解,更重要的是,它指向了一个对抗病原体(尤其是耐药菌)的创新路径——**利用人体自身产生的天然防御蛋白**。在传统抗生素研发面临瓶颈、耐药性问题日益严峻的背景下,这种“师法自然”的策略显得尤为宝贵。虽然将intelectin-2开发成临床应用的治疗手段还有很长的路要走,但它无疑为未来的抗感染治疗和免疫调节疗法点亮了一盏新的明灯。

MIT Tech3个月前原文