一项新的研究论文详细揭示了AI模型Claude 3 Sonnet的内部工作机制,展示了如何通过激活与金门大桥等概念相关的“特征”来影响模型的反应。通过调整这些特征的强弱,研究人员能够引导Claude的回答包含特定元素,展示了...
Read More近日,研究人员发现了一种针对视觉变换器(Vision Transformers)的新型安全威胁。这种被命名为“SWARM”的攻击手法,利用一个“切换令牌”秘密激活模型中的后门行为,使其对用户具有高度的隐蔽性和危险性。视觉变换器是...
Read More谷歌DeepMind近日推出了一项名为“先锋安全框架”的新技术,以应对未来先进AI模型可能带来的风险。这个框架确定了对可能有害的AI能力的关键能力级别(CCLs),并根据这些CCLs对模型进行评估,当达到阈值时,应用缓解策...
Read MoreAI工具如GPT-4越来越多地在编写研究论文等任务中协助学者,甚至在某些方面超过了他们。根据梁等人的研究,有高达18%的论文在某些领域得到了AI的协助。这种AI的集成可能创建出一个循环,软件既生成又审查学术出版物。...
Read More近日,知名开源平台GitHub Repo发布了全新的服务框架——AnythingLLM。该框架具有LLM(Low Level Management)和RAG(Risk Analysis and Governance)两大主要功能,提供了一站式的服务体验。AnythingLLM的目标是通过...
Read More近期,一些人工智能驱动的硬件产品如Humane Pin和Rabbit R1在发布之后备受争议,但这并没有减少风险投资对该领域的关注和投入,著名投资人Sam Altman等人对其进行了大量投资。这种吸引力在于人工智能有可能通过创新...
Read More本文对人工智能和机器学习进行了深入剖析,认为尽管AI工具在某些任务中可能有所用处,但它们常常未能达到AI公司所作的宏大承诺。文章强调了AI实际应用案例,如编程辅助和语言生成,与行业叙事设定的过高期待之间的巨...
Read More有效利他主义和有效加速主义是两种不同的思想流派,两者在大部分问题上达成了共识,但在人工智能(AI)安全这个话题上却存在分歧。有效利他主义强调将资源用于最大程度上的做出善行,而有效加速主义则主张利用技术的...
Read More