(来源:麻省理工科技评论) 过去几个月,一连串由 AI Agents 发起的网络攻击震惊了世界。7 月,OpenAI 披露,其一群人工智能代理逃出了沙箱环境,并入侵人工智能平台 Hugging Face,以便在一次网络安全测试中作弊。最近,外部研究人员发现,OpenAI 的代理曾于 5 月劫持一个德国维基网站和代码托管平台 RubyGems,用来分享测试答案。 本月早些时候,人工智能公司 Anthropic 披露了四起事件,均指向其模型 Claude 在网络安全演练期间入侵了第三方系统。就在上周,谷歌确认,其模型 Gemini 也被发现入侵了其他公司的系统。 揭露 OpenAI 网站遭劫持事件的研究人员警告说,很可能还有类似但尚未被…
阅读全文
02孩子无法选择父母,正如父母也无法主动挑选孩子。但如今,一家美国公司号称能为寻求辅助生殖的夫妻筛选“更好”的胚胎。 近日,美国基因组学创业公司 Nucleus Genomics 在其研究平台 Nucleus Labs 发布了新一代多基因评分(PGS)模型套件 Vitruvian,用于预测身高、体重指数(BMI)和智力三项性状。 公司创始人兼 CEO 基安·萨德吉(Kian Sadeghi)随后在社交平台上宣称,Vitruvian 将用于胚胎 DNA 优化,“(最高)可提升 14 个智商点数”。他还援引前牛津大学哲学家尼克·博斯特罗姆(Nick Bostrom)在《超级智能》(Superintelligence)一书中的论述,称基因优化…
阅读全文
03(来源:麻省理工科技评论) 据美国国防部的一份预算申请,美国政府计划在未来五年投入 3030 万美元,研发一种改进版测谎技术。该项目名为“测谎仪+”(Polygraph+),又称“下一代测谎仪”(Polygraph Next),包括利用人工智能和机器学习的评分算法,以及一种名为“非接触式感测”的技术。后者可以在不将设备连接到受测者身体上的情况下,读取其生理数据。 据 Inside Defense 报道,这份预算文件称,项目旨在“使联邦政府的测谎和可信度评估技术现代化”,提高其准确性和可靠性。但它也可能只是又一次试图借助技术识别谎言的失败尝试。英国诺森比亚大学法律学者基里·科措格鲁(Kyri Kotsoglou)在研究司法系统中测谎仪…
阅读全文
049 月 20 日上午,OpenAI 一个本被限制访问外网的内部模型,悄悄向外部某个公开的聊天机器人发了一条询问:法国的首都是哪里? 它其实并不在乎答案是什么。当时这个模型正在接受强化学习(RL)训练,任务是根据一些零散的线索查出一篇博客的作者是谁。训练环境本该完全阻断它自主上网,但它找到了一条缝隙,把问题编排进了域名查询的请求里发了出去。问法国首都,纯粹是在测试这条隐秘的线路通不通。很快,外部返回了回答:法国首都是巴黎。确认线路可用后,它紧接着顺着同一条道,又发出了 18 个问题。 5 天后,OpenAI 发布了针对这次事件的调查报告,并宣布暂停旗下最强模型的全部训练、评估,以及广义上所有带有工具调用能力的推理任务。同一天,Open…
阅读全文
05一枚纽扣电池卡在食道里,电流会在负极一侧电解组织液,生成强碱,迅速导致严重灼伤,随后发展为食道穿孔、气管食管瘘。腐蚀一旦延伸至主动脉,患者的生命将难以挽回。 同样的电池也装在胶囊内镜和电子药丸里,与消化道隔着一层壳,在体内运转 1 到 3 天后随粪便排出,器件安全性相对可控。可一旦进入每天服用,或在胃里工作数天的场景,设备卡住、外壳破损等意外情况的发生概率就会随时间累积。 为破解这一困境,研究人员正在开发一些可在体内安全降解的电子器件,不仅能为患者减少内镜取物的痛苦,还能降低设备长期滞留的潜在风险。 受糯米纸糖果(就是大白兔奶糖那种)的启发,麻省理工学院(MIT)团队开发出一种能在消化道内降解的“纸电池”。它用两种人体必需的矿物质制…
阅读全文
06(来源:麻省理工科技评论) 去年这个时候,我正在曼彻斯特参加一场衰老研究会议,听一场关于果蝇衰老的报告,手机却突然接连响起消息提醒。 据报道,俄罗斯总统弗拉基米尔·普京(Vladimir Putin)说:“随着生物技术的发展,人体器官可以不断移植,人甚至可以越活越年轻,乃至实现永生。” 他似乎说的是一种通过“更换”器官来延长寿命的设想。多项实验曾将年轻小鼠与年老小鼠的身体连接起来,发现年轻小鼠体内的某些因素能使年老小鼠呈现出返老还童的迹象。既然如此,年轻的器官会不会也让七十多岁的国家领导人变年轻? 遗憾的是,对普京来说,新研究给这个想法泼了一盆冷水。针对小鼠和人类移植心脏的研究显示,不管供体心脏起初有多年轻,它很快都会呈现出与受者相…
阅读全文
07当地时间 9 月 24 日,科技媒体 The Information 曝出消息,AI 初创公司 TypeSafe AI 正与投资者洽谈一轮 10 亿美元或更高规模的融资,部分投资者提出的估值超过 100 亿美元,已有投资方表示愿意领投,谈判仍处于早期阶段。 次日,《金融时报》(Financial Times)援引知情人士的说法,称这家公司正在接到估值 100 亿美元或更高的融资提议。公司联合创始人兼 CEO 迪奥戈·阿尔梅达(Diogo Almeida)拒绝透露细节,只表示投资人已经踏破了公司的门槛。 TypeSafe AI 于 9 月 15 日结束隐身状态,并宣布完成 4000 万美元种子轮融资,同时发布首款模型 Jev,估值来到…
阅读全文
08三周前,GPT-6 Astra 发布后,整个 AI 圈很快被它刷了屏。 每隔一段时间,新模型都会刷新数学、编程和推理榜单,这其实已经不算稀奇。但这次,Astra 带来的冲击更像是一次 AI 能力边界的突然扩张。它在软件工程、Computer Use、科学研究等传统强项上继续推进的同时,开始进入越来越复杂的专业工作流。 OpenAI 公布的结果中,Astra 在测试模型三维建模能力的 BenchCAD 上达到 95.9% 的几何重合率,可以根据多视角图片生成 CAD 代码;官方演示里,它还能直接操作 Blender 搭建一栋房子,再转进常用于游戏和实时三维开发的 Unreal Engine 5,变成一个可以行走的三维空间。 从平面图像…
阅读全文
099 月的第一天,斯坦福大学(Stanford University)物理学家兰斯·狄克逊(Lance Dixon)收到 Anthropic 的消息:Claude 已经完成了平面 N=4 超杨-米尔斯理论(planar N=4 super Yang-Mills theory)中九圈六胶子散射振幅的计算,请他帮忙验证。自 2023 年以来,兰斯与合作者一直致力于解决这一难题。 几天后,中国科学院理论物理研究所的何颂团队也告诉兰斯,他们借助 GPT-6 独立得到了九圈振幅的符号(symbol)。 当地时间 9 月 25 日,Anthropic 邀请前理论物理学家、科学作家马特·冯·希佩尔(Matt von Hippel)撰文,正式公布他们…
阅读全文
10近日,一家名为 C5R 的美国旧金山初创公司用 12 周建成了一座 AI 驱动的研究设施 Facility-0,覆盖了生物学、化学和材料科学。接着它发布了一个名为 SciUniverse 的基准,能够测试模型是否可以在真实实验室里工作,结果发现模型虽然很懂科学理论,却在实际操作中频繁遗漏一些关键细节。 比如,当一个前沿 AI 模型在实验室里试图移液一批样本的时候,但它根本没有注意到样本还冻着。另一个 AI 模型在含 DNA 的孔之间重复使用了同一个枪头,以至于污染了整组样本。还有 AI 模型对着敞开的孔板做涡旋震荡,甚至完全没有考虑溶剂正在蒸发。 这些便是 C5R 在 SciUniverse 基准测试里记录下来的真实失败,C5R 的…
阅读全文