Meta支持的机构牵头打造AI制药数据基建,达18亿美元
作者:MD 出品:明亮公司 继个人AI助手Muse流行后,Meta(META.US)在生物科技领域的最新布局也引起了市场的关注。10月7日,Meta背景的生物科技机构Biohub正在扩大一项总规模约18亿美元的“虚拟生物学倡议”(Virtual Biology Initiative)。Biohub还宣布,美国能源部、美国国立卫生研究院、Google DeepMind、Isomorphic Labs和Meta将加入该倡议。NVIDIA提供计算基础设施。多家细胞和基因组研究机构将参与数据生产和标准制定。 18亿美元并不全是新增现金,其中,Biohub投入5亿美元;美国能源部(DOE)未来五年投入超过5亿美元;美国国立卫生研究院(NIH)将协调使用此前超过5亿美元联邦投资形成的数据和科研设施;Google DeepMind、Isomorphic Labs和Meta合计投入3亿美元。 Biohub由Meta创始人Mark Zuckerberg和他的妻子Priscilla Chan创立支持,是独立的非营利研究机构,并不属于Meta。不过,Meta既是投资方,也是Biohub部分AI技术和人才的来源。 Biohub:希望为虚拟细胞生产训练数据 Biohub的一项核心目标是建立“虚拟细胞”, 这是一套从基因组、蛋白质、成像和细胞扰动数据中学习的AI系统,用于预测细胞在药物、基因编辑或环境变化下的反应。研究人员可以先在模型中测试药物、基因编辑或其他方案,再选择值得进入实验室的项目。 而此次扩大规模的“虚拟生物学倡议”想要做的,是解决AI生物科技的数据问题。 现有生物数据分散在论文、实验记录和公共数据库中,格式和实验条件不同,失败结果又很少公开。 Biohub计划通过这项倡议建立统一标准、标识符和访问入口,并生产更多干预数据( 干预数据,是记录细胞在药物、基因编辑或环境变化后的反应)。 正如「明亮公司」此前所提及的, 这类模型目前受到数据限制。 生物数据分散在论文、实验记录和公共数据库中。不同机构使用的样本、仪器和记录方式不同。公开数据又以成功结果为主。没有结合、合成失败等结果较少进入论文。 对AI发现新药来说,模型也需要失败数据。模型只有见过足够多的成功和失败结果,才可能预测新药物或新靶点的效果。而且,失败结果可以说明某种设计为什么无法表达,为什么发生非特异性结合,或者为什么只在特定细胞环境中有效。 在倡议中,Biohub将用4亿美元用于冷冻电子断层成像、活体显微技术和生物工程工具, 另有1亿美元支持外部研究 。合作的美国能源部提供超级计算、成像设施和自动化实验室,而NIH提供疾病数据和公共数据库。 这一流程与AI制药公司建设湿实验室的逻辑相似:模型提出方案,实验室进行验证,结果再用于下一轮训练。区别在于, Biohub希望把数据和工具作为科研基础设施向外开放 ,而不是围绕一条自有药物管线使用。 Meta布局Biotech:从蛋白质模型延伸至细胞数据 Meta较早通过FAIR实验室进入计算生物学。FAIR开发了ESM蛋白质语言模型。ESM项目负责人Alex Rives后来创办EvolutionaryScale,该团队于2025年加入Biohub,Rives担任Biohub科学负责人。 2026年5月,Biohub发布ESMC、ESMFold2和ESM Atlas。ESM Atlas覆盖68亿条蛋白质序列和11亿个预测结构。Biohub还使用ESMFold2为多个癌症及免疫靶点设计蛋白结合物,部分设计已完成实验室验证。
菲舍尔:凯恩是教科书式的射手,进这么多球当然配得上拿金球
提供足球运动的安全知识教育,包括运动损伤预防、急救培训和教练员认证服务。...