网易首页 > 网易号 > 正文 申请入驻

自动化边缘科研:流程、边界与人类角色丨Vibe Modeling读书会第九期

0
分享至


导语

面向大模型驱动科研自动化的发展趋势,探讨生成式人工智能在科研流程中的能力边界与方法价值。本期读书会为Vibe Modeling读书会第九期,中山大学物理与天文学院CIBR吉妮实验室实习生贾梓杏将聚焦于经典科研智能体论文,分析大模型在科研自动化中的应用路径与评价方法,并探讨如何在 Vibe Modeling 实践中提升模型结果的可靠性,以及人类研究者在智能化科研中的作用。

集智俱乐部联合同济大学长聘副教授陈小杨和北京林业大学副教授李周园共同发起,本读书会旨在跨越硬科技与社会科学两大板块,系统梳理Vibe Modeling的技术现状、应用潜力与开放问题,通过集体实践形成可复用的提示策略及评估方法,为这一新范式奠定早期社区基础,助力推动其在各领域的规范化应用与人才培养落地。



报告简介

本期将以介绍多篇顶会/顶刊论文的Journal Club形式,从前 8 期聚焦的具体建模应用转向方法论层面的系统反思。围绕大模型驱动科研自动化的可信性与能力边界,讲解从领域专用辅助建模到端到端全自动科研的演进路径,结合认知建模(GeCCo)与全流程自动化(The AI Scientist)等典型案例,介绍相关技术实现的 Pipeline、迭代优化机制与多维度评估体系。进而深入探讨 LLM 科研能力边界的实证研究,以及如何在具体任务评估模型的结果,如神经元激活视角(SAE)与领域专用 Benchmark(LLM-SRBench、SIMBENCH),并能从一些学界提供的方法中学会如何在我们Vibe Modeling的过程中如何评估并优化模型给我们的答案。最终基于 Human or AI in the Loop 的理论辨析与 生成模型对于人类Critical Thinking 实证研究,重新审视自动化时代人类研究者的核心价值、批判性角色。

分享大纲

  • 大模型辅助科研的 Pipeline:从领域专用建模到端到端自动化

  • 生成结果的评估:多维度能力边界与可信及可行性检验

  • 人类的作用:自动化浪潮中的批判性角色再定位

核心概念

  1. 端到端自动化科研(End-to-End Automated Research)

以 The AI Scientist 为代表的系统,旨在将科研全流程——从 Idea 生成、文献检索、实验规划、代码实现、结果可视化、论文撰写到同行评审——交由智能体自主完成。

  1. 逆向工程(Reverse Engineering)

在评估 LLM 科研能力时,反向工程指模型从黑盒系统的输入-输出对中推断其内部机制(如程序、形式语言或数学方程)的过程。Princeton 的研究将其形式化为:给定观测集合 O={(xi,yi)} ,模型需输出对黑盒函数 f∗ 的假设。这是检验 LLM 是否具备「科学发现」能力的基础任务。

  1. 自动化评审(Automated Review)

The AI Scientist 中用于评估生成论文质量的子系统。它模拟顶级机器学习会议(如 NeurIPS)的评审流程,对论文的 Soundness、Presentation、Contribution 进行 1–10 评分,并输出优缺点与接收/拒绝建议。

  1. 人在回路(Human-in-the-Loop, HIL)与 AI 在回路(AI-in-the-Loop, AI2L)

两种人机协作范式的根本分野。HIL 系统中,AI 掌握决策主导权,人类作为「标注者」或「纠错者」提供反馈以优化模型;AI2L 系统则相反,人类掌握最终决策权与系统控制权,AI 仅作为辅助工具提供信息、建议或自动化子任务。在科研自动化语境下,Vibe Modeling 更接近 AI2L,而全自动论文生成则偏向 HIL,厘清这一区分对评估责任归属与系统设计至关重要。

  1. 批判性思维(Critical Thinking)

在生成式 AI 辅助的知识工作中,批判性思维不再仅指传统的问题解决,而是被重新操作化为:目标与查询构建(Goal & Query Formation)、响应检查(Inspect Response)与响应整合(Integrate Response)。知识工作者通过验证 AI 输出是否符合客观标准、交叉核对信息来源、调整风格与语境,来确保最终工作质量。

主讲人介绍

主讲人:贾梓杏,中山大学物理与天文学院CIBR吉妮实验室实习生,目前已直博至北京大学前沿交叉学科研究院生命科学联合中心。研究领域:类脑结构计算建模 、类脑启发人工智能。

参考文献

[1] Lu, C., Lu, C., Lange, R. T., Yamada, Y., Hu, S., Foerster, J., Ha, D., and Clune, J. The AI Scientist: Towards end-to-end automation of AI research. Nature, 2026. URL https://doi.org/10.1038/s41586-026-10265-5.

[2] Gottweis, J., Weng, W.-H., Daryin, A., Tu, T., Sirkovic, P., Myaskovsky, A., Glowaty, G., Weissenberger, F., Orlandi, A., Popovici, D., Palepu, A., Rong, K., Tanno, R., Saab, K., Zhang, F., Blum, J., Carroll, A., Kulkarni, K., Tomašev, N., Zverinski, D., Rendulic, I., Vedadi, E., Hasler, F., Rimanic, L., Boia, M., Budiselic, I., Feinstein, B., Bellaiche, M., Sheffer, T., Freyberg, J., Ratcliff, J., Bertolli, O., Chou, K., Hassidim, A., Gokturk, B., Vahdat, A., Guan, Y., Dhillon, V., Vaishnav, E. D., Lee, B., Costa, T. R. D., Penadés, J. R., Peltz, G., Matias, Y., Manyika, J., Hassabis, D., Xu, Y., Kohli, P., Pawlosky, A., Karthikesalingam, A., and Natarajan, V. Accelerating scientific discovery with Co-Scientist. Nature, 2026. URL https://doi.org/10.1038/s41586-026-10644-y.

[3] Rmus, M., Jagadish, A. K., Mathony, M., Ludwig, T., and Schulz, E. Generating computational cognitive models using large language models. In Advances in Neural Information Processing Systems (NeurIPS), 2025. URL https://arxiv.org/abs/2502.00879.

[4] Lee, H.-P., Sarkar, A., Tankelevitch, L., Drosos, I., Rintel, S., Banks, R., and Wilson, N. The impact of generative AI on critical thinking: Self-reported reductions in cognitive effort and confidence effects from a survey of knowledge workers. In CHI Conference on Human Factors in Computing Systems (CHI '25), 2025. URL https://doi.org/10.1145/3706598.3713778.

[5] Si, C., Yang, D., and Hashimoto, T. Can LLMs generate novel research ideas? A large-scale human study with 100+ NLP researchers. In International Conference on Learning Representations (ICLR), 2025. URL https://openreview.net/forum?id=M23dTGWCZy.

[6] Ghareeb, A. E., Chang, B., Mitchener, L., Yiu, A., Szostkiewicz, C. J., Shved, D., Gyimesi, G. J., Laurent, J. M., Wright, S. M., Razzak, M. T., White, A. D., Finnemann, S. C., Hinks, M. M., and Rodriques, S. G. A multi-agent system for automating scientific discovery. Nature, 2026. URL https://doi.org/10.1038/s41586-026-10652-y.

[7] Geng, J., Chen, H., Arumugam, D., and Griffiths, T. L. Are large language models reliable AI scientists? Assessing reverse-engineering of black-box systems. arXiv preprint arXiv:2505.17968, 2025. URL https://arxiv.org/abs/2505.17968.

时间信息

2026年7月19日(周日)下午14:00-16:00,腾讯会议线上进行,感兴趣的朋友扫码报名加入Vibe Modeling读书会后,可进入学员群进行交流。

报名读书会:「Vibe Modeling」

集智俱乐部联合同济大学长聘副教授陈小杨和北京林业大学副教授李周园共同发起,将在集体实践中探索 Vibe Modeling 在不同领域的通用模式与特殊需求,沉淀可复用的提示策略、评估方法与工作流,为这一范式搭建早期社区基础,助力 AI 赋能的跨学科研究与人才培养落地。

读书会自2026年5月17日起,每周日下午14:00-16:00线上开展,持续10周,包含主讲分享与讨论交流,并提供会后视频回放,诚邀相关领域研究者及跨学科兴趣者参与。

扫描海报中二维码报名参加读书会


报名方式

第一步:微信扫码填写报名信息。

第二步:填写信息后,付费报名。如需用支付宝支付,请在PC端进入读书会页面报名支付:

第三步:添加运营助理微信,拉入对应主题的读书会社区(微信群)。

PS:为确保专业性和讨论的聚焦,本读书会谢绝脱离 Vibe Modeling 读书会主题及相关问题的交流讨论;如果出现讨论内容不符合要求、经提醒无效者,会被移除群聊并对未参与部分退费。

加入社区后可获得的资源

完整权限包括:线上问答、录播回看、资料共享、社群交流、信息同步、共创任务获取积分等。


特色退费与激励机制

我们提供以下两种途径,让您的投入获得实际回馈:

  1. 任务达标退费路径

    认领并合格完成任意两期字幕任务,即可退还全额报名费,并额外获得集智专属周边奖励。

  2. 运营成长激励路径

    合格完成一个字幕任务后,可申请成为运营助理。在读书会项目顺利结项后,将退还学费。表现优异者,还有机会获得额外的奖学金。


特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
随着佩古拉2-0,美网女单八强已诞生3席:3大世界前十悍将在列

随着佩古拉2-0,美网女单八强已诞生3席:3大世界前十悍将在列

侧身凌空斩
2026-09-07 08:30:29
罗迪克为斯瓦泰克鸣不平:美国观众应给予更多尊重

罗迪克为斯瓦泰克鸣不平:美国观众应给予更多尊重

甜度百分百21
2026-09-07 04:19:25
昔日巴萨“子弹”退役:86场20球 曾上演帽子戏法 梅西3助攻

昔日巴萨“子弹”退役:86场20球 曾上演帽子戏法 梅西3助攻

叶青足球世界
2026-09-07 15:12:40
南京连夜成立联合调查组

南京连夜成立联合调查组

政知新媒体
2026-09-07 13:31:40
4-3!英格兰公开赛爆大冷:中国25岁小将战胜世界第4,罗伯逊一轮游

4-3!英格兰公开赛爆大冷:中国25岁小将战胜世界第4,罗伯逊一轮游

小火箭爱体育
2026-09-07 23:00:48
郑钦文美网碰世界第8斯瓦泰克,里巴放弃全部奖金,赢了或直冲前100输了也能补积分

郑钦文美网碰世界第8斯瓦泰克,里巴放弃全部奖金,赢了或直冲前100输了也能补积分

隐于山海
2026-09-07 10:07:16
雷军发布小米迄今最贵手机,售价10999元起

雷军发布小米迄今最贵手机,售价10999元起

极目新闻
2026-09-07 20:38:42
China GT离谱致歉信:人差点没了,先说“配置没问题”

China GT离谱致歉信:人差点没了,先说“配置没问题”

三言科技
2026-09-07 11:22:17
广东一地教育局局长,被查

广东一地教育局局长,被查

南方都市报
2026-09-07 12:09:50
细节曝光!江西低保女生赴港追星,返程后全家2000元补助被清零,女方家庭情况曝光后全网吵翻

细节曝光!江西低保女生赴港追星,返程后全家2000元补助被清零,女方家庭情况曝光后全网吵翻

李晚书
2026-09-07 07:40:43
中科院:江浙沪血液有害物质浓度爆表!

中科院:江浙沪血液有害物质浓度爆表!

生命科学前沿
2024-03-27 17:38:51
快观察 泽连斯基“忙碌的一天”:与美特使首轮谈3小时,还密商“冬季方案”

快观察 泽连斯基“忙碌的一天”:与美特使首轮谈3小时,还密商“冬季方案”

上观新闻
2026-09-07 15:44:19
58-74!世界杯杀出死亡之组,日本女篮爆出意外败局,中国女篮迎来利好契机!

58-74!世界杯杀出死亡之组,日本女篮爆出意外败局,中国女篮迎来利好契机!

刘哥谈体育
2026-09-07 09:16:58
美网超级冷门!郑钦文2-0晋级八强,奖金532万,斯瓦泰克被打崩溃

美网超级冷门!郑钦文2-0晋级八强,奖金532万,斯瓦泰克被打崩溃

侃球熊弟
2026-09-08 01:44:47
30年没离开过上海的保安,突然“被北京法院判了”,账户被冻结、欠债百万…

30年没离开过上海的保安,突然“被北京法院判了”,账户被冻结、欠债百万…

上观新闻
2026-09-07 12:38:31
百万粉丝吃播网红“干饭莹莹”去世,年仅24岁,直播卖皮蛋一场要吃六七十个

百万粉丝吃播网红“干饭莹莹”去世,年仅24岁,直播卖皮蛋一场要吃六七十个

上观新闻
2026-09-07 20:17:01
“17岁男生被人冒充警察施暴”案涉案三人被公诉,伤者拒绝刑事谅解

“17岁男生被人冒充警察施暴”案涉案三人被公诉,伤者拒绝刑事谅解

封面新闻
2026-09-07 18:50:04
蔡澜说,刘銮雄追女明星,都是先送3000万,这样90%港姐可以拿下

蔡澜说,刘銮雄追女明星,都是先送3000万,这样90%港姐可以拿下

晓銊就是我
2026-09-07 12:39:23
英格兰公开赛:丁俊晖4-3绝杀!首爆大冷,中国00后新星1-4出局了

英格兰公开赛:丁俊晖4-3绝杀!首爆大冷,中国00后新星1-4出局了

小火箭爱体育
2026-09-07 19:48:28
乌媒称,特朗普特使要求乌克兰从顿巴斯撤军、泽连斯基辞职并举行大选

乌媒称,特朗普特使要求乌克兰从顿巴斯撤军、泽连斯基辞职并举行大选

山河路口
2026-09-07 13:18:21
2026-09-08 02:35:00
集智俱乐部 incentive-icons
集智俱乐部
科普人工智能相关知识技能
6028文章数 4684关注度
往期回顾 全部

科技要闻

小米澎程N90 Max定价26.99万元

头条要闻

伊朗试验特殊武器爆炸场面如同地狱 美军舰直接跑了

头条要闻

伊朗试验特殊武器爆炸场面如同地狱 美军舰直接跑了

体育要闻

压哨避开CBA选秀规则?NBL香港金牛队已为男篮国手王俊杰报备合同

娱乐要闻

热搜第一,演员李沐宸致歉

财经要闻

证监会原副主席王建军一审被判无期徒刑

汽车要闻

智能可变大空间SUV 小米澎程系列车型上市 20.99万起

态度原创

健康
教育
家居
数码
公开课

同样是脑梗,为何康复结局大不同?

教育要闻

取消英语主科地位,各路专家下场,吵上热搜.....

家居要闻

2026建博会(广州) 公装联探展交流活动

数码要闻

存储吃紧!华硕、技嘉计划再次上调显卡售价:最高涨幅500元

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版