#waic2026# 上海AI实验室的《科学智能前沿》论坛,有几个观点让我印象特别深。
过去这一年,大家最大的感受可能都是:AI写代码越来越强了。
现场也放了一组数据:SWE-bench成绩已经从早期不到5%,一路提升到超过88%,很多主流大模型已经能够完成接近一半的软件工程任务。Coding能力几乎是一路指数级增长。
但另一边,Science(科学发现)的进展,却没有那么乐观。
无论是NatureBench还是SGI-Bench,目前的大模型在真正需要提出科学假设、设计实验、发现规律这些任务上,能力依然有限。
现场用了一个词形容:信号已经出现“一冷一热”。
为什么?因为现在的大模型主要还是在学习已有知识。而真正的科研,需要创造未知知识。#2026世界人工智能大会# 上海






