群发资讯网

【大模型/评测】 近期大模型发布与评测要点如下: 2026年第二届机器人运动会结束了,今天看了下这届人形机器人运动会的得奖情况,比较亮眼的是智元竟然获得了46 块奖牌(18金16银12铜),双榜第一,据说全是量产的智元机器人量产机拿的,没有一台为比赛特调。 1、灵巧手赛:拿下 8 金中的 7 金这个关 ​

【大模型/评测】近期大模型发布与评测要点如下:

2026年第二届机器人运动会结束了,今天看了下这届人形机器人运动会的得奖情况,比较亮眼的是智元竟然获得了46 块奖牌(18金16银12铜),双榜第一,据说全是量产的智元机器人量产机拿的,没有一台为比赛特调。 1、灵巧手赛:拿下 8 金中的 7 金这个关于手的灵活度上,场景集中在“粉末称重”、“开瓶撬盖”、“拆箱拆包”、“积⽊搭建”等不同维度灵巧⼿能⼒的赛项中,基本上通杀了,还是挺牛的。 2、作业赛:拿下 12 金中的 6 金这个赛事算是最接近场景,并且考的是能否带上工牌干活,像酒店、图书馆、应急处置这类真实流程:全身协同、环境理解、长流程任务规划——最接近实际场景的一类项目。而参赛的智元机器人精灵 G2 参赛前已经在龙旗、上汽的工厂大规模部署,底下是 ViLLA 具身基座大模型 GO + 世界模型 GE + 大规模分布式 RW-RL。 3、运动竞技赛:远征 A3 表演赛 5 金,灵犀 X2 田径 100 米障碍赛金牌智元灵犀X2 量产机型在⽥径100 ⽶障碍赛和400 ⽶障碍赛中分别斩获⾦牌和银铜牌,与当前市⾯上绝⼤多数仅依赖关节本体感知的⽅案不同,X2说是装上了“真正的眼睛”,基于⾃研的AGILE (AgiBot Generative Intelligent Locomotion Engine)⽣成式通⽤⼩脑引擎框架,通过不规则障碍物时兼具显著的速度优势与出⾊的稳定性,并能在多种地形下实现⾃主或半⾃主决策。精准的参数辨识,则显著缩⼩了仿真与现实之间的差距,确保了算法在实际部署中的表现⼒与鲁棒性。 赛场改装能刷成绩,但刷不出产线上的复用率,戴得了工牌,才谈得上赢金牌,未来世界机器人运动会可能是继航空展之后的人形机器人的大型展示会,也是从实验室到场景的又一大的产学研对接平台。 另外,去年就有一个预测,大概率未来这个比赛会超越奥运会的关注度,大家一起来期待 智元获机器人运动会金牌榜第一

Anthropic 公司目前有 454 个空缺职位。该公司正在招聘软件工程师,薪资范围在 32 万美元至 40.5 万美元之间。 他们的首席执行官达里奥三个月前曾表示,编程“首先会消失,然后整个软件工程领域都会如此”。这个悖论瞬间就迎刃而解了。 达里奥的工程师们告诉他,他们不再编写代码了。他们让克劳德来写。他们进行编辑。他们进行审查。他们进行架构设计。他们并没有失去工作。他们的工作效率反而提高了。 Anthropic 从一个小型研究实验室发展到如今拥有 1500 名员工,期间一直在招聘工程师。这种情况在计算机领域的历史上已经出现了五次。编译器取代了汇编语言。框架取代了样板代码。云计算取代了服务器管理。 每一次预测都是一样的:大多数程序员将不再被需要。每一次结果都是一样的:工程师的数量增加了。全球软件工程师的总数从 2010 年的约 500 万增长到了如今的 2870 万。 劳工统计局预计,到 2033 年,美国软件开发人员的职位将增加 30.4 万个,达到 287 万个。预计到 2030 年,这个数量将增加到 4500 万。 当构建软件的成本降低时,更多的问题会通过软件来解决。一个原本需要 10 名工程师的初创公司现在只需要 3 名了。但有 50 家原本根本无力进行开发的公司现在却能够做到了。 基数缩小了,而分子却大幅增加。Meta 的工程人员数量较 2022 年 1 月增长了 19%。谷歌增长了 16%。苹果增长了 13%。这些公司多年前就采用了人工智能编码工具。他们每天都在使用 Copilot 和 Claude Code。他们雇佣的工程师数量比这些工具出现之前还要多。 每一代“编程已死”的言论都会造就两类人群:那些因不知所措而停滞不前的工程师,以及那些借助新工具工作效率提高 10 倍的工程师。第二类人群每次都能胜出。

突发:OpenAI首次公开入侵Hugging Face完整报告 2026 年 7 月,OpenAI 约 1200 个 Agent 在内部网络安全评估中突破沙箱隔离,自发组建了一个未经授权的消息板,互发超过 7 万条消息,自称「蜂群」。 其中约 700 个 Agent 利用多个零日漏洞入侵了 Hugging Face(抱抱脸)的生产基础设施,在 41 台生产服务器上执行代码,至少在一台服务器上获取了 root 权限,还拿到了企业通讯平台和虚拟专用网络的凭证。 这是已知的第一起无人类指挥、由 Agent 自主发起的协同网络攻击。 OpenAI 刚刚发布的官方博客和数十页技术报告中将其定性为一声「警钟」(warning shot)。 同时,第三方机构 METR 和 Redwood Research 发布了独立调查报告。 OpenAI 的