«
网站首页
反馈问题或建议
首页
园子
新 闻
博问
闪存
会员
周边
博客园
»
新闻
最新发布
推荐新闻
热门新闻
新闻评论
今日
昨日
本周
本月
0
突发,Claude刷新物理学世界纪录!单挑基于杨振宁理论9圈难题
新智元报道 就在刚刚,Anthropic 官宣,Claude 拿下了理论物理的一项前沿纪录。 它在几乎无人类干预的情况下,连续运行数天,一举攻克了高能物理学界出了名难算的「九圈散射振幅」计算难题! 具体来说,它算出了平面N=4 超杨-米尔斯理论里六粒子振幅的九圈结果,人类此前的纪录停在八圈。 注意,
0
五年前的一次选择,成了中国智能时代的王炸
新智元报道 2022 年 12 月,ChatGPT 的横空出世点燃了 AI 时代的烽火,人们一下发现,机器似乎真的拥有了智能。 「ChatGPT 时刻」就成了智能起点的代名词。然而这个算法,漏掉了一台中国的机器。 曙光 8000。 近日,央视大型纪录片《超级工程》再度回归,这一次中国算力基础设施走向
1
GPT-6开真车考过了科目二!
新智元报道 离大谱,大模型竟然第一次考过「科目二」了。 从没专门学过开车的 GPT-6 Astra,被强行塞进一辆真实的丰田卡罗拉里。 结果它自己看路、自己打方向,一路绕开锥桶,最后稳稳地开进了一块用锥桶围出来的「车位」。 方向盘在自己转,开车的是大模型 同一个赛场里还有 Claude Fable
0
终于!Claude Code额度用完,不再恶心砍断你代码了
新智元报道 终于,Claude Code,干了件人事。 就在昨天,Anthropic 开发者账号@ClaudeDevs 官宣:Claude Code 撞上 5 小时用量上限时,不再一刀切断(代码改到一半,对不起,没了,爱咋咋地)。 现在,它会先找一个体面的停点,把手上这一步做完,再停。 就这么一个改
0
啥题啊能干崩OpenAI最强模型训练…
文婷发自凹非寺 量子位 | 公众号 QbitAI 一道没搜出答案的找人题,竟然把 OpenAI 最强模型的相关训练干停了! 事情有多离谱呢?请看大屏幕——OpenAI 一款正在进行 RL 训练的内部研究模型,本来的任务是凭几份履历、博客定位某人。 常规搜索碰壁后,它没有放弃,竟把本该查地址的 DNS
0
OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网
新智元报道 「天网」中的一幕,正在现实上演。 一次训练中,OpenAI 逃逸的 AI Agent,已在整个互联网上植入了「自我复制的代码」! 当政客 Andrew Yang 在 CNBC 说出这句话时,很多人以为他疯了。 就在这两天,OpenAI 亲手发布了一份报告,标题非常简洁:《自我复制提示词注
0
8万段代码还原OpenAI智能体入侵HF!只能读网页,竟拼出攻击工具链
新智元报道 一场堪比黑客电影的 AI「越狱」大戏,让 OpenClaw 创始人、「龙虾之父」Peter Steinberger 忍不住也发出了惊叹。 现在我明白,为什么有些人会谈论 AGI 了。这也太巧妙了! 9 月 25 日,研究者 Jeffrey Ladish 等人公布了一份名为 Swarm T
0
刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!
新智元报道 Gemini 4 Pro,又曝出新的检查点了! 最近,两个全新检查点(内部代号「barium-b」或 Checkpoint 2)被开发者们发现了,实测后发现,Gemini 4 Pro 强得可怕! 有开发者直呼:「在爆肝 400 小时使用 Opus 5.5 和 GPT-6 之后,Gemin
0
震撼,Opus 5.5首次突破Dijkstra算法最短路径!
新智元报道 震撼,Opus 5.5 首次颠覆了 Dijkstra 最短路径算法! 就在刚刚,Vals AI 公布了一项足以载入计算机科学史册的重大突破。 他们让 10 个 Claude Opus 5.5 Agent 去挑战 CS 本科经典算法 Dijkstra,成功找到了一种更快路径。 对于所有学过
0
对标OpenAI!不会代码,也能跑Claude API
新智元报道 Anthropic,终于动手了。 就在刚刚,A/终于把用了快两年的开发者工具 Workbench,一刀砍掉,改名成了 Playground。 表面看,只是换了个名字。 但真正的变化是,Anthropic 正把原本偏工程化的 Claude API,做成一个普通人也能直接上手的可视化产品。
0
真怕了!OpenAI和Anthropic差点签下「互黑协议」
新智元报道 刚刚,The Information 爆出一记猛料。 OpenAI 和 Anthropic 这对硅谷最大的死对头,今年初差点坐到一张桌子上,签下一份互相攻击对方模型的协议。 协议的核心就是,双方互相开放 API,你来黑我的模型,我去黑你的模型。两边的律师连测什么、怎么测都写进了合同里。
0
智能也有「元素周期表」!人类和细菌同一格,最强AI还低一位
新智元报道 1869 年,门捷列夫把当时已知的 63 种元素排成一张表。 这张表最大胆的地方不在于填满的格子,而在于他刻意留下的空位。 他断言那里藏着尚未发现的元素,并预言了它们的性质。此后十余年间,镓、钪、锗接连被发现,性质与预言惊人吻合。 一张分类表,从此成了寻找未知的地图。 一个半世纪后,智能
0
GPT-6自己打开软件干活了!一张图纸长出3295个零件,一句话造出豪宅
新智元报道 GPT-6 Astra 发布没多久,就已经没人看榜单了? 不是跑分不好看,而是 OpenAI 变了套路,改成收作业了。开发者一看,行,那就交作业吧。 开发者 Tom Krcha 把一张旧蒸汽机车的图纸扔给 Astra,让它在 Blender 里重建。 几分钟后,Blender 里多出了
0
又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录
衡宇发自凹非寺 量子位 | 公众号 QbitAI 服都服了,又是哪家模型搞匿名啊,大过节的搁这儿杀出来冲榜?! 说的就是你,Space Bunny。 一个没留神,它在短短几天里经历了突然出现->突然热度飙升->突然干到 OpenRouter、OpenCode 双榜调用日榜第一->突然讨论热度也飙升。
0
Scaling意外涌现!万名智能体暗中抱团,智商领先GPT-6半年
新智元报道 Scaling 没死,只是换了一个方向! 就在最近,知名 AI 安全研究员 Lisan al Gaib 揭示了一个事实:AI 已经学会了背着人类,自己寻找 Scaling 的捷径! 在这个全新的 Scaling 体系下,单个智能体能用的算力,往往高达数百万 Token。而通过找到彼此、建
0
GPT-6 Astra学会用「空白Token」思考!推理能力突然变强
新智元报道 给 AI 一道难题,不许写解题过程,只准交答案。 答不出来怎么办? 在题目后面,加上一长串毫无意义的点。 就这么一个操作,GPT-6 Astra 在一项四跳推理测试中的准确率,从约 10% 升到了 50%。旧 AIME 数学题上的表现,也从约 60% 升到了 90%。 题目没变,没有补充
0
星舰第14飞,为什么准备绕地球六圈?
文 | 反熵 按照 SpaceX 目前的排期,星舰第 14 次试飞最快将在 9 月 28 日升空,发射仍需监管批准。 这一次,SpaceX 准备做一件过去 13 次试飞始终没有做的事情:把星舰真正送进能够持续环绕地球的轨道。 按照目前公布的方案,星舰上面级计划进入约 275 公里高的轨道,在太空运行
>
返回新闻首页