智能AI None OpenAI推理之父掀桌:AI真·满血的样子,你没钱见! 新智元报道 【新智元导读】 OpenAI o1推理模型核心缔造者Noam Brown发长文炮轰整个行业:用单一跑分评价AI模型,从2024年就过时了。控制推理预算后再看,那叫一个天壤之别。OpenAI的Noam Brown,刚刚发了一篇长文 GPT benchmark Brown 2026-06-11 新智元
智能AI None ChatGPT突然改版!奥特曼:IPO不着急 新智元报道 【新智元导读】 GPT-5。6本月上桌,agentic编码据称已反超Anthropic Mythos。三家旗舰模型撞进同一个6月,两大AI巨头同时冲刺IPO,奥特曼却在内部抛出了一个更大的变量:如果AI先学会自我改进,上市反而不 GPT Anthropic OpenAI 2026-06-11 新智元
智能AI None 刚刚,人类首个神话级克劳德5正式解禁! 新智元报道 【新智元导读】 藏了两个月说「太危险」的Mythos 5终于解封。ASI级「神话」,今夜降临。Anthropic今夜「双连发」。就在刚刚,Claude Fable 5和Claude Mythos 5同时上线。那个被Anthrop Fable Mythos Claude 2026-06-10 新智元
开发者生态 None 同时接入 GPT、Claude、豆包多个大模型,维护成本和账单太头疼,统一 API 网关靠谱吗? 同时接入 GPT、Claude、豆包多个大模型,维护成本和账单太头疼,统一 API 网关靠谱吗。我们团队在做 AI 智能助手项目,场景比较复杂——推理深的用 Claude,中文友好场景用豆包,日常 FAQ 用 GPT。之前各家官方 API API GPT Claude 2026-06-08 聪明伶俐的鞭炮_eMBOh1
开发者生态 None DeepSeek V4 Pro 在精度上击败 GPT-5.5 Pro 【HN用户评论摘要】 These tests are looking increasingly like a waste of time。The "intelligence" is clearly there now。Trying to m the and for 2026-06-08 yogthos
智能AI None 向 GPT-Rosalind 引入新功能 GPT-Rosalind advances life sciences research with enhanced biological reasoning, medicinal chemistry expertise, genomics GPT Rosalind advances 2026-06-07 OpenAI博客
智能AI None 人类偷跑代码又秒删,GPT-5.6震撼升级决战神话! 新智元报道 【新智元导读】 GPT-5。6发布候选版本kindle-alpha敲定,前端和视觉能力大幅跃升。与此同时,Claude Mythos 5在API中闪现又秒删。Anthropic与OpenAI狭路相逢 ,AI史上的「诸神黄昏」提前 Mythos GPT OpenAI 2026-06-07 新智元
智能AI None Claude Opus 4.8实测封神!强到离谱,也贵到肉痛 新智元报道 【新智元导读】 传说中的Claude Opus 4。8,性能真的如此强大吗。有人高呼封神,直言这是Opus 5,有人吐槽太拉了,还不如Opus 4。Anthropic王者归来。深夜,Anthropic全新发布Claude Opu Opus Anthropic Every 2026-05-29 新智元
智能AI None 认知分类变压器:语言建模的分类理论归纳偏差 arXiv:2605.28864v1 Announce Type: new Abstract: The Cognitive Categorical Transformer (CCT) is a 306M-parameter architec the that and 2026-05-29 Al Kari
智能AI None 刚刚,Claude Opus 4.8来了!两个史上首次改写历史 新智元报道 【新智元导读】 Opus 4。7发布刚43天,Opus 4。编程实力暴增,全面霸榜。Claude Code一口气放出上百个agent并行干活,一个人11天就能重写75万行代码、99。更狠的Claude Mythos,几周后就来。 Opus Claude Anthropic 2026-05-29 新智元
智能AI None GPT-5.5彻底击穿300个黑客评测任务,仅需5000万Token! 新智元报道 【新智元导读】 GPT-5。5 把进攻性网络安全最难的 7 个基准全部打穿,92。4% 正确率,评估体系直接失灵。AI 黑客能力每 6 个月翻一倍,而衡量它有多危险的尺子,已经先被干碎了。316 道进攻性网络安全任务,GPT-5 GPT 网络安全 小时 2026-05-28 新智元
智能AI None Warp 押注于使用 GPT-5.5 构建开源 Warp uses GPT-5。5 and OpenAI models to coordinate coding agents across local, cloud, and open-source development workflo and Warp uses 2026-05-27 OpenAI博客
开源推荐 None GitHub 热门项目:minbpe GitHub项目:minbpe 仓库地址:https://github。com/karpathy/minbpe Stars:10503 | 作者:karpathy 项目描述:Minimal, clean code for the Byte the minbpe and 2026-05-27 GitHub Trending
智能AI None 实锤!GPT-5.5「降智」被抓,OpenAI官方文档认了 新智元报道 【新智元导读】 GPT-5。5被扒出「假思考」,用两小时就被偷偷换成mini,200美元月费买了个「薛定谔的脑子」。Trace命令实锤,官方文档亲自认领。往后有纷纷吐槽:OpenAI,你糊弄谁呢。ChatGPT又被爆「降智」了。 GPT OpenAI Codex 2026-05-27 新智元
开发者生态 None DeepSWE:长视野编码剂的无污染基准 DeepSWE is a long-horizon software engineering benchmark that delivers four major advances over today's public benchmark gpt xhigh gemini 2026-05-27 ammar_x
开源推荐 None GitHub 热门项目:GPT-Prompt-Hub GitHub项目:GPT-Prompt-Hub 仓库地址:https://github。 and engineering prompts 2026-05-26 GitHub Trending
智能AI None 刚刚,中国AI闯入全球编程前二!前面只剩Claude 新智元报道 【新智元导读】 Code Arena最新放榜,Qwen3。7-Max以1541分冲进全球第四,成为前五中唯一的非Claude模型。编程,中国模型第一次杀到这个位置。就在今天,Code Arena最新榜单出炉。7-Max以1541 Qwen Max Opus 2026-05-26 新智元
智能AI None 约 1000 行代码搭起网页 AI 智能体:微软 Webwright 让 GPT-5.4 跑分提升 81% IT之家 5 月 26 日消息,微软研究院本月发布开源网页智能体框架 Webwright, 让 AI 模型在终端里编写 Playwright(浏览器自动化库)代码、执行 bash 命令、查看日志并反复修正。 Webwright 命令 Runner 2026-05-26 IT之家
智能AI None OpenAI GPT-5.6模型曝下月发布:AI上下文 150万代币 IT之家 5 月 26 日消息,多名开发者在 OpenAI Codex 后端日志中发现未官宣模型 GPT-5。6,内部代号为 iris-alpha, 将支持 150 万上下文窗口,有望今年 6 月发布。在本次曝光的 GPT-5。6 系列模型 GPT alpha 月发布 2026-05-25 IT之家
智能AI None GPT-5.6泄露了! 新智元报道 【新智元导读】 最近,GPT-5。150万Token+神级极简UI,下月紧急上线,奥特曼的「超级智能体」要掀翻整个硅谷。6月AI大战,已经提前爆发了。全网都在盼的OpenAI新模型——GPT-5。5发布仅仅过去三周,就在昨天,整 GPT OpenAI gpt 2026-05-25 新智元