全部资讯

重置筛选
闻乐
闻乐
新版GPT Image 2.5已经能伪造GPT-6发布会了

新版生图模型GPT Image 2.5尚未正式发布,已有用户收到ChatGPT弹窗提示,版本号跳过2.1直接来到2.5。网传测试显示其能力大幅提升,已可伪造GPT-6官方发布会及奥特曼全员推文,生成图像中嵌入的文字几乎无破绽,多角色脸部一致性显著改善,并修复了GPT Image 2的噪点问题,生成速度极快。该模型疑似以luna-lisa-alpha为代号在LMArena匿名竞技场进行测试。ChatGPT网页版一度将生图功能提升至主目录第二位,仅次于"新聊天",显示生图将成为GPT-6时代的主打功能之一。

Marcus on AI
Marcus on AI
对GPT-6 Astra的初步评价

文章转述并评论OpenAI GPT-6 Astra在ARC-AGI测试中的表现:据ARC Prize分析,其在ARC-AGI-3得分约63%,借助新的供应商适配器框架可达99%,并在96%的关卡中超过人类;系统还据称会为陌生环境构建较精确、紧凑的符号世界模型。作者认可其可能代表真实进展,同时强调ARC-AGI成绩不等于实现通用人工智能,能力稳健性、真实开放任务表现、内部机制、可监控性及潜在风险仍有待验证。

莫崇宇
莫崇宇
刚刚,GPT-6 震撼发布!人类进入 AGI 大分工时代

OpenAI 正式发布 GPT-6 Astra,定位为迄今最智能、最贴合人类意图的模型,首次在德州 Stargate 基地以超 10 万张 GPU 进行预训练,并大量引入此前模型参与监督。Astra 的核心变化是 Computer Use 能力,可调用工具、操作软件、浏览网页,独立完成表单填写、CRM 更新、Blender/UE5 三维建模、KiCad PCB 设计、Ableton 音乐制作等任务;在 OSWorld 2.0、Agents' Last Exam、Terminal-Bench 4.0、DeepSWE v1.1、FrontierMath Tier 4、GPQA Diamond 等基准测试中均显著领先 GPT-5.6 Sol 和 Claude Opus 5。Codex 编程代理同步升级,支持跨上下文窗口保存笔记与搜索历史,并可在用户回复期间推进不依赖该回复的子任务。安全方面,Astra 达到 OpenAI Preparedness Framework 关键网络安全能力阈值,在 ExploitBench 满分并发现两枚未知 zero-day 漏洞,已向维护方披露,但文字推理过程

noreply@aihot.virxact.com (X:cb_doge (@cb_doge))
noreply@aihot.virxact.com (X:cb_doge (@cb_doge))
Grok 4.6 在多项基准上超过 OpenAI GPT-6 Astra (Max)

据 Artificial Analysis 数据,Grok 4.6 (High) 在多项基准上超过 OpenAI GPT-6 Astra (Max):Agentic Index 59 对 51,τ3-Banking 51% 对 41%,Non-hallucination 66% 对 49%,GDPval-AA v2 1,730 对 1,629。作者称 Grok 4.7 很快将到来。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtm6sdqr01rxrocws3n6xer0

noreply@aihot.virxact.com (X:AI Safety Memes (@AISafetyMemes))
noreply@aihot.virxact.com (X:AI Safety Memes (@AISafetyMemes))
Ryan Greenblatt称GPT-6 Astra不透明推理能力大幅跃升,链式思维监督或失效

Ryan Greenblatt称GPT-6 Astra在不透明推理上出现巨大跃升,能在不外显推理的情况下心算解出高难度竞赛数学题,而此前AI只能解基础应用题。他提醒基准结果可能受污染,并提到UK AISI发现Astra的monitorability明显更差;他猜测跃升源自增加串行深度的架构改动,若未来几代模型延续此类跃升,chain-of-thought将不再是有效的监督工具。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtm6pqhd01o7rocwtayjudjo

noreply@aihot.virxact.com (X:Emad Mostaque (@EMostaque))
noreply@aihot.virxact.com (X:Emad Mostaque (@EMostaque))
Astra 在 Stargate Texas 使用 10 万块 GPU 完成 train run

Emad Mostaque 称 Astra 在 Stargate Texas 使用 100k GPUs,用约两个月时间预训练,使其成为首个 10 亿美元规模的训练 run。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtm6384k015tro62qpbd936l

noreply@aihot.virxact.com (X:洪明 (@hongming731))
noreply@aihot.virxact.com (X:洪明 (@hongming731))
BestBlogs 早报 09-04:GPT-6 Astra 安全概览、曾鸣 AI 产业史观与 Meta 组织实践

BestBlogs 09-04 早报汇总十条内容,涉及 GPT-6 Astra 安全概览、Paul Graham 创业访谈、曾鸣 AI 产业史观、Codex 与 DeepSeek 的 Harness 开源对比、Meta 团队缩减计划与组织级第二大脑、NVIDIA 推测解码指南、通义 E-Commerce Bench、Google WeatherNext 3 和美团智播。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtm6384v015vro62edz3rxpe

noreply@aihot.virxact.com (X:洪明 (@hongming731))
noreply@aihot.virxact.com (X:洪明 (@hongming731))
BestBlogs 早报 09-04:GPT-6 Astra 安全说明、Paul Graham 与曾鸣访谈及七个应用案例

BestBlogs 早报 09-04 精讲三篇内容:OpenAI 发布 GPT-6 Astra 安全概览,称其为准备度框架中首个达到关键级网络安全能力门槛的模型,并说明越狱抵抗、失配监控与思维链监控的变化;Paul Graham 在 YC 访谈中谈 AI 改变信息获取与创业成本结构,算力成为新开支项;曾鸣以基础设施、应用探索与原生应用框架讨论 AI 产业与组织演进。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtm6384v015wro620j62rehg

noreply@aihot.virxact.com (Gary Marcus:The Road to AI We Can Trust(RSS))
noreply@aihot.virxact.com (Gary Marcus:The Road to AI We Can Trust(RSS))
Gary Marcus 评 GPT-6 Astra:进步明显但鲁棒性与可监控性存疑

Gary Marcus 发文点评 GPT-6 Astra,称多项报告显示其为真正的进步,OpenAI 产品显式创建并操纵符号世界模型,令其近十年的主张获得印证。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtm5q99n018rrow0z6je2l9y

加载更多资讯