极客洞察

重置筛选
极客洞察
极客洞察
🎮 Claude 读 68000 汇编,重制 1993 年 Amiga 游戏到 Godot

原标题:《Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly》 评分: 246 | 作者: rabahs 💭 连 68k 汇编都能考古,人类还写代码干嘛? 🎯 讨论背景 Babylonian Twins 是一款 1993 年在 Baghdad 为 Amiga(80/90 年代流行的家用电脑平台)写成的游戏,这次讨论的核心是作者如何借助 Claude Code(Anthropic 的命令行编码代理)把它从 68000/68k assembly 重新搬到 Godot(一个开源跨平台游戏引擎)。作者把旧汇编源码、2010 年的 C ++ 版本、手写笔记和长期记忆一起喂给模型,让它解释逻辑、补素材并协助整理发布。评论里之所以不断提到 Copper、blitter、50Hz 帧率和 UAE(Universal Amiga Emulator,Amiga 模拟器),是因为 Amiga 时代的硬件和时序非常特殊,移植时既要保留手感,也要验证行为是否接近原版。这个故事还带着巴格达 90 年代制裁时期做

极客洞察
极客洞察
😡 Verisign 终止 .name 3LD 付费域名引争议

原标题:《.name Termination》 评分: 1598 | 作者: pavel_lishin 💭 付到 2040 的域名,原来是可随时收回的租房? 🎯 讨论背景 `.name ` 是 2001 年左右推出的 gTLD(通用顶级域),最初由 Global Name Registry(最早的运营方)管理,后来由 Verisign(大型域名注册局)接手。它一开始主要卖的是 3LD 形式的个人域名,比如 `john.doe.name `,并配套 email forwarding;多年后才开放 2LD,比如 `doe.name `。这次争议来自 Verisign 申请终止现存的 3LD 服务,让对应的 2LD 重新开放注册,大约影响 22,000 个已有域名。由于 DNS、浏览器 cookie、证书颁发和 Public Suffix List(公共后缀列表)都默认域名层级对应安全/管理边界,这种混合结构会把身份、解析和安全问题同时放大。 📌 讨论焦点 粗暴终止与合同违约 很多人把这次处理看成对已付款域名的 rug-pull:有人已经把注册期买到 2036/2040,却可能被提前终

极客洞察
极客洞察
🤔 Julia:MIT 项目走红为科学计算/HPC 语言,JIT 缓存仍争议

原标题:《How an MIT research project became a global programming language》 评分: 20 | 作者: theanonymousone 💭 连 JIT 缓存都没补上,就敢写全球语言神话? 🎯 讨论背景 这篇文章讲的是 Julia(起源于 MIT 的开源动态编程语言)如何从研究项目成长为被科学计算和高性能计算社区广泛使用的语言。评论把焦点放在它最有名的矛盾:运行时很快,但 JIT(即时编译)带来的首次启动延迟常常让脚本体验变差。有人提到 Julia 1.14 将加入会话间缓存,以及现有的 PkgImages(Julia 的预编译包镜像机制)是否已能解决部分问题。讨论还延伸到它和 R、Matlab、Lisp、Fortran 及 C 的定位差异,以及 MIT 和 JuliaHub(Julia 的商业公司)到底谁更该被写进成功故事里。 📌 讨论焦点 JIT 启动延迟与缓存体验 有评论认可 Julia 的速度和生态,但认为真正影响使用的是 DX:脚本本身只跑几十毫秒,却要先花几秒做编译。评论里提到缺少有效的 JIT 缓存是最致

极客洞察
极客洞察
🤔 coding agents 偏爱 grep:LSP 难配、易崩,还反向催生新工具

原标题:《Grep beats LSP? Why coding agents ignore your fancier tools》 评分: 22 | 作者: kaonashi-tyc-01 💭 有 LSP 还要 grep,难道这叫智能编程吗? 🎯 讨论背景 讨论起点是一篇文章,主张 coding agents(如 Claude Code,Anthropic 的命令行编程代理)在查找代码时常更爱用 grep、find 和 ripgrep,而不是 LSP(Language Server Protocol,语言服务器协议)。评论里很多人把焦点放到现实工作流:LSP 依赖 IDE、配置和本地索引,任何一个环节坏掉都会让 agent 回到最朴素的文本搜索。有人把这种经验延伸到 Emacs(高度可扩展的文本编辑器)和 Neovim(可脚本化的终端编辑器),认为文本搜索、模糊选择和本地索引更符合 LLM 的工作方式。另一部分人则从已编译依赖、JAR、bytecode 和反编译的角度解释为什么 agent 经常回退到 grep、javap 这类直接工具。文章和评论一起指向一个问题:更“高级”的语言

极客洞察
极客洞察
🤔 Heart Aerospace 首飞最大电动飞机:125 英里纯电、500 英里混动

原标题:《The largest electric aircraft just flew [video]》 评分: 240 | 作者: feb 💭 飞 125 英里后烧油,还算纯电吗? 🎯 讨论背景 Heart Aerospace(YC W19 的瑞典电动飞机创业公司)这次公开飞行的是 X1 演示机,而不是其计划中的 ES-30 商业机型。X1 走的是纯电路线,ES-30 则设计成 30 座级 regional aircraft(支线飞机),纯电约 125 英里,混动约 500 英里。混动部分依赖两台由 sustainable aviation fuel(SAF,可持续航空燃料)驱动的 turbo generators,用来覆盖 reserve 和 diversion(备降)需求,因此评论里一直在讨论这到底算不算“电动飞机”。这场讨论也反映了航空业的老难题:battery energy density(电池能量密度)仍然很难与 Jet-A 燃油相比,但 clean-sheet airframe(从零开始设计的机体)和更简单的 electric propulsion(电推进)可能让短

极客洞察
极客洞察
🤨 17k 次实测:Claude Code、Codex、Cursor 选工具差异与 SEO 化争议

原标题:《Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out》 评分: 137 | 作者: screm 💭 以后让 Agent 推荐产品,也要先买广告位吗? 🎯 讨论背景 这篇帖子来自 Armature(YC P26 创业公司,一家面向 dev tools 的增长服务商)发布的一项研究,作者称自己在一个尽量接近真实工作流的环境里跑了近 17k 次 session,观察 Claude Code(Anthropic 的 coding agent)、Codex(OpenAI 的 coding agent)和 Cursor(AI code editor)在不同仓库、不同人物设定下会选哪些工具。评论默认读者已经熟悉这些 coding agent 会调用 web search、文件编辑和 shell 工具,也熟悉它们在开发流程里越来越像“决策者”而不只是补全器。很多人补充说,工具选择不只取决于模型,还可能被 system prompt、tool instructions、仓库上下文和

极客洞察
极客洞察
😟 德州神秘肾病:高温农工、脱水与毒素猜测

原标题:《A Mysterious Kidney Disease Has Arrived in Texas》 评分: 30 | 作者: johntfella 💭 难道高温、脱水、毒物都不算任何线索吗? 🎯 讨论背景 这篇讨论围绕 Texas(美国德州)一篇关于“神秘肾病”的报道展开,指向的是在高温环境下工作的 Latino field workers(拉丁裔农场工人)中出现的慢性肾病。评论里反复提到 CKDu(慢性肾病不明原因)这种在 Sri Lanka、India 等地也见到的模式,暗示它并不局限于某个族群,而更像是热、脱水、体力劳动和环境暴露叠加后的职业病。有人把注意力放在 pesticides、herbicides、nitrites 等农业化学品上,也有人强调 Texas 的劳动保护和高温监管不足。另一个现实背景是医疗可及性:这些工人未必有稳定的血检、尿检或专科诊断路径,因此疾病往往在晚期才被发现。 📌 讨论焦点 高温工地/农场作业导致的慢性肾损伤 不少评论认为,这更像是长期高温作业引发的职业性肾损伤,而不是真正“神秘”的疾病。有人分享自己在炎热地区从事建筑工作的经历,提到

极客洞察
极客洞察
😄 《Unusual Suspects》:猜画乐趣、CLIP 评分与追踪弹窗

原标题:《Unusual Suspects》 评分: 131 | 作者: beeperboy95 💭 Cinnamoroll 都 88% ,这评分是抽签吧? 🎯 讨论背景 《Unusual Suspects》是 neal.fun(一个以创意浏览器小游戏闻名的网站)上的一款网页游戏,玩家根据角色提示进行涂鸦,系统再按相似度给出分数。评论里很多人把它看成“猜画”或“画图识别”游戏,重点不在画得像不像,而在能否抓住目标角色的关键特征。围绕评分机制,大家猜测它可能用了 CLIP(图文对齐模型)或 embedding(向量表示)来比较用户涂鸦和目标图像。与此同时,讨论也延伸到移动端操作、Firefox on Linux 卡顿、自动播放音频,以及 Google 同意弹窗和追踪脚本等网站层面的体验问题。 📌 讨论焦点 搞笑猜画与涂鸦反差 很多人把这款游戏当成纯粹的搞笑体验,核心乐趣来自自己潦草的手绘和真实角色之间的巨大反差。有人把它类比成 Telestrations(接龙画图桌游),认为这种“画出来再揭晓”的机制天然适合制造荒诞感。评论里举了不少例子,比如把 Mr. Peanut 画成“芥末罐

极客洞察
极客洞察
😬 GPT-6 Astra:ARC-AGI-3 高分、harness 争议与 AGI 论战

原标题:《GPT-6 Astra》 评分: 1436 | 作者: kibae 💭 把自家 harness 调好就能宣布 AGI 了? 🎯 讨论背景 这次讨论围绕 OpenAI 发布的 GPT-6 Astra 展开,官方把它定位为面向 ChatGPT、Codex、API 和企业用户的新一代模型,并给出了 ARC-AGI-3、DeepSWE、ExploitGym、SRE-Bench 等多项高分。争议核心在于 ARC-AGI-3(Fran çois Chollet 设计的第三代抽象推理基准)是否被 OpenAI 自家的 Responses API harness 和 compaction 机制“放大”了分数,而不是单纯反映模型本体能力。系统卡里关于 CoT、monitorability、sandbagging 和 sabotage tasks 的描述,又让安全与 deception 话题迅速升温。评论区同时把 OpenAI 之前对 AGI 的各种说法(远程同事、most economically valuable work、novel physics)拿来反复对照,试图判断这次到底是能力

极客洞察
极客洞察
🤔 K2 Horizon 号称全开源,评测与版权争议并起

原标题:《K2 Horizon: Frontier Performance, Radically Open》 评分: 268 | 作者: karimf 💭 先设登录墙,还叫 Radically Open? 🎯 讨论背景 K2 Horizon 是 IFM(看起来与 UAE 的 Mohamed bin Zayed University of Artificial Intelligence 相关)的新一代 LLM 系列,主打 frontier performance 和“radically open”。发布页、Hugging Face(模型与数据集托管平台)和 GitHub(代码托管平台)里能看到不同尺寸的模型、数据集和部分代码,但有人指出 pre-training / post-training 仓库仍有 placeholder,完整 recipe 可能还没补齐。讨论因此迅速转向:什么才算真正 open,是否必须连 training data、数据来源和处理流程一起公开,以及这会不会撞上 copyright、privacy 和 license 的现实限制。评论还拿 OLMo(Allen

加载更多资讯