全部资讯

重置筛选
infinitum 资讯聚合
infinitum 资讯聚合
Nvidia与CrowdStrike推出SafeMind网络安全模型

Nvidia和CrowdStrike推出名为SafeMind的新型代理式AI模型系列,能够同时为客户发现并关闭攻击路径,标志着AI在网络安全自动化方面的新进展。

infinitum 资讯聚合
infinitum 资讯聚合
大模型智能与成本评估的误导性

文章指出ArtificialAnalysis发布的智能与成本散点图具有误导性:成本轴采用对数刻度,无法体现便宜模型与重型模型之间的巨大价格差异,也不能反映便宜模型之间几乎可忽略的价格差别;同时该图以数据中心价格列出开源模型,显著高于本地硬件运行成本。对于多数不需要前沿智能的用户而言,中国开源模型已足够。

infinitum 资讯聚合
infinitum 资讯聚合
Meta推进Muse代理超级应用及Ava模型

Meta距离推出代理超级应用Muse更近一步,目前已开放iOS版本候补名单。桌面应用新增计算机使用设置,公司似乎正在测试支持计算机控制的模型变体Ava。

infinitum 资讯聚合
infinitum 资讯聚合
世界模型:AI的下一赌注

世界模型有望成为下一代重要AI范式,帮助系统表征环境、预测结果、模拟可能性、规划与行动。三位AI领军人物Yann LeCun、Demis Hassabis和Fei-Fei Li的趋同表明,围绕面向决策而非仅仅面向生成的模型正在形成越来越强的势头。

infinitum 资讯聚合
infinitum 资讯聚合
Claude文件水印检测工具上线

Anthropic推出工具用于识别Claude在生成文件时所使用的文本水印,帮助用户验证文件是否由Claude创建。

infinitum 资讯聚合
infinitum 资讯聚合
前OpenAI Stargate高管Hemani加入Anthropic

前OpenAI高级数据中心员工Shamez Hemani今年4月离开OpenAI加入Meta的专项计算团队,现已成为Anthropic技术团队成员,职业轨迹短暂辗转于三大AI公司。

infinitum 资讯聚合
infinitum 资讯聚合
TxBench-AB:抗体发现AI基准

TxBench-AB是一项新颖的AI基准,用于评估大语言模型在生物医学研究中的有效性,特别聚焦抗体发现领域的能力测试。

infinitum 资讯聚合
infinitum 资讯聚合
构建可靠的智能体harness架构

文章详细阐述了智能体harness的架构设计,涵盖状态管理、运行时、控制平面、推理、工具、接口和语言选择等模块,核心论点是不可避免的复杂性应由核心抽象吸收,而非不断推给扩展和用户。

infinitum 资讯聚合
infinitum 资讯聚合
测试时训练:新的扩展轴探索

测试时训练作为模型开发中诱人的"新扩展轴"概念,能在推理阶段持续学习以解锁模型效能提升。新研究发现了若干令人兴奋的技术,但持续学习问题仍未解决。

infinitum 资讯聚合
infinitum 资讯聚合
OpenAI披露Astra采用循环深度技术能力跃升引安全担忧

多家来源共同指向 OpenAI Astra 模型采用「循环深度」技术 这一事件。该技术使模型在 Transformer 块中重复使用层,在不增加参数量的前提下扩大模型容量,并在输出下一个 Token 前于潜在空间中反复处理内部状态,以更少文字完成更多计算。Astra 在内部 V8 高危漏洞测试中实现 100% 任意代码执行成功率,发现并利用两个未知零日漏洞,完成浏览器沙箱逃逸与操作系统 root 权限提升,成为首个达到 OpenAI「关键级」网络安全能力门槛的模型。能力飞跃的同时引发安全专家担忧:若更多推理从思维链转移至不可读的激活状态,依赖思维链监控的安全体系可能被削弱。OpenAI 首席科学家 Pachocki 承认监控脆弱性正在恶化,并表示当前版本仍保留可见思维链。Astra 已推迟部分发布以加强训练与权限管控,最强网络安全能力将仅限少量测试者使用。 相关文章: OpenAI Astra为循环Transformer模型 - TLTD OpenAI Astra被曝引入「循环深度」能力飙升!安全专家坐不住了 - 机器之心

加载更多资讯