布拉格经济大学研究员托马什·布鲁克纳发现,通过让模型反复输出1到100的随机数,可生成独一无二的"行为指纹"。对165个模型各问30次后发现,GPT-4o偏爱42和37,Claude Sonnet 5疯狂输出47,Qwen3-Max则30次全部回答42。该方法仅需约120条请求即可识别模型身份,错误率约10.6%,为验证API是否被偷换模型提供了轻量级方案。 🔗 阅读原文:https://mp.weixin.qq.com/s/pqFZreEZj8kB4KDirl4MSQ via AI HOT · https://aihot.virxact.com/items/cmrtyvkng3voibihzero6pry1
前沿・资讯
聚合优质信息源,掌握技术前沿动态
AI HOT
智谱已完成一座 1 吉瓦大型 AI 数据中心的建设,全部采用中国国产芯片,旨在替代受限的英伟达芯片以开发其 GLM 平台。该中心已部分运营,智谱现已建成或运营多个配备超 1 万块芯片的计算集群,成为国内 AI 公司建设的最大规模服务器枢纽之一。智谱近期通过香港 IPO 筹集数十亿美元,年度经常性收入有望达 10 亿美元。 🔗 阅读原文:https://www.ithome.com/0/979/301.htm via AI HOT · https://aihot.virxact.com/items/cmrtzwmzg4579bihzk01uy448
我们刚刚为 Gemini Batch API 完成了一些重大的基础架构升级: - p95 延迟降低 80% - p99 延迟降低 68% - 批量成功率现已超过 99.998% - 批量过期减少 98% - 新增对部分批次的支持 团队完成这项工作太棒了!! 🔗 阅读原文:https://x.com/OfficialLoganK/status/2079367218438324367 via AI HOT · https://aihot.virxact.com/items/cmrtxrtqw3nuxbihzed4uljht
有WAIC参展商将招聘展架置于展台核心位置,与核心技术产品并列展示,直接在现场招揽人才。这反映出AI行业人才争夺已从线上招聘转向行业一线场景。核心策略包括:通过行业展会场景直接筛选有热情和认知的候选人,以技术产品实力作为招聘背书,以及主动到行业峰会、开源社区等人才聚集地拦截优质人才。 🔗 阅读原文:https://x.com/AYi_AInotes/status/2079366911922762031 via AI HOT · https://aihot.virxact.com/items/cmrtxuwfb3or8bihzdi5rwanw
微软计划 2026 年年底前,面向 Windows 10/Windows 11 经典版 Outlook 推送 Copilot 更新,整合"起草电子邮件"功能。该功能基于 Copilot,用户可在写信框内启动 AI 新建或编辑草稿,届时将邀请 Microsoft 365 Copilot 许可证用户参与体验。 🔗 阅读原文:https://www.ithome.com/0/979/297.htm via AI HOT · https://aihot.virxact.com/items/cmrtxrh023nrqbihzazls3get
美国法官批准 Anthropic 向书籍作者支付 15 亿美元和解金,这是美国版权案中已知的最大和解金额。案件源于作者起诉 Anthropic 使用盗版书籍训练 Claude,法官裁定训练书籍属于合理使用,但存储超 700 万本盗版书籍构成独立侵权。91% 的受覆盖作者已领取赔偿,部分作者认为金额过低并选择继续诉讼。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2079366110722556089 via AI HOT · https://aihot.virxact.com/items/cmrtxs6at3nx1bihzasjp59ho
一项实验证明,将任务分解为规划者与执行者的树状结构后,代理群在四小时内用 Grok 4.5 达到 80% 的 SQL 测试通过率,而旧版代理群在第二小时前即失败。新系统峰值提交速度达每秒 1,000 次,为此团队从零构建了专用版本控制系统。该架构已在构建浏览器、修复漏洞及生成数十亿 token 合成数据等任务中验证。 🔗 阅读原文:https://cursor.com/blog/agent-swarm-model-economics via AI HOT · https://aihot.virxact.com/items/cmrtxsl2e3o24bihzutblssoo
一项实验证明,将任务分解为规划者与执行者的树状结构后,代理群在四小时内用 Grok 4.5 达到 80% 的 SQL 测试通过率,而旧版代理群在第二小时前即失败。新系统峰值提交速度达每秒 1,000 次,为此团队从零构建了专用版本控制系统。该架构已在构建浏览器、修复漏洞及生成数十亿 token 合成数据等任务中验证。 🔗 阅读原文:https://cursor.com/blog/agent-swarm-model-economics via AI HOT · https://aihot.virxact.com/items/cmrtxsl2e3o24bihzutblssoo
作者筛选了GitHub上九个学术科研Skill,按"夯、顶级、人上人、NPC"五档排名。Academic Research Skills通过四库交叉验证引用,能拦截AI编造的假引用;Claude Scholar可连接Zotero和Obsidian批量导入论文并自动生成结构化笔记;nature-skills能将中式英语论文润色至接近Nature发表水准。 🔗 阅读原文:https://mp.weixin.qq.com/s/v_RzRaiYc-Yk4X8d1WhzWg via AI HOT · https://aihot.virxact.com/items/cmrtxg42y3k5kbihzm699azbp
领先开源模型与闭源前沿的差距已从2025年大部分时间的6-10个月缩短至仅4-7个月。Kimi K3在自主法律工作基准上几乎翻倍领先Claude Fable 5,并修复了15个Codex和Fable因"网络护栏"拒绝处理的关键安全漏洞。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2079363814194339855 via AI HOT · https://aihot.virxact.com/items/cmrtxs6at3nx2bihzmm6wkcsc