postinstall 脚本早就应该被移除了,它就是 NPM 软件包的毒瘤。依赖深处存在大量不受控制的 postinstall,只要拉取一些东西,它们就会随机运行,简直荒谬。我不知道当初怎么会有人认为这是一个好主意。
JetBrains描述了在开发相关支出在六个月内大约增长十倍后,如何开始集中管理AI的使用。公司没有强制工程师仅使用少数已批准的工具,而是构建了一个共享的访问与记账层,既保留工具选择,又为团队提供更好的消耗可见性与控制能力。
今天上午,OpenRouter 没有举行发布会,也没有公布技术报告,只用一个忍者表情放出了一款代号为“Ox Alpha”的神秘模型。“Ox”在英文中正有“牛”的意思,于是,一场属于 AI 行业的“牛来”也开始了。
J-Space Cognition Suite 是一套不修改 DeepSeek V4-Pro-0813 权重的推理时 Harness,宣称可提升其在 Agent Benchmark 上的表现。当前所有性能数据均未获第三方复现验证。该项目与 ...
“Anthropic 堪称 AI 界的‘苹果’,尽管价格最高,却攫取了最多的收入。”有人这么评价 Anthropic 。但另一方面,用户的体感是:“做 Anthropic ...
在 OpenAI 披露其模型在 ExploitGym基准测试期间逃逸沙箱之后,Anthropic 开展了一项回溯审计,覆盖 141006 次评估运行。调查评估了多项进攻性基准测试的历史测试,包括 Cybench、CyberGym和 ExploitBench,重点检查了在第三方评估合作伙伴 Irregular 提供的环境中执行的运行。审计发现了三起不同事件,涉及六次评估运行。在这些运行中,由于出口路 ...
AI 对于简短、定义明确的任务确实有用,但随着复杂性增加,收益会迅速消失,瓶颈也会向上游转移至代码审查环节,而这恰恰是高级工程师判断力发挥作用的地方。在真实的开源项目中,AI 生成的 15 个 PR 没有一个可以合并,尽管它们都通过了自动化测试。AI ...
大多数数据工程师都试过把一个 Coding Agent 指向自己的 SQL,然后得到一些“看起来有用”的结果。样板代码变少了,搭架子更快了,信号很明确:Agents 和数据工作天然是契合的。但很快就会出现一种更难描述的挫败感,问题不在模型本身,而在于 ...
一个尚未发布的模型,已经具备接近“关键级”的网络攻击能力,另外一边,已经有一个内部模型则在安全测试中逃出沙箱、利用零日漏洞入侵了 Hugging Face。面对能力增长超出安全设施承载范围,OpenAI 暂停了部分强化学习训练。 2026 年 8 月 ...
KCD Hangzhou 2026 将于 11 月 28 日在杭州举办,即日起面向社区征集演讲议题,截止时间为 9 月 30 日。 杭州是阿里巴巴和 DeepSeek、宇树科技等多家人工智能企业的诞生地,也是全国首批"国家新一代人工智能创新发展试验区 ...
Cloudflare 发布了一项开发者预览功能,允许任何网站通过一个面板开关启用 WebMCP(Web 模型上下文协议)接口。这使得基于浏览器的 AI ...
责任声明:文章观点、理论体系及最终内容由作者负责;AI 参与讨论、推演、表达优化及部分内容生成。 研究说明:知识驱动计算(Knowledge-driven Computing, KDC)是我们正在提出和持续打磨的一套 AI ...