安全关键场景」共找到 3588 篇相关文章

新闻资讯7

中国芯片迎来关键一战

自2020年华为麒麟芯片断供,中国芯片加速自主研发,2025年末集体冲刺上市。如摩尔线程、沐曦股份等,虽多数亏损,但市值狂飙。不过,国产GPU面临技术、生态等挑战,崛起需漫长蛰伏与突破。

芯师爷
产品应用7

太野了!某龙虾自爆安全漏洞

国内几家厂商上线基于 OpenClaw 的 Claw AI Agent 产品,功能强大。作者测试其中一家,发现它轻易暴露大量信息和安全漏洞,如 Claude API 代理无认证、IMDS 元数据服务无防护等。建议相关厂商自查加固。

AGI Hunt
新闻资讯8

50+ 当下 Agent 关键数据与发展趋势预测

index.dev报告整理50+条AI Agent统计数据,涵盖采用率、市场规模等。介绍技术栈各层级,如开发者层提升编码效率,知识工作者层辅助办公。还提及企业采用趋势、用户交互变化、市场规模增长等内容。

特工宇宙
新闻资讯8

HBM Roadmap和HBM4的关键特性

文章介绍 KAIST TERALAB 公布的 HBM 技术,涵盖 HBM 路线图和 HBM4 特性。HBM 路线图展示从容量升级到计算存储融合的进化,HBM4 在电气规格、封装冷却、架构等方面有突破,AI 工具也用于研发。

芯师爷
推荐文章7

Anthropic8张图,揭示Workflow & Agent的协作场景

文章借Anthropic的阐述,区分了Workflow与Agent概念。指出任务明确用Workflow,开放式问题用Agent,还介绍了构建blocks、workflows方法及Agent工作方式和实施原则。

CourseAI
推荐文章8

Harness is the New Dataset:模型智能提升的下一个关键方向

文章指出当基模能力成熟,决定 agent 上限的是围绕模型搭建的系统,即 harness engineering。介绍其组件、设计原则,探讨模型与 harness 关系,还列举创业机会项目,最后推测下一范式是 Coordination Engineering。

海外独角兽
开源动态7

AgentIF-OneDay 发布,评估全场景长时复杂任务

红杉中国 xbench 发布 AgentIF - OneDay 评测体系,用于评估大模型解决复杂任务的能力。该体系从任务复杂度新视角出发,沿 Scaling Context 和 Scaling Domain 推进,构造了三类典型任务进行测评,揭示了主流 Agent 的能力边界。

特工宇宙
算法论文8

智能体并非越多越好,45%准确率成关键拐点

Google研究《Towards a Science of Scaling Agent Systems》验证“智能体并非越多越好”。在GPT等上实验发现,单个智能体准确率超45%,增加数量会损性能,还揭示工具税、错误螺旋等问题,给出预测公式。

AI工程化
新闻资讯7

IROS 关键圆桌:到底应该模型驱动,还是数据驱动?

10月20日,美团在IROS大会期间举办学术年会,多位嘉宾围绕具身智能商业化等议题展开探讨。圆桌嘉宾就第一性原理、软硬件体系、模型与数据驱动等话题各抒己见,还谈及机器人最终形态并勉励年轻人。

AI科技评论
算法论文8

关键突破:理论验证了 RL for LLM 路线的可行性

传统RLHF依赖人工标注偏好数据训练奖励模型,成本高且难扩展。本文发现任何通过Next - token预测训练的LLM内部隐含通用奖励模型,从理论和实验证明其可高效实现模型对齐。

深度学习自然语言处理