自注意力机制」共找到 1944 篇相关文章

新闻资讯7

美议员联合施压:拟对华芯片设备出口管制再升级!

本周美国众议院多位议员致信国务院与商务部,呼吁加强对华晶圆制造设备出口限制。新提案禁止向中国出售无法本地生产的设备,还限制售后维修,要求施压盟友建立多边禁运机制

芯师爷
新闻资讯8

谷歌重回铁王座!Gemini 3吊打GPT-5,奥特曼发信承认技不如人

谷歌携Gemini 3和Nano Banana Pro强势回归AI王座,连奥特曼都承认谷歌「反超」。谷歌逆袭原因多样,创始人布林回归打破「大公司病」,CEO劈柴推动「AI优先」,还有研TPU提供算力保障。

新智元
开源动态7

让龙虾越用越聪明!普林斯顿大学为OpenClaw搞了个强化学习框架

普林斯顿大学研究团队发布强化学习框架OpenClaw - RL,能捕捉用户反馈与环境结果信号,有独立解耦异步机制,融合打分与文本指导,经真实场景验证效果良好,蹚出我进化新路径。

AIGC开放社区
开源动态8

告别Transformer,重塑机器学习范式:上海交大首个「类人脑」大模型诞生

上海交通大学团队发布首个「类人脑」大模型 BriLLM,脱离传统 Transformer 架构限制。它基于 SiFu 学习机制,有可解释性、能无限处理上下文等优势,还支持多模态融合,已获交大重点项目资助。

机器之心
算法论文7

正确答案 ≠ 正确推理,CoT 或成大模型推理能力停滞的「罪魁祸首」?

研究指出当前大模型推理能力评估多关注答案准确性,忽视推理步骤。通过对前沿模型测试发现,2023 - 2024 年大模型推理能力提升停滞,进步靠提示工程,底向上策略最有效。

AI科技评论
新闻资讯7

AI Agent 是长期运行的“风险系统”,如果你还只在防 Prompt Injection,说明已经落后一代了

AI安全公司CyberArk首席软件架构师Niv Rabin团队提出基于“指令检测”与“历史感知校验”的方法,防御大语言模型和AI Agent恶意输入与历史投毒攻击,介绍多种防御机制

InfoQ
推荐文章7

第 3 章 Agent 核心功能技术详解

本章以Claude Code及其生态为主参照,介绍现代Agent平台提供类似‘操作系统’机制,包括命令、记忆等。面向熟悉Python与LLM的开发者,按是什么、解决什么问题等展开,还分析了Agent工程核心挑战。

CourseAI
算法论文8

98%准确率!这个双分支AI模型,精准识别木薯叶病害(附代码)

2026年3月论文DenseSwinV2提出双分支AI模型,结合CNN与Transformer,加通道注意力模块突出病害特征。该模型分类木薯叶病害准确率达98.02%,还给出简化版代码,有落地价值。

机器学习AI算法工程
新闻资讯8

OpenAI深夜发布ChatGPT Agent:能主动思考、选工具,智能体赛道大变天

今天凌晨1点,OpenAI发布ChatGPT Agent,它能主思考行动,选工具完成复杂任务。首席执行官Sam Altman发文介绍,虽实用但有风险,内置安全机制。测试中表现优异,网友期待体验。

AIGC开放社区
新闻资讯8

Dario访谈首曝:Mythos被称为「超级武器」

Bloomberg主持人与Anthropic CEO Dario Amodei进行69分钟访谈。谈及Mythos模型强大危险不敢发布,还探讨AI递归改进、文明崩塌概率、白领工作消失等问题,Dario坦率面对技术矛盾。

新智元