「模型问题」共找到 9544 篇相关文章
太巅了!MIT老哥在Transformer里造了台计算机,LLM从此不需要调用外部工具?
LLM在数学推理表现佳,但纯计算是短板。MIT的Christos Tzamos团队在Transformer内造计算机,实现WebAssembly解释器,解决数独难题,还突破注意力机制瓶颈,打开软件与神经网络新接口。
百度“龙虾” 全家桶亮相,多款龙虾产品上新,家用小度虾也来了
3月17日百度AIDAY龙虾专场,百度“龙虾”全家桶亮相,多款产品上新。百度集团沈抖谈OpenClaw趋势,还推出桌面AI智能体DuMate、“家用小龙虾”等,多个Skills也发布,持续降低体验门槛。
MCP已死,CLI当立!OpenClaw压根没想用它,硅谷大厂正在集体弃用。
近期Perplexity宣布弃用MCP,转而用API和CLI。MCP存在浪费Agent资源、启动易失败、权限管理差等问题。而CLI可组合、可调试、认证现成,MCP成多余中间层。
显存暴降92%!哈工大为线性注意力开辟了新道路
哈尔滨工业大学等团队发现线性注意力性能不足根源是查询范数丢失等。基于此提出NaLaFormer,在ImageNet - 1K准确率最高提7.5%,超分任务峰值内存降92.3%,为线性注意力发展开辟新道路。
CVPR'26 | 以机器人为中心的ToM推理框架,从心智推理到决策行动
吉林大学、台湾大学和微软亚洲研究院联合提出MindPower Benchmark,构建以机器人为中心的ToM推理框架,统一建模环境感知、心智推理等,还构建数据集和评估指标。引入Mind - Reward强化优化,提升ToM决策与动作生成性能。
FlashAttention-4正式发布:算法流水线大改,矩阵乘法级速度
深度学习领域底层优化技术FlashAttention更新至4版本。其核心作者称在Blackwell GPU上,注意力机制执行速度接近矩阵乘法。新算法克服瓶颈,在B200上性能提升,还获Pytorch官方支持。
阿里正式批准林俊旸辞职!CEO亲自挂帅新基模小组
昨日深夜林俊旸官宣告别Qwen,国内媒体确认其离职属实,阿里CEO吴泳铭批准。此外,周靖人继续领导通义实验室,吴泳铭等领导新小组,阿里坚持开源模型策略。
终于在国产AI上看到了Opus的影子|GLM-5深度实测
作者起初怀疑GLM - 5称对标Claude Opus 4.6、定位“系统架构师”的说法,但实测后改观。通过宝可梦策略助手、降噪网站沉浸式交互、求职招聘双边匹配三个测试,展现其系统规划、执行、纠错等能力,像真正架构师。
ACP 协议 + 多 AI 编程智能体:企业研发的新生产力平台
文章围绕 ACP 协议展开,介绍其概念、工作原理及在 AutoDev 的集成实践。还提及 ACP 生态、多 Agent 协作实践,如 Augment Intent、Google Antigravity。最后阐述企业级 AI 平台治理体系,包括 MCP、ACP、A2A 三层协议协同价值。
OpenClaw们狂奔,谁来焊死安全车门?
2026年开年,AI进化成“行动式智能体”,带来便利的同时,也引发恐慌,传统安全思维失效。江苏通付盾提出前瞻性智能体安全框架,已在“大群空间”多智能体协同平台落地。