「多平台架构」共找到 6247 篇相关文章
VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案
常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。
真正的Jarvis要来了?涂鸦智能押注Physical AI
智能家居爆发期,诸多硬件品牌借涂鸦能力发展。如今涂鸦发布AI生活助手“Hey Tuya”,它依托自研架构补齐Agent进入物理世界的关键能力,让涂鸦从幕后走向台前,有望构建家庭生活新基础。
10级漏洞刚补完,React又炸了!现代Web“默认底座”因一行代码缺失引发全球地震,开发者经历最黑暗一周
12月12日,React官方确认RSC里有两处新漏洞。此前React2Shell漏洞危害大,超两百万台服务器有风险,开发者服务器被入侵挖矿。该漏洞因核心通信机制缺一行校验代码,Vercel等平台受波及。
NeurIPS 2025|CAKE:大模型驱动的贝叶斯优化新配方,让黑箱优化更智能、更高效
香港中文大学(深圳)等高校研究人员提出 CAKE 方法,被 NeurIPS 2025 接收。它利用大语言模型动态设计高斯过程核函数,构建自适应贝叶斯优化框架,在多领域实验中效果优,还具备可解释性。
Vibe Coding 产品最大的错觉,是以为自己真的有护城河
Base44创始人Maor Shlomo认为Vibe Coding工具易被复制,技术护城河难寻。他指出真正的护城河是“垂直整合”,构建全栈平台很关键。还谈到市场竞争、软件发展趋势、公司策略等多方面内容。
张小珺对话李想:3小时长谈总结(AI、VLA与组织进化)
张小珺半年前与李想3小时长谈,围绕AI展开多话题探讨。李想认为AI应成生产工具,赞赏DeepSeek,还分享VLA架构、理想终局规划,提出管理心法,思考AI与人关系。
从 ReasoningBank 到 MetaAgent,RL 未必是 Agent 自进化的必要解?
业内对智能体自进化的探讨开启多路线探索模式。除 RL 优化,记忆系统改进成新方向,如 ReasoningBank 机制。此外,业内还从智能体自我识别、工具和策略辅助等机制探索其他技术路线。
具身智能迎来ImageNet时刻:RoboChallenge开放首个大规模真机基准测试集
近日,RoboChallenge推出全球首个大规模、多任务真机基准测试。它构建开放、公正、可复现的‘真实考场’,为视觉 - 语言 - 动作模型提供评估标准,推动具身智能发展,还提供远程测试服务等。
北大彭一杰教授课题组提出RiskPO,用风险度量优化重塑大模型后训练
北大彭一杰教授课题组提出 RiskPO,解决大模型后训练陷入「均值陷阱」问题。它将风险规避理念融入优化目标,用「关注奖励分布左尾」替代「追求整体均值」,在多领域数据集上表现超越 GRPO 等。
GPT-5 之后,我们离 AGI 更近了,还是更远了?
2025年8月8日OpenAI发布GPT-5,架构有革新,在基准测试成绩优异,但跑分现场PPT出错、被Grok 4击败。它在编程表现出色、价格有竞争力,写作能力有争议,模型幻觉和提示注入攻击问题待解。