「构建方法」共找到 3226 篇相关文章
POF | 西交大陈泽伟、陈刚等:面向可变形域非周期非定常流动的几何自适应时空深度学习框架
西交大陈泽伟、陈刚等人提出ViT - STFlowNet框架,用于可变形域非周期非定常流动预测。该框架融合自适应网格变换与ViT架构,克服传统方法局限,测试显示预测精度高、泛化能力好,为飞行器流场感知控制提供工具。
字节Seed提出M3-Agent:像我们一样"记住"与"思考"的长视频理解新范式
字节Seed提出M3 - Agent,这是首个融合实时视听输入、类人记忆构建与自主推理的多模态智能体。它模仿人类记忆机制,解决长视频理解痛点,已被CVPR 2025收录并开源代码,为通用人工智能奠定基础。
LoRA中到底有多少参数冗余?新研究:砍掉95%都能保持高性能
这篇创新研究介绍了LoRI技术,证明即使大幅减少LoRA的可训练参数,模型性能依然强劲。研究团队在多个任务上测试了LoRI,发现仅训练LoRA参数的5%,LoRI就能匹配或超越其他方法的性能。
蚂蚁阿福:从 0 到生产的医疗 Agent 工程化落地|QCon 北京
4月16 - 18日QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题,有百余落地案例。蚂蚁集团郭春晓将分享《蚂蚁阿福:从0到生产的医疗Agent工程化落地》,探讨构建技术体系等内容。
躲了科学家几十年的流体不稳定奇点,被DeepMind用AI找到了
谷歌DeepMind与多所高校合作,用物理知情神经网络(PINN)+高精度数值优化的方法,找到了流体方程里的不稳定奇点。这种奇点很“挑剔”,此前难寻踪迹,此次发现为非线性流体动力学研究提供新范式。
斯坦福:优化器「诸神之战」?AdamW 凭「稳定」胜出
斯坦福大学 Percy Liang 团队研究指出,虽有不少声称能显著加速的优化器替代方案,AdamW 仍为预训练稳健首选,但矩阵型方法在特定数据–模型比例下优势明显。研究还揭示了现有研究的方法论缺陷。
融云首发“通信+AI”闭环架构,让 AI 有情商、能落地|甲子光年
8月28日融云在AIM线上发布会推出“通信+AI”产品矩阵,围绕“能落地的好AI”理念打造高情商AI。通信与AI相互增强,构建四层知识体系数字分身,其产品可解决多场景痛点,还能降低开发门槛。
ShellAgent 2.0 体验:让前端消失,省掉 70% 开发资源
本文介绍Myshell ShellAgent 2.0测试情况,它仅用提示词就能生成Agent应用,摆脱前端构建流程,降低创建门槛。文中展示创建计算八字、分析钱包资产、拆解学习资料等应用案例,还能Remix他人发布的应用。
kimi 的RL end2end ON LLM
文章分享Kimi Researcher背后技术思考,采用端到端强化学习打造大模型Agent。对比传统方法,凸显其灵活通用、能力上限高、可扩展优势。还展示其在考试榜单成绩提升及智能“涌现”,介绍多应用场景。
软件正在发生根本变化:Andrej Karpathy 旧金山 AI创业学院演讲万字实录
Andrej Karpathy在旧金山Y Combinator AI创业学院演讲,指出软件正进入“软件3.0”时代,大语言模型(LLM)是新型计算机,能用英语编程。他探讨了LLM特性、生态,以及如何利用其构建部分自治产品等。