「多任务学习」共找到 6233 篇相关文章
让 Claude/Codex/Cursor 少读文件、多懂代码:Serena 体验
Serena是“编码代理工具箱”,能让LLM像IDE一样理解和改代码,有符号级检索等亮点。适合大型代码库任务,10分钟可上手,有多种接入方式,还有提示词模板,能让AI操作更专业。
Ray异构融合底座重构数据管道:架构演进与万卡落地实践
文章指出大模型发展下,传统大数据引擎在多模态数据处理局限性凸显。腾讯基于Ray构建新一代数据管道,介绍了云原生调度与计算范式融合架构,详述容错、资源利用等方面优化实践,展示了重构收益。
苏妈和李飞飞炸场CES!AMD AI全栈野心显露:从云端到个人PC,AI芯片性能四年要飙1000倍
今年 CES 上 AMD 专场演讲亮点多。苏姿丰称未来五年50亿人每天用 AI;李飞飞和她探讨空间智能与世界模型;Helios 平台受关注,MI455 GPU 解决内存墙;Ryzen AI 推动 AI 下放到本地。
DeepSeek-OCR是「长文本理解」未来方向吗?中科院新基准给出答案
DeepSeek-OCR的视觉文本压缩技术降低长文本处理成本,中科院自动化所等团队推出VTCBench基准测试评估模型视觉认知,含三大任务及衍生版本,测试结果有‘U型曲线’,还评测多种尖端模型。
NeurIPS 2025 Best Paper | 扩散模型不为人知的“时间差”:为什么先学会创作,后学会抄袭?
深度学习中,扩散模型能生成新图像且抗过拟合。巴黎高师和博科尼大学研究团队论文指出,这源于隐含的动力学正则化,训练分两阶段,数据量增加会拉开‘泛化窗口’,还给出数学解释。
12毫秒暴露自动驾驶致命缺陷,北航新研究实现场景感知的动态物理对抗攻击|TPAMI2025
近日部分L3级自动驾驶车型获批上路,但自动驾驶感知系统存在缺陷。北航等机构提出DynamicPAE框架,实现场景感知的动态物理对抗攻击,解决多维度挑战,在多场景表现优异,被TPAMI2025录用。
2025最大AI赢家的凡尔赛年度总结,哈萨比斯Jeff Dean联手执笔
谷歌由Jeff Dean和哈萨比斯牵头完成2025年AI年度总结与趋势展望报告。报告梳理八大研究方向,展示谷歌在模型能力、产品集成、创造力赋能等多领域进展,强调安全责任与开放合作。
全网首测!首款国产GPU「AI算力本」现场上手
新智元报道首款国产GPU「AI算力本」MTT AIBOOK,它搭载国产全功能显卡,预装开发环境,打破系统壁垒。其背后的MUSA架构全栈自研,软件升级、有翻译工具,硬件架构革新,还有开源计划,产品应用广泛。
LeCun离职前的吐槽太猛了
年底将离开Meta的LeCun在播客直言,不看好大语言模型通往AGI,也吐槽Meta封闭。他将创办开源公司AMI研究世界模型,认为其与LLM本质不同,还回顾AI学习史引出JEPA架构。
阿里干死豆包图疯传,千问:相煎何太急;字节大幅涨薪,传年利润或达500亿刀;印度AI妖股近两年暴涨550倍,仅2名员工|AI周报
这篇 AI 周报涵盖多领域动态。如阿里辟谣千问全员会干死豆包图;周鸿祎遭前高管实名举报财务造假;字节涨薪并推进 AI 手机合作;多家科技公司有新品发布或业务进展等。