深度研究能力」共找到 5172 篇相关文章

算法论文8

冷门新语言AI写不动?IEEE论文:从零到及格线,MoonBit给出完整训练路线

IEEE论文聚焦新语言MoonBit和Gleam,探讨大模型代码生成能力研究发现大模型零样本生成新语言代码能力差,few - shot和RAG有提升但有限,继续预训练及指令迁移可显著提高模型表现。

量子位
产品应用7

一块TFT“屏幕”,如何成为AI4S验证新标准?

Anthropic呼吁放缓AI研究,AI for Science领域上下游能力增长矛盾凸显。TFT天然具备阵列化、高密度等特点,与AI for Materials验证需求匹配。领挚科技基于TFT技术为行业提供验证标准,助力科研成果产业化。

DeepTech深科技
算法论文8

ICLR最佳论文:Transformer天生简洁

2026年ICLR最佳论文对Transformer做深度思维体检,指出其架构真正威力在于描述概念时比RNN等简洁指数级甚至双重指数级,但验证其内部逻辑计算成本高昂,为解释其能力开新窗。

AIGC开放社区
新闻资讯8

离开OpenAI后,这位27岁的首席AI科学家要带腾讯走向AI的下半场|姚顺雨

今年9月姚顺雨从OpenAI离职传闻加入腾讯,如今腾讯内部公告尘埃落定。27岁的他出任腾讯相关要职,腾讯还升级架构。他学术成果丰硕,有产品能力,提出AI下半场观点,或为腾讯带来多方面提升。

花叔
推荐文章8

超实用提示词模板!AI科学家教你用协作提示词激发大模型潜力

文章由知名AI科学家Lance Eliot所写,指出主流大语言模型因训练机制变得‘短视’,缺乏深度协作能力。介绍协作提示词技术,能让AI成为主动引导者,并以测试展示效果,还说明了适用场景。

AIGC开放社区
新闻资讯8

前端危!Gemini 3内测结果获网友一致好评,“有史以来最强前端开发模型”

谷歌下一代旗舰模型Gemini 3未发布便走红,内测结果显示它擅长前端、SVG矢量图生成,多模态能力更强。网友实测其在编程、绘图等方面表现出色,疑似谷歌内部文件显示发布时间为10月22日。

量子位
算法论文8

华为发布如何利用RL训练强大的Deep Research Agent综述!

华为技术团队发布综述论文,首次系统性梳理利用强化学习(RL)训练强大的深度研究代理。论文指出传统SFT和DPO方法有局限,RL优势明显,还在数据构建、算法设计等方面给出进展与路线图。

深度学习自然语言处理
算法论文7

震撼实锤!清华姚班校友揭「1.4×加速」陷阱:AI优化器为何名不符实?

为降低大模型预训练成本,近年新优化器频出,宣称加速1.4×到2×却难落地。斯坦福研究指出方法学缺陷,对比不同缩放范式加速差异,给出优化器设计见解,证实严格基准评测必要。

新智元
算法论文8

通用LLM压缩算法,居然藏视频编码里!2.5bit实现4bit性能,硬件无缝支持

LLM.265研究发现,视频编码器是高效的大模型张量编码器,现成视频编解码硬件压缩AI模型数据效率高。它灵活控制码率、可压缩多种张量,还能利用GPU硬件加速。实验显示其压缩效果显著。

新智元
开源动态8

社区供稿 | 全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型 Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源科学多模态大模型Intern-S1。它融合书生家族优势,首创跨模态科学解析引擎,在多学科任务上超越顶尖闭源模型,技术创新显著,未来将持续开源。

Hugging Face