「深度研究功能」共找到 3899 篇相关文章
Attention Sink产生的起点?清华&美团首次揭秘MoE LLM中的超级专家机制
清华和美团研究聚焦MoE LLM,首次发现超级专家子集。通过多模型实证分析,揭示其分布规律、重要性及对注意力机制的影响,开发识别工具,为模型压缩提供新方向。
Transformer作者:DeepSeek才有搞头,OpenAI指望不上了
Transformer发明者Ashish Vaswani认为OpenAI等闭源厂商被商业化冲昏头脑,没心思做基础研究。他All in基础研究,坚持开源路线,想打造西方世界的DeepSeek。其团队论文提出颠覆性观点,或降低训练成本。
把任何文档变成Claude的新技能,这个开源工具火了。
Claude新出Skills,类似插件让其有自定义可调用功能。开源工具Skill Seekers能把网站文档转换成可使用技能。介绍了Skills特点及Skill Seekers功能原理、特点等,效率提升显著。
Cursor 1.0 正式版来了!BugBot 代码审查、后台 Agent 全面开放、MCP 一键安装。
Cursor 1.0正式版更新,新增功能不少,如BugBot代码审查、记忆功能、MCP一键配置等。后台Agent全面开放,还支持Jupyter Notebook。不过新设置界面使用体验一般,远程开发时mcp配置有问题。
天塌啦!!!这个开源项目让我失业啦,1300+ Star的开源AI画布,牛到让你怀疑~~~
介绍了 1300+ Star 的开源 AI 画布 Infinite - Canvas,它以画布为创作统一入口,有独特架构和多协议适配,具备多种实用功能、生态插件及两种画布模式,部署简单但需配置,适用于多场景,有优点也有局限。
数据集蒸馏,连发两篇顶会!10%样本实现全量性能,鲁棒不失真
数据集蒸馏能让模型高效节能,WMDD和GUARD两项研究分别解决保留原始数据特性、提升模型对抗扰动能力问题。WMDD用Wasserstein度量保留几何特性,GUARD平滑损失景观获对抗鲁棒性。
Anthropic首次揭秘下一代Claude怎么造!用户吐槽直接喂模型,连AI“做梦”都被训练
Anthropic研究团队产品经理Alex在访谈中透露Claude演进方向,如将模型开发产品化、向“持续运行Agent”演化,还解释“dreaming”机制等,也提及训练“人格”、研究意识等,展现了长远思考。
DeepSeek急招Agent方向!一口气放17个岗位,重度Vibe Coding用户优先
DeepSeek一口气开放17个招聘岗位,核心聚焦Agent方向,覆盖算法研究、数据评测、基础设施等全链条。岗位要求显示其Agent布局从研究落地到能力建设,还追求数据闭环与技术栈全面布局。
Claude会「做梦」了,梦里还在卷
Anthropic旗下Claude Managed Agents上线新功能Dreaming,可让AI在工作间隙“睡觉”反思,清理记忆、总结规律、自我升级。此外,还有Outcomes、多智能体编排功能进入公开测试,能让AI独立完成复杂工作。
Claude Code 的"懒加载"更新:AI 终于学会了"随叫随到"
Claude Code推出Tool Search功能,解决AI工具生态困境。它采用“懒加载”,按需调用工具,节省大量token。这反映AI工具生态从“能用就行”走向“精打细算”,对用户和开发者均有益。