深度学习资料库」共找到 1981 篇相关文章

算法论文8

ICLR 2026|人大&通义:别再只会堆上下文了!IterResearch用40K上下文轻松实现2048轮交互不退化

中国人民大学与阿里巴巴通义实验室团队提出 IterResearch 迭代式深度研究范式。它能让 Agent 在 40K 上下文下完成 2048 次工具交互且性能不衰减,解决了传统范式上下文臃肿问题,论文已被 ICLR 2026 接收。

机器之心
开源动态8

AI Agent也有体检中心了?诊断级安全框架AgentDoG正式开源

上海人工智能实验室今日开源全球首个具深度诊断能力的AI智能体安全护栏框架AgentDoG。它能精准定位风险、解释决策成因。团队提出三维风险分类法,构建数据合成管道,实验表现领先,还集成归因模块。

PaperAgent
产品应用8

今天,被GLM-5的Agentic Coding能力惊艳到了

上月底Anthropic报告揭示编程趋势转变,月初Claude Opus 4.6与GPT - 5.3 Codex发布印证。作者深度测试GLM - 5,经两项实测挑战,发现其在复杂系统任务表现超预期,有‘系统架构师’思维。

PaperAgent
新闻资讯8

YC 专访 OpenClaw 创始人:80% 的 App 将会消失,我们还剩下什么?

YC 深度访谈 OpenClaw 创始人 Peter Steinberger。他本是半退休开发者,因 AI 智能体 Moltı 爆火。他认为 AI 应回硬盘,OpenClaw 能控制设备、处理文件。还谈到机器人雇佣人类、80% App 将消失等观点。

AI科技大本营
开源动态7

致敬Kimi K2:基于slime的全流程INT4量化感知RL训练

受Kimi K2团队启发,SGLang RL团队落地INT4量化感知训练流程方案,在强化学习多方面取得进展,还在slime框架复现全流程方案,实现媲美BF16精度,提高Rollout效率,为社区提供开源参考。

机器之心
推荐文章7

2026 初的大模型,离电影 Her 还有多远?

作者重看电影《Her》后,对比 2026 年初现实 AI 与电影中萨曼莎的能力,从七个维度分析差距。指出功能性上已接近,但存在性层面差距大,还探讨了 AI 发展趋势与存在意义。

特工宇宙
产品应用8

模型训练篇|多阶段ToolRL打造更可靠的AI导购助手

当前,AI导购成电商与服务平台新风口,但芝麻租赁场景挑战大,存在需求难匹配等痛点。为此打造AI导购智能体“租赁小不懂”,经架构升级和算法优化,性能提升,还探索了MoE训练和推理优化。

阿里云开发者
产品应用8

Claude统治一切!吞下这颗红药丸,焊工也是顶尖程序员

一种被称为「Claude - pilled」的现象在硅谷蔓延,焊工、律师等非程序员用Claude Code写APP,程序员护城河渐崩。但工程师用它后学习速度下降,社区探索让AI成导师的办法,且软件开发范式正转变。

新智元
新闻资讯7

马化腾内部员工大会安利「元宝派」新玩法,结合腾讯优势开启AI社交新赛道

腾讯2026年员工大会上,马化腾强调保持定力。过去一年混元大模型深度重构,吸引人才。AI助手元宝发展佳,即将推出“元宝派”新玩法,还针对春节推10亿现金红包活动,马化腾现场安利。

AI科技评论
算法论文8

定位大模型「作弊」神经回路!新研究首次揭示:虚假奖励如何精准激活第18-20层记忆

此前学术界发现大模型用虚假奖励训练也能提升准确率,背后微观机制是黑盒。南科大等团队深度拆解,定位到关键记忆节点,发现‘困惑度悖论’,还能操控记忆,成果对评估、检测和去污染有意义。

量子位