「实验平台」共找到 2599 篇相关文章
传统训练效率很低?我们靠 “给模型降噪” 重新审视长上下文建模难题
文章指出长上下文模型处理长文本时易受噪声干扰,提出新评估指标IG分数和“上下文去噪训练(CDT)”方法。实验表明CDT优于现有策略,经其训练的开源模型在长上下文任务中性能媲美GPT - 4o。
英伟达新“桌面超算”800GB大内存,满血DeepSeek R1能装1个半
英伟达在Computex大会宣布新办公室落户中国台湾省台北市,还推出多款新品。如面向个人的DGX Station有800GB内存,能跑大模型;面向企业的RTX PRO Server可加速多种用例。此外,还发布新平台、宣布合作等。
都说记忆是Agent标配,但MemSyco发现漏算了一件事
厦门大学与吉林大学的最新研究指出,随着大模型Agent具备长期记忆,虽成为“长期协作者”,但也出现Memory-Induced Sycophancy问题。为此提出MemSyco - Bench评测基准,经实验得出多项发现,指出Agent Memory关键瓶颈转变。
一句话生图要过时了?开源图像生成Agent进化出「工具编排」
来自多机构的研究团队提出GenEvolve,将开放图像生成建模为「工具编排轨迹」。它配置三类工具,经多轮决策完成生成。通过构建数据集训练,实验显示在多基准上表现出色,已开源模型、代码等。
32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世
现有LLM自动化CUDA方法难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。
10人创业团干翻行业“潜规则”!全员必须会AI、让跑大模型全程“裸奔”,谷歌老兵不烧钱创业
谷歌老兵Bryan Zhou投身AI创业,组建AnyInt团队。该平台定位AI Infra中间件,一个API对接所有模型,提倡“去中心化”。团队一开始就奔着付费用户,还做了极致性能优化,吸引众多开发者。
探索文本压缩极限!C3纯文本压缩pipeline:20倍压缩解码准确率98%
DeepSeek团队的DeepSeek - OCR技术引发关注,研究者重新审视视觉压缩路径后提出C3技术。C3采用纯文本压缩管道,实验表明其压缩精度远超DeepSeek - OCR,还具独特遗忘模式,代码模型均已开源。
超10万亿Tokens的高质量数据集是怎么炼成的?专访中国电信天翼AI阮宜龙
中国电信天翼AI打造超10万亿Tokens高质量数据集,依托星辰MaaS平台构建“数据—模型—服务”闭环。其与研究院推进技术研发并落地产品,建“三全”星辰大模型体系,还在多行业展现应用价值。
ICCV 2025 | 基于时序增强关系敏感知识迁移的弱监督动态场景图生成
北大王选所团队发表论文 TRKT,针对弱监督动态场景图生成任务目标检测质量瓶颈,提出时序增强关系敏感知识迁移方法,含关系敏感知识挖掘和双流融合模块,实验证明能提升场景图生成质量。
我去,Github 51k star,没看错,他是开源的,“用 Docker 运行 macOS”?你绝对没看错!
这是一个运行于 Docker 中的 macOS 虚拟环境项目。开发者或安全研究者在非 macOS 平台运行 macOS 常遇性能差等痛点,而 Docker - OSX 利用容器化轻量部署,接近原生性能,功能亮点多,应用场景丰富。