「深度学习框架」共找到 3317 篇相关文章
Google 最新的 Gemini 2.5 Flash-Lite 原型能动态生成软件界面
Google最新的Gemini 2.5 Flash - Lite原型能动态生成软件界面。它打破传统预设框架,通过‘UI宪法’等设计保证风格与适应性,响应速度快,还解决了生成界面可能带来的混乱问题,或重塑人机关系。
Gaia2 与 ARE:赋能社区的智能体评测
文章介绍 Gaia2 与 ARE,Gaia2 是智能体基准 GAIA 升级版,能分析复杂行为,与 ARE 框架一同发布。ARE 可模拟复杂真实条件,支持定制。文中对比多款模型,指出当前模型挑战,并说明评测步骤和 ARE 使用场景。
DPad: 扩散大语言模型的中庸之道,杜克大学陈怡然团队免训推理加速61倍
扩散大语言模型(dLLMs)有全局规划能力,但存在计算冗余。杜克大学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,能在几乎无损精度下实现高达61.4倍推理加速。
腾讯开源了一个通用智能体,又刷榜了GAIA~
腾讯优图实验室开源了 `Youtu-agent`,在深度搜索和工具使用benchmark上表现佳。它不依赖GPT/Claude,有自动智能体生成功能,提供单、多智能体模式,还集成分析平台,可实时调试与离线分析。
破解人机协作密码:工作技能拆成两层,AI执行人类决策成功率狂飙 | ICML 2025
耶鲁和南大研究人员合作的论文提出数学框架,把工作技能拆分为决策层和执行层子技能,揭示人类与AI在这两层面各有所长,优势互补可提升成功率,还为机构适应新工作体系提供指南。
谷歌大脑之父首次坦白!茶水间闲聊引爆万亿帝国,AI自我突破触及门槛
AI界传奇Jeff Dean在「登月播客」深度访谈中,回顾个人成长、Google Brain早期故事及AI未来思考。他揭秘诸多细节,还谈到神经网络发展、注意力机制突破、LLM可解释性等内容,也提及未来五年规划。
打破幻觉!Qwen最新OCR让印章、表格、公式识别准确率飙升45%
基于推理增强框架的视觉语言模型处理OCR任务有成果,但存在生成幻觉问题,特定领域不如专家模型。DianJin - OCR - R1通过推理与工具交互,按‘思考 - 调用工具 - 重新思考’流程提升OCR性能,减少幻觉。
麻省理工大学:《通往通用人工智能之路》的研究报告
麻省理工科技评论洞察与Arm公司合作发布《通往通用人工智能之路》报告,探讨AGI定义、实现时间表、当前AI局限性及技术路径等。指出当前AI有局限,实现AGI需解决诸多障碍,还强调计算能力和异构计算的重要性。
实测Perplexity Pro平替模型,免费开源仅4B
一款仅4B大小的开源模型Jan-v1,声称能平替Perplexity Pro,且完全免费、支持本地部署。实测发现,它在检索增强生成、上下文深度分析等能力上表现不错,入门级显卡即可带动本地部署。
LLM总是把简单任务复杂化,Karpathy无语:有些任务无需那么多思考
随着推理大模型和思维链普及,大模型有了‘深度思考’能力,但现在有些偏科,简单任务也复杂化。AI大牛Andrej Karpathy发长文指出该现象,认为是基准测试优化所致,大模型发展不能只追求分数。