「上云智能体」共找到 5412 篇相关文章
ICML 2026 | 拒绝盲目猜token,阿里x浙大将投机解码带入弹性预算时代
随着大模型参数规模扩大,推理成本成核心瓶颈。投机解码在高并发下有问题,阿里与浙大学者提出 ECHO,将投机树构造建模为预算调度问题,通过稀疏门控和弹性预算调度提升系统收益。
CVPR 2026 视频模型趋势梳理:不止生成下一帧,更要理解下一步
视频智能正从画面生成走向运动控制、动态建模等。CVPR 2026 显示视频模型竞争重心从视觉质量转向对时空和物理规律的建模能力,文中介绍多篇相关论文及成果。
The Batch: 952 | GPT-5.5 性能领先,但幻觉问题突出
OpenAI 最新旗舰模型 GPT-5.5 是闭源视觉 - 语言模型,在重要基准测试中表现领先,但在区分已知未知内容上有困难,幻觉问题突出,在主观评估中落后于对手。
北大开源统一世界模型框架:多类合成推理任务一套搞定
世界模型研究中,不同任务存在接口不统一等问题。北大DCAI课题组联合多方推出OpenWorldLib推理框架,整合多模态能力,构建标准化接口体系,在多任务上评估效果良好,降低研发门槛。
GPT-image-2十大最强玩法实操:夯到爆炸
OpenAI全量上线GPT Image 2,其表现远超其他模型。它优势明显,如真实感与细节强、文本渲染准确、自带“思考”能力。文章还给出其十大玩法实操及提示词,涵盖图文组合、海报生成等。
Demo秀终结,机器人连干8小时不歇!智元定义「部署态」
4月17日智元合作伙伴大会上,智元创始人定义2026为「部署态」元年,即机器人在真实场景7×24小时自主干活。大会首提XYZ曲线产业发展框架,还发布七大生产力解决方案,展示四大新本体、六大AI模型等成果。
OCR 赛道变天了:Datalab 要亲手杀死自己
Datalab推出Chandra模型,指出老一代pipeline OCR已到天花板。它从“切块识别”转向“整页理解”,在布局感知、数学支持、表格表单处理上表现出色,标志OCR从“识别字符”进入“理解文档”阶段。
比 BeautifulSoup 快 784 倍!这个自适应爬虫框架,我愿称它为下一代 Web Scraping 标杆
文章介绍了自适应Web Scraping框架Scrapling,它能解决爬虫从能跑到跑得稳的问题,具备极速爬取、自适应解析等核心功能,适用于电商数据采集等场景,还给出使用方法和项目地址。
Meta 143亿挖角后的首个作品:Alexandr Wang 推出闭源模型,杨立坤点赞
沉寂9个月后,Alexandr Wang带队的Meta发布新一代模型Muse Spark。它是原生多模态推理模型,性能媲美Gemini Pro和GPT 5.4,在多领域有应用潜力。不过闭源引争议,且在部分领域有短板。
OpenClaw 3.24发布:彻底解决最重要的Skills安装障碍!
OpenClaw 3.24 发布,改动显著。Skills 安装更顺滑,系统自动检测依赖;控制台界面大改,侧边栏更易用;修复媒体文件访问漏洞;Microsoft Teams 支持升级;还修了多平台群聊 Bug,新增 API 端点,提升 RAG 兼容性。