等变局部评分机」共找到 8027 篇相关文章

算法论文7

剑桥揭开大模型翻车黑箱!别再怪它不懂推理,是行动出错了

剑桥大学机构研究指出,大模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了自条件化影响及模型规模的作用。

新智元
推荐文章7

初探:从0开始的AI-Agent开发踩坑实录

作者分享从0开始开发AI Agent实现开源应用Helm Chart自动化生成的历程。介绍了定义角色、明确AI能力边界开发要点,尝试三种Agent范式,还提及实践痛点如AI可观测性不足、Prompt工程困境

阿里云开发者
开源动态7

免费开源、可本地部署的AI私人助理Clawdbot,保姆级搭建教程来了

本文提供免费开源、可本地部署的AI私人助理Clawdbot的搭建教程。它能在多平台运行、连接工具和技能。教程涵盖创建虚拟机、安装Node.js和Clawdbot、设置连接步骤,还介绍技能扩展和VPS运行方案。

AI寒武纪
算法论文8

斯坦福7B智能体全面超越GPT-4o,推理流登顶HF

传统智能体系统难兼顾稳定性和学习能力,斯坦福团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o大模型,为AI发展提供新思路。

新智元
开源动态8

让图像生成告别 AI 味!清华 + 港中大 + 腾讯混元联手推出SRPO

腾讯混元联合港中大、清华推出SRPO,解决文生图技术痛点。它结合Direct - Align和SRPO,提升图像审美,训练时间缩至十分钟,在测试中碾压主流方法,不过对冷门风格控制和机制可解释性待提升。

AIGC开放社区
开源动态8

社区供稿 | 阿里国际Ovis2.5重磅发布:以小博大,刷新开源模型性能新高度

阿里国际发布多模态大模型Ovis2.5,在OpenCompass综合得分提升,保持SOTA水平。它在原生分辨率视觉感知三方面突破,有9B和2B两版本,代码、模型资源已开源,技术原理涉及架构、训练与数据。

Hugging Face
产品应用8

中国团队一夜封神,AI出海「全球第一」!曾靠游戏狂赚10亿美金

在大模型竞争激烈的当下,中国出海团队SeaArt(海艺)用2.5年超越Midjourney,成全球访问量第一的AI内容创作社区。它打造AI原生内容生态,SeaVerse开启全模态时代,还靠洞察用户、游戏基因优势制胜。

新智元
产品应用8

你们催更的模型,云栖大会一口气全发了!

云栖大会上新6款模型、发布1个全新品牌,覆盖多场景。如Qwen MAX万亿参数大模型能力登顶国际榜单,Qwen3 - Omni实现全模态不降智,各模型能力升级显著,现已同步上线。

阿里云开发者
新闻资讯7

AI 渗透金融行业:大模型如何破解风控、服务与决策难题?

在数字化与人工智能驱动下,金融行业变革深刻。InfoQ《极客有约》X AICon 直播栏目邀多位专家探讨大模型赋能金融,涉及风控、服务、决策难题,分享了大模型应用场景、技术渗透、权衡可解释性与性能观点。

InfoQ
新闻资讯7

北大校友孙之清C位出镜,小扎看OpenAI直播夺人!1亿刀薪酬光速被签

CoT之父Jason Wei离职后,又一华人科学家孙之清入职Meta。他曾在OpenAI与奥特曼同框直播,此前深度参与o3项目,还带头做「ChatGPT Agent」技术实现。加上Jason Wei,三人都加入Meta。

新智元