「Agentic性能」共找到 4445 篇相关文章
OceanBase全面拥抱AI!首发PowerRAG产品,CTO杨传辉详解AI战略
OceanBase在第三届开发者大会发布面向AI的应用产品PowerRAG,CTO杨传辉解释其AI战略,即构建Data×AI能力,推动一体化数据库向一体化数据底座演进,这对行业发展有推动作用。
谢赛宁等推出统一多模态模型!替代VAE实现图像理解/生成双SOTA,代码权重数据集全开源
谢赛宁等团队推出统一多模态模型Blip3 - o,用扩散Transformer生成CLIP图像特征,采用顺序预训练策略。对比多种设计方案,确定CLIP + Flow Matching最佳,模型在多任务测试表现卓越且全开源。
AI不一定要“聊天”,OpenAI前研究员研发只做决策的模型,绕开文本生成,响应速度快200倍
本文报道前OpenAI研究员Diogo Almeida离职创业,推出不做文本生成、只输出结构化决策的新AI模型Jev,公开性能数据,探讨大模型应用分工新路线。
超硬核,腾讯给力!
文章介绍腾讯朱雀实验室开发的AI安全红队测试平台A.I.G,能对AI系统做全面“安全体检”,覆盖AI基础设施、MCP、LLM等风险。它功能实用,安装简单,适合折腾AI服务或MCP的人。
「龙虾热」后,OpenClaw 会是又一个泡沫吗?
OpenClaw是受高度关注的开源项目,发布一周吸引200万访问、超10万GitHub星标。热度外溢到产品和产业,厂商推「类龙虾」产品,应用边界向AI硬件延伸,地方政府也推出支持举措,但围绕其争议也在积累。
腾讯混元 x MBZUAI 港中文新研究:将纠错纳入策略空间,Search-R2 重构搜索增强推理学习方式
过去大语言模型能力提升靠参数和数据扩张,但在真实任务中此路径有局限。腾讯混元、MBZUAI、港中文联合团队提出Search - R2,将纠错纳入策略空间,抑制错误传播,在多跳推理任务中优势显著。
AI“租人”平台一夜爆火:时薪3500、2.4万用户抢着“卖身”,专家:警惕劣币驱逐良币
AI社交网络Moltbook引发恐慌后,RentAHuman.ai网站上线将AI雇佣人类变为商业系统。上线一天访问量破50万,超2.4万用户“挂牌待租”,引发热议与担忧,专家也给出相关判断。
QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5
通义文档智能团队推出QwenLong - L1.5长文本推理专家,提供端到端长文本推理后训练“配方”,含数据合成管线、强化学习方法、智能体架构,在多基准测试成绩佳,代码已开源。
北航领衔发布300页代码智能综述:从基础模型到智能体,一次读懂Code LLM全景图
北航领衔联合近30家机构撰写《From Code Foundation Models to Agents and Applications》,系统梳理代码智能领域,串联模型、任务等成完整技术链路,还通过实验等给出实践指南。
HF Papers直播 AI Insight Talk | OCR 专场
由Hugging Face等联合发起的【AI Insight Talk】系列直播活动第6场 - OCR专场明天开启。将剖析三项技术方案,举办圆桌对谈。还会有嘉宾介绍HunyuanOCR、PaddleOCR - VL、MinerU等模型的技术亮点。