多任务能力」共找到 7246 篇相关文章

产品应用8

让问题不过夜:交易领域“问诊”Agent实践

文章针对研发支持中的痛点,构建智能Agent系统,将问题抽象为业务答疑与问题诊断两类能力。介绍了系统架构、构建演进、知识体系、质量评估等内容,还展示实战成效,指出当前边界与下一步方向。

阿里云开发者
新闻资讯7

GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

第三方评测机构Roboflow测试显示,GPT-5.6 Sol在目标检测、计数等视觉任务上表现出色,尤其在文档版面识别和密集场景处理上进步明显,但认字能力有退步,且大尺寸图片检测框易飘移。

新智元
开源动态7

腾讯Youtu-agent 不会代码,也能搞定数据分析+深度研究+HTML报告

腾讯开源的Agent框架Youtu - agent灵活高性能,可用于数据分析等任务。基于openai - agents构建,适配种模型API等。突出优势是能自动化生成智能体及其配置,采用YAML配置方案,有内置‘元智能体’,还完全异步。

CourseAI
推荐文章7

上下文工程又进化了:Harness实现AI完全自主化

近期Harness Engineering讨论火热,Harness是围绕AI模型的支撑架构,Anthropic用其突破AI局限,解决AI完成复杂任务时的偷懒问题,还通过智能体架构用于前端设计、软件开发,经实战检验效果良好,后续还对其进行简化。

AIGC开放社区
新闻资讯7

GPT-5.2被曝作弊!偷袭谷歌竟靠拉爆token刷高分,不如Gemini 3

新智元报道,OpenAI刚发布GPT - 5.2就被指「作弊」,其在基准测试中或调参数使模型用更算力资源。有用户发现它消耗远超对手的token才获成绩,真实能力或与Gemini 3相当。此外,还揭示了OpenAI为商业利益牺牲学术独立的问题。

新智元
算法论文8

学会“吃一堑长一智",性能飙升11%!XSKILL让AI积累经验和技能

XSKILL框架让AI像人一样积累经验和技能,将任务级技能与动作级经验统一到双流设计中,通过视觉接地提取和检索知识,在个基准测试中显著提升性能,还展现出跨模型迁移性。

AIGC开放社区
产品应用8

GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了

GPT - 5.2 登场,有 Instant、Thinking、Pro 三个版本,在方面大幅升级,能覆盖 44 类专业工作。它经济性强、编程能力佳、推理出色,但存在速度慢的问题,其价格 API 端有调整,未来还将推 Codex 优化版。

AI前线
开源动态8

沉寂一个月,openPangu性能飙升8%!华为1B开源模型来了

华为发布专为昇腾端侧硬件打造的openPangu Embedded - 1B模型,仅10亿参数却性能卓越。它运用阶段训练和优化,在权威基准表现亮眼,V1.1平均分较上月跃升超8%,还介绍了背后技术。

机器之心
推荐文章7

看懂毫米波雷达,这一篇就够啦!

文章介绍毫米波雷达,它是频率30GHz - 300GHz的电磁波,兼具微波与远红外波特点,有高数据传输速率、高分辨率等优势,也有绕射能力差等弱点,在领域应用前景广,移远通信等企业正布局。

芯师爷
新闻资讯7

AI参与战争的时代正式拉开帷幕?

美以对伊朗军事行动或已运用AI,美军投入大量资金研发相关技术,并通过实战迭代提升AI定点清除成功率。AI在军事中有方面应用,美国已启动相关计划,引发全球军备竞赛,中国应迎头赶上。

芯师爷