领域特定任务」共找到 3624 篇相关文章

产品应用7

当大家都在“养龙虾”时,阿里把生态里最大的龙虾递到了千问手里

2026年1月千问App上线点外卖、订酒店机票等服务,起初有局限,后体验改善。千问又上线“一句话打车”,接入阿里丰富生活服务生态,有望成“任务操作系统”,推动软件交互变革。

MacTalk
产品应用8

刚刚,喝到了千问APP给我点的奶茶

2026 年初,智能体发展迅猛。Anthropic 发布 Cowork,谷歌联合推出 UCP 标准。1 月 15 日千问 App 上线「任务助理」,打通阿里生态,有 400 多项新功能,实测显示其在多场景表现出色。

机器之心
算法论文7

美7000万人或被取代,Agent光速卷入职场!北大校友、杨笛一新作

斯坦福大学研究团队调查104个职业领域1500名专家及52名AI研究员,构建WORKBank数据库。研究发现职场AI需求与能力错配,工人对AI态度不一,还揭示未来人类技能变化趋势。

新智元
算法论文7

AI仅凭“自信”学会推理,浙大校友复刻DeepSeek长思维链涌现,强化学习无需外部奖励信号

UC Berkeley团队提出新训练方法Intuitor,大模型无需接触真实答案,仅优化自身信心就能学会复杂推理。该方法无需外部奖励信号或标注数据,用模型自身置信程度作内在奖励信号,在多任务表现良好。

量子位
算法论文8

医疗AI迎来大考!南洋理工发布首个LLM电子病历处理评测 | AAAI'26

南洋理工大学研究人员构建EHRStruct基准,涵盖11项核心任务、2200个样本,用于评测LLM处理结构化电子病历的能力。研究发现通用大模型优于医学专用模型,提出的EHRMaster框架与Gemini联合后性能超现有模型。

新智元
新闻资讯8

让AI学会潜意识推理,Sapient发布类脑模型HRM

新加坡初创公司Sapient Intelligence发布仅2700万参数的分层推理模型HRM,在多项高难度推理任务上超越大模型。它绕过大模型推理困境,借鉴大脑机制,训练效率高,开源后GitHub星标突破10.3k。

AIGC开放社区
新闻资讯7

OpenAI o3-pro模型发布,但不能聊天

当地时间6月10日,OpenAI o3 - pro模型发布,ChatGPT Pro用户可通过API使用。它是o3子版本,在多领域表现出色,但响应慢,适用于对可靠性要求高的难题。目前临时聊天功能停用,不支持图像生成和Canvas。

AI前线
产品应用8

代码智能体占领GitHub!自动修bug、加功能、写文档,一台手机就能指挥

GitHub上新代码智能体Copilot Coding Agent,可自动修bug、加功能、写文档,开发者评价很棒。在手机APP就能操作,还能同时分配多任务。微软宣布VSCode中GitHub Copilot将开源,还发布多项新功能。

量子位
算法论文8

二元成功率已经过时!PRM-as-a-Judge才是你需要的具身操作评测框架

传统二元成功率评测具身操作任务有局限,难回答策略推进、执行效率等问题。中科院自动化所等机构研究人员提出PRM - as - Judge框架,含进度势能、OPD指标体系和RoboPulse基准,能细粒度审计执行过程。

机器之心
开源动态8

腾讯纯文本LLM训视觉encoder,拿捏图表长视频,达到开源小模型SOTA!

腾讯开源Penguin - VL,直接用纯文本LLM训视觉编码器,跳出传统多模态拼接套路。在2B/8B紧凑参数规模的复杂任务中竞争力强,训练分三阶段,相关代码、模型等已开放。

量子位