「任务感知能力」共找到 4781 篇相关文章
美国政府变身英特尔最大股东,能帮它重新崛起吗?
路透社消息,美国政府与英特尔达成协议,将掏89亿美元买其4.333亿股普通股,占股9.9%,加上之前拨款,总投资达111亿美元。此交易引发各方争议,美国政府意在提升本土芯片制造能力。
Google官方发布nano banana使用指南
Google官方发布nano banana使用指南,介绍其核心能力,如角色一致性、精确局部编辑等,还给出写提示词的6要素、5种实用技巧,同时指出模型存在风格化不一致、文字渲染易出错等问题。
「人类造的最后一个AI」还有多远?一张图看懂OpenAI、Anthropic等大厂的RSI进度
本文报道中国前沿AI机构Theseus Labs联合多家产学研机构发布RSI领域研究报告,梳理全球72家头部AI厂商的RSI研发进展,提出五级RSI框架与HCI指标,拆解出可工程化的RSI发展路径,发布后在海外AI圈引发热议。
CVPR 2026 Highlight|让家电「在仿真中运转起来」,北大正式发布RealAppliance!
北京大学团队提出 RealAppliance 数据集与 RealAppliance - Bench 评测基准。前者收录 100 个精细家电资产,与真实产品系统多层面对齐;后者围绕五项任务评估模型家电操作规划能力,实验显示主流模型仍面临挑战。
Anthropic 兄妹 Dario Amodei 和 Daniela Amodei 最新对话:Claude 为什么一直限速?
在 5 月 6 日 Anthropic 开发者大会上,兄妹 Dario Amodei 和 Daniela Amodei 对话,谈到 Claude 限速因 2026 年 Q1 增速年化 80 倍远超规划,还涉及开发者生态、模型训练、能力释放等话题,强调平衡发展与安全。
刚刚,国产AI双冠王!黑马世界模型打破全球纪录,一镜到底封神
生数科技的MotuBrain零宣发登顶双榜,打通「看懂世界+执行行动」,适配多个头部机器人本体。它基于Motus进化,具备多本体、多任务、长程执行能力,展示出强大的「一脑多能」和「一脑多型」特点。
The Batch:924|GPT-5.4:性能更高,价格也更高
OpenAI更新旗舰模型GPT-5.4,有Thinking和Pro两个版本,扩展工具使用能力,多基准测试达当前先进水平,但定价高。虽在部分任务表现超Claude,挑战Gemini地位,不过成本也更高。
10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源
阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒
当行业争论30B能否挑战万亿参数时,清华、人大、面壁智能与OpenBMB联合研发的AgentCPM-Explore开源,基于4B参数在深度探索任务表现出色,还开源配套平台,解决小模型性能提升难题。
小模型,大能量!200美金的GPT Pro竟然输给了它?
博主用11个场景深度测试昆仑万维的Skywork R1V4 - Lite,它能做到Gemini 2.5 Pro才能干的事,速度快、成本低。在定位、人物识别、生活实用、专业鉴定、学术研究等场景表现出色,核心突破在于主动图像操作与深度推理。