「跨模态检索能力」共找到 3418 篇相关文章
OpenAI发布权威AI科研基准,扯下AI遮羞布:奥赛金牌≠一流科学家!
OpenAI在2025年12月16日发布FrontierScience基准,用超700道题从物理、化学、生物维度考验AI科研推理能力。评测分竞赛和研究赛道,初测显示GPT - 5.2领先,但前沿模型仍有诸多问题。
人类选手苦战10小时获得世界编程冠军,OpenAI获得亚军,但这可能是最后一次了
在AtCoder启发式编程世界杯总决赛,人类选手Psyho苦战10小时击败OpenAI的AHC模型夺冠。赛事专注优化问题,比赛过程跌宕起伏,也证明了AHC具备持续性推理等关键能力。
Agent创业者的天塌了,OpenAI发布ChatGPT Agent
昨晚OpenAI发布ChatGPT Agent,这让Agent创业者紧张。它整合多种能力,功能强大,支持多操作。新模型经强化学习调优,在多基准测试中表现佳,或挤压初创公司通用Agent赛道空间。
奥特曼瘫坐叫停“GPT-6”训练!太强触发最高安全警报
OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AI护AI,升级监控。
Anthropic发布AI就业冲击报告,数据让人意外
Anthropic发布AI对劳动力市场影响的报告,基于真实数据和理论智能分析。提出“观察暴露度”新指标,揭示AI理论能力与实际应用差距大,还给出高危职业排行,分析受影响人群、安全职业等。
Vibe Coding 再升级,做世界顶尖的 Agentic Engineering!
过去18个月,AI Coding工具从‘辅助补全’到‘独立编程’质变,决定Agent产出质量核心变量从模型能力转向工程系统。文章探讨工程师角色迁移、Context Engineering、对抗Agent缺陷、长期维护及发展路径等问题。
AI是「天才」还是「话术大师」?Anthropic颠覆性实验,终揭答案!
Anthropic新研究证实Claude模型有一定内省意识,能控制自身内部状态。用「概念注入」实验,Claude Opus 4和4.1表现最佳。不过该能力不可靠、局限大,未来进化情况待察。
GPT-5,AI的「登月时刻」来了!奥特曼现场发布,三位一体博士级智能体
GPT-5正式发布,它是融合模型,准确性大幅提升,编程、写作等能力飞跃,语音模式升级,还有个性化功能,已介入医疗。API含三款模型,价格有竞争力,标志AI竞争转向「智能发布」。
科学智能2.0的「最强大脑」!上智院复旦无限光年联合发布开放平台
WAIC 2025上,上海科学智能研究院、复旦大学、无限光年联合发布「星河启智科学智能开放平台」。它以六大核心能力打造科学智能生态、驱动科研范式变革,致力于实现「科学的AI次方」效应。
Scaling没有墙!Anthropic CEO:AI实验室真相远超公众想象
Anthropic CEO Dario Amodei在摩根士丹利会议称Scaling Law未撞墙,2026年将激进加速。他用棋盘稻米寓言比喻,称当前处第40格,前39格增长只是前奏。还透露代码生成是AI能力爆发指标,Anthropic或在RSI取得进展,且重视人才文化。