人类挑战」共找到 2181 篇相关文章

算法论文8

24小时、78轮实验、持续迭代,AiScientist自己把最优解一步一步逼出来了

中国人民大学高瓴人工智能学院的AiScientist挑战让AI持续推进研究工程。它采用“thin control over thick state”设计,通过分层编排和File - as - Bus等方式,在多任务上表现出色,为AI科研工程补上关键底座。

PaperAgent
开源动态7

110万美元悬赏!AMD发起全球战书:谁能打破DeepSeek与Kimi的推理速度极限?

AMD与GPU MODE联合发起2026线上黑客松,向全球发榜。挑战赛设110万美元奖池,分预选赛和决赛,要对核心GPU算子打磨、挑战明星模型,代码须可合并,给出了赛程安排及参赛方式。

AI科技大本营
产品应用7

The Batch:924|GPT-5.4:性能更高,价格也更高

OpenAI更新旗舰模型GPT-5.4,有Thinking和Pro两个版本,扩展工具使用能力,多基准测试达当前先进水平,但定价高。虽在部分任务表现超Claude,挑战Gemini地位,不过成本也更高。

DeeplearningAI
算法论文8

复杂空间推理新SOTA,性能提升55%!中山大学新作SpatialDreamer

中山大学等机构推出SpatialDreamer,模拟人类空间认知过程,构建闭环推理流程,还提出GeoPO解决奖励稀疏问题,构建SpatialDreamer - SFT数据集。实验显示其在多基准达SOTA,为AI空间智能发展开辟新路径。

新智元
产品应用7

阿里,悄咪咪在海外上线全新 Agent Coding 产品

阿里在海外推出 Agent Coding 产品 Qoder,个人版免费试用。随着 LLM 技术发展,AI 辅助编码范式改变。Qoder 探索发挥 AI 潜力、解决开发挑战,有透明化等功能及增强上下文工程理念,还能自动选模型。

特工宇宙
新闻资讯7

OpenAI即将发布:开源模型和浏览器

OpenAI将发布AI驱动的网页浏览器挑战谷歌Chrome,或集成代理Operator实现智能网络体验。还准备下周四发布类似o3 mini的开源模型,不再是微软Azure独家。谷歌也可能很快发布Gemini 3。

AI寒武纪
开源动态7

LLM 的记忆问题「很快」就不再是问题了?

当前智能体范式转变,AI Memory 成核心基石,分化为「Agent Memory」与「LLM Memory」。开源项目 OpenClaw 引发热议,其「长效记忆」让 AI 记忆问题形成边界,不过 LLM Memory 仍面临挑战

机器之心
新闻资讯8

《多模态大语言模型技术发展报告》正式发布 | 中科算网算泥社区

2月5日,中科算网算泥社区发布《多模态大语言模型技术发展报告》。报告回顾多模态大模型发展历程,剖析核心技术创新,展示应用实践,分析挑战与机遇,为各界提供参考,推动多模态AI技术发展。

AIGC开放社区
推荐文章8

OpenAI 万字报告: 不要再卷Agent了~

OpenAI《How People Use ChatGPT》报告显示,73%的ChatGPT用途与工作无关,用户多将其用于实用建议、信息查询和写作。Asking对话占比及满意度更高,机会藏在人类惰性里。

探索AGI
新闻资讯7

图灵得主Yoshua Bengio,开始警惕AI有意识了

图灵得主Yoshua Bengio和学生在Science发文探讨AI意识问题。文章未明确AI是否有意识,而是讨论科学界和公众信念的演变及把AI当有意识生命体的风险,还提及计算功能主义等相关理论。

机器之心