推理密集型信息检索」共找到 2635 篇相关文章

开源动态8

1万亿参数Ling-1T开源,国产LLM牛了~

Ling-1T是Ling 2.0系列首款旗舰“非思维”模型,总参数量达1万亿。预训练数据超20万亿token,支持128K上下文长度。在多项任务中表现出色,是目前已知最大的FP8训练基座模型,已完成全面评测。

PaperAgent
新闻资讯7

“iFold”,苹果AI新成果

苹果发布基于流匹配的蛋白质折叠模型SimpleFold,被戏称“iFold”。它用通用Transformer模块搭配流匹配生成范式,3B参数版本追平谷歌AlphaFold2性能,还解决了传统模型算力依赖问题,效率高。

量子位
新闻资讯7

Nano Banana核心团队:图像生成质量几乎到顶了,下一步是让模型读懂用户的intention

这是对Nano Banana核心团队的专访。团队认为图像生成质量提升空间有限,未来关键在模型可表达性和读懂用户意图。还探讨了图像模型发展趋势、应用场景、产品设计、评估方式等,提及与传统工具将长期共存。

Founder Park
算法论文8

科研智能体「漫游指南」—助你构建领域专属科研智能体

该综述提供科研智能体构建指南,提出三级分级系统,阐述构建流程与能力增强方法,涵盖知识组织、注入、工具集成,还提及基准评估和未来研究方向,促进AI与自然科学融合。

机器之心
新闻资讯8

OpenAI和Anthropic罕见互评模型:Claude幻觉明显要低

OpenAI和Anthropic罕见合作,互相授予API权限评估模型安全与对齐情况并发布报告。双方派出多模型参与,从指令层次、越狱、幻觉、欺骗策略等方面评测,呈现各模型优缺点。

量子位
算法论文7

一场「狼人杀」,考倒了一堆大模型

南开大学等机构设计 InMind 评测框架,在 Avalon 游戏对 11 个前沿大模型测试。多数模型停留在表层模仿,仅少数推理增强模型有初步‘风格敏感性’,未来人机交互应关注‘像不像’。

AI科技评论
算法论文8

颠覆互联网的下一波浪潮:Agentic Web来了!

本文介绍全新范式 Agentic Web,它由 AI 智能体组成,用户发目标,AI 自动完成任务。文章从多方面解析这场范式革命,还阐述应用场景、面临挑战,指出其是互联网重大转折,但落地需解决诸多难题。

机器之心
新闻资讯8

刚刚,Claude 4.1 发布

刚刚,Anthropic 发布 Claude Opus 4.1,对智能体任务、编码和推理能力全面升级,付费用户已可使用。未来几周还有重大改进。它在多方面能力提升,碾压对手,网友反应热烈。

AGI Hunt
开源动态8

通义实验室大火的 WebAgent 续作:全开源模型方案超过GPT4.1 , 收获开源SOTA

WebAgent续作《WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization》提出对information-seeking任务形式化建模,设计训练数据合成方法,全开源模型方案在GAIA评测获SOTA表现,还补足了训练数据不足问题。

机器之心
产品应用7

重塑浏览器!微软在Edge加入AI Agent,自动化搜索、预测、整合

今天凌晨微软官网宣布在浏览器Edge中加入Copilot模式,它像多层级混合智能体,能自动执行搜索、整合等操作,有标签筛选等创新功能,可提升效率,还保障隐私安全,已免费开放。

AIGC开放社区