大模型技术」共找到 10342 篇相关文章

开源动态8

小红书hi lab首次开源文本模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,小红书hi lab团队首次开源文本模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
算法论文8

AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为

2026年4月28日,Anthropic联合剑桥学发布论文,提出“内省适配器”技术,可让模型用自然语言“坦白”微调中学到的行为。该技术在AuditBench基准测试等实战中表现出色,但也存在高误报率等局限。

AI科技评论
产品应用7

数字技术工人已到岗!时序模型+Agent已掌握了工厂生产管控技术,比人类更懂工况

基于时序模型和Agent的数字技术工人,能承担生产操作等关键任务,接手复杂工业环节。国内AI团队打造的河谷平台构建智能体,自研底层技术,以工艺维度训练,上岗快,极峰科技还创新商业模式。

量子位
新闻资讯8

连续发布两款万亿参数模型,蚂蚁 AI 来势汹汹

国庆期间模型行业热闹非凡,各团队产品侧重不同。蚂蚁百灵模型团队在十天内连续发布并开源两款万亿参数模型 Ling-1T 和 Ring-1T-preview,引发关注。万亿参数模型难训,国内达到此规模的屈指可数。Ling-1T 综合性能出色,应用场景广泛。蚂蚁选择开源,意在构建开放 AGI 生态。

AI科技评论
算法论文7

模型追逐星辰海,GPT和Gemini国际天文奥赛夺金

新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。

机器之心
开源动态8

字节跳动开源文档解析模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!

字节跳动开源文档解析模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用多领域。技术架构基于视觉 - 编码器 - 解码器,训练集超3000万个样本,安装推理简单,比同类更具竞争力。

小华同学ai
新闻资讯7

王田苗三问具身牛:模型还在「拨号上网」,机器人靠什么拿下真实订单?| WRC 2026

在2026世界机器人会的圆桌论坛上,王田苗向具身智能头部企业CXO抛出尖锐问题。嘉宾围绕量产卡点、模型应对物理世界不确定性及产业终局生态展开讨论,并就商业化落地节奏达成共识。

AI科技评论
新闻资讯7

Redis 之父:哪怕被喷我也得说,AI 远远落后于人类程序员!开发者跟评:用模型气得我自己写代码都有劲儿了

Redis 之父 Antirez 分享研发经历,认为人类程序员比模型出色,人类能打破常规想出更有效解法。他在修复 Redis 复杂 bug 时,与 Gemini 2.5 PRO 交流,凸显人类创造力优势。开发者看法不一,AI 虽成工具但缺创造力。

AI前线
新闻资讯7

“机器人一次性卖完太亏!”真机智能刘智勇:今年中国本体厂商将淘汰,拼的是世界模型

本文是《2025 年度盘点与趋势洞察》系列之一,InfoQ 采访真机智能刘智勇,探讨具身智能。涉及 VLN 技术进展、世界模型作用、落地瓶颈等,还提及商业模式创新,认为 2026 年本体厂商将收缩。

AI前线
新闻资讯7

初稿抢先看!13家单位共同起草全国首部AI模型私有化部署标准智合标准化建设

由智合标准中心组织起草的《人工智能模型私有化部署技术实施与评价指南》团体标准立项,这是国内首部相关标准。它全流程覆盖、多方面融合、三方协作,能解决企业痛点,现征集起草单位和人,5月15日开研讨会。

AI工程化