「多领域推理」共找到 6490 篇相关文章
3B模型性能小钢炮,“AI下半场应该训练+验证两条腿跑步”丨上海AI Lab&澳门大学
上海AI Lab和澳门大学联合发布通用答案验证模型CompassVerifier与评测集VerifierBench,填补Verifier领域循环迭代体系空白。AI下半场评估比训练更重要,当前验证方法有困境,新模型验证精度高且能用于强化学习。
OpenAI深夜祭出GPT-5,所有人能免费用!Altman:像和博士级专家对话
北京时间8月8日凌晨,OpenAI推出GPT - 5,宣称其更智能、准确,幻觉率低。还推GPT - 5 - mini和GPT - 5 - nano两款新模型,免费用户可使用部分版本。它在编程和健康领域测试表现出色,引发各界热议。
全新 AI 消息模型:Apache RocketMQ 如何让 AI 应用拥抱事件驱动架构?
AIGC浪潮下,大语言模型重塑应用开发范式,开发者构建AI应用面临诸多挑战,需可靠高效的异步通信机制。Apache RocketMQ在AI时代演进,有轻量化通信与智能化资源调度两大创新,还介绍了多场景实践。
金融智能体落地四阶段,同花顺Agent战略与实践全景
在数字化与 AI 驱动下,金融行业变革正酣。同花顺产品总监路忠文解析 AI Agent 在金融领域实践,结合案例揭示其突破传统业务边界的潜力,探讨落地挑战与趋势,还分享了公司自身 AI 探索历程与实践经验。
腾讯混元A13B用130亿参数达到千亿级效果,Flash Attention作者点赞
腾讯混元A13B模型仅130亿激活参数,却能和千亿级大模型竞争,获Flash Attention作者赞叹。它精准卡位性能与效率‘甜蜜点’,依托高质量预训练和结构化后训练,多方面表现突出且已全面开源。
OpenAI再次跳票,奥特曼:开源模型无限期推迟!
奥特曼宣布OpenAI开源模型无限期推迟,称需额外安全测试和审查高风险领域。这已是第二次跳票,此前从6月推迟到夏末。而此时竞争对手纷纷上新,此决定加剧其身份分裂质疑和社区信任流失。
DreamArt!只需一张图,生成可动的可交互物体
生成可动物体是具身智能等领域关键挑战,现有方法有局限。北大团队提出DreamArt框架,从单张图像生成可交互可动物体,经三阶段流程,表现优于基线方法,不过也存在生成不符物理规律等问题。
两张图就能重构3D空间?清华&NTU利用生成模型解锁空间智能新范式
ICCV 2025中稿的LangScene-X以全新生成式框架,仅用稀疏视图就能构建可泛化的3D语言嵌入场景。它攻克传统方法痛点,将多模态信息统一在单一模型,为空间智能领域打开新大门。
Grok 4基准测试被爆极其优异,人类终极考试成绩飙升到45%,碾压o3 和Gemini的20%
API开发者曝光Grok - 4和Grok - 4 Code测试成绩,HLE达35%,推理后飙升到45%,远超o3和Gemini的20%。其他测试也表现优异,但成绩引发争议,有人质疑数据污染,也有人支持,目前数据未官方证实。
首届国产机器人足球赛,最忙的是担架
国内首个机器人主体足球赛在北京举行,四支高校战队用加速进化T1平台参赛,全程机器人自主行动。清华火神队夺冠,不过比赛中机器人失误多。主办方预计5年提升其水平,赛事目标是2050年机器人队夺世界杯。