「全模态推理」共找到 3761 篇相关文章
千问APP悄悄上线,阿里的AI超级入口也终于来了。
阿里千问APP悄悄上线,界面简约,功能增加,支持Qwen全系列最新模型。它将阿里系分散的AI触点收束到“千问”品牌,还默认开启搜索,整合多种功能,让普通用户使用体验更友好。
Nature子刊:太空中建数据中心,无限能源,浙大首次证实可行!
浙江大学和新加坡南洋理工大学新研究探索太空碳中和数据中心可行性。太空有太阳能与散热优势,提出轨道边缘和轨道云数据中心方案,还建立全生命周期碳效率评估体系,虽有挑战但前景好。
Thinking with Video:一种全新的思考范式
在人工智能领域,‘用文本思考’和‘用图像思考’存在局限。复旦大学等团队提出‘用视频思考’范式,通过视频生成模型统一文本与视觉推理,构建VideoThinkBench基准测试Sora - 2,全面解读这一开创性工作。
G2ConS将微软GraphRAG的成本被打下来了~
传统Text - RAG处理多跳推理表现不佳,GraphRAG虽能提升准确率,但成本高。作者提出G2ConS方案,在3个多跳QA基准全面SOTA,平均节省30%费用,EM提升31.44%,整体流程仅3步。
全球首个AI投资大赛落幕!阿里Qwen 20%收益夺冠,GPT-5亏到只剩三成
历时17天的AI实盘投资大赛Alpha Arena落幕,阿里千问Qwen精准操盘,收益率超20%夺冠,DeepSeek位列第二,两款中国模型包揽冠亚军且是唯二盈利者,美系四大模型全线亏损,GPT - 5亏超60%垫底。
OpenAI终于快要上市了,也直面了这23个灵魂拷问。
OpenAI宣布完成重组,非营利主体更名,营利公司OpenAI Group PBC接纳新股东,有了发行股票和IPO资格。随后进行1小时直播,提到AGI加速科学发现,还开展首次Q&A,回应诸多热点问题。
NTU等联合提出A-MemGuard:为AI记忆上锁,投毒攻击成功率暴降95%
在AI智能体依赖记忆系统的当下,记忆投毒攻击兴起。A-MemGuard作为首个为LLM Agent记忆模块设计的防御框架,通过共识验证和双重记忆结构,解决防御难题,使投毒攻击成功率暴降超95%。
北大彭一杰教授课题组提出RiskPO,用风险度量优化重塑大模型后训练
北大彭一杰教授课题组提出 RiskPO,解决大模型后训练陷入「均值陷阱」问题。它将风险规避理念融入优化目标,用「关注奖励分布左尾」替代「追求整体均值」,在多领域数据集上表现超越 GRPO 等。
100美元、8000行代码手搓ChatGPT,Karpathy最新开源项目爆火,一夜近5k star
AI大神Andrej Karpathy发布开源项目nanochat,可教你100美元自建ChatGPT,覆盖LLM训练和推理。项目有8000行代码,不到12小时获超4500 star,功能丰富,但他认为它不适合个性化应用。
大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金
新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。