大涡模拟网络」共找到 5442 篇相关文章

新闻资讯7

256G内存条涨到天价:不是内存条疯了,是算力正在变成新土地

近期,256GB内存条单根突破4万元。这并非普通DDR5,而是服务器专用内存。其价格飙升源于供需错配,模型训练对容量内存需求极端。有人认为是泡沫,也有人觉得是结构性变化。

芯师爷
新闻资讯8

让AI学会潜意识推理,Sapient发布类脑模型HRM

新加坡初创公司Sapient Intelligence发布仅2700万参数的分层推理模型HRM,在多项高难度推理任务上超越模型。它绕过模型推理困境,借鉴脑机制,训练效率高,开源后GitHub星标突破10.3k。

AIGC开放社区
算法论文8

均值至上假繁荣!北新作专挑难题,逼出AI模型真本事

当强化学习成模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三任务表现优异。

新智元
开源动态8

彻底戳穿AI「失忆症」!超越OpenAI全局记忆,中国队开源LLM记忆操作系统

语言模型有「记忆」缺失问题,国内顶尖团队打造出操作系统级AI记忆框架MemOS并开源且可商用。它将「记忆」升为「一级资源」,用MemCube封装记忆,评测显示性能优于OpenAI全局记忆方案。

新智元
新闻资讯7

微软谷歌正在力招「电工」

巨头围绕AI的人才争夺战扩至能源领域。微软、谷歌等厂纷纷扩招能源专家团队,互挖墙脚。缺电已成AI发展瓶颈,厂也在核电、核聚变项目投资,还可提高数据中心能源效率。

量子位
新闻资讯7

奥特曼瘫坐叫停“GPT-6”训练!太强触发最高安全警报

OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AI护AI,升级监控。

量子位
算法论文8

突破高分辨率图像推理瓶颈,复旦联合南洋理工提出基于视觉Grounding的多轮强化学习框架MGPO

先进多模态模型处理高分辨率图像有瓶颈,复旦和南洋理工研究者提出基于视觉Grounding的多轮强化学习方法MGPO,能让模型精准推理,还可使模型从答案反馈中涌现视觉定位能力,避免依赖昂贵标注。

机器之心
推荐文章8

真正能用好AI的企业是怎么做的?(附企业级AI落地实战手册)

数字化深入,非结构化文档成企业难题。合合信息发布白皮书,提出复杂文本智能五核心能力标准,用11个行业标杆案例展示多模态文本智能技术应用,提供可复制落地范本。

PaperAgent
新闻资讯7

Anthropic刚刚牵手SpaceX,Claude直接用上22万张H100+轨道AI算力,马斯克也要上天了

Anthropic官宣与SpaceX签算力单,拿下Colossus 1数据中心全部算力供Claude用,还将共同开发太空算力。这是在GPT - 5.5压力下的反击,且Anthropic此前已签多笔算力单。

鲸选AI
算法论文8

模型越聪明越“不听话”?MathIF基准揭示AI服从性漏洞

上海人工智能实验室与香港中文学研究团队发布论文,用MathIF基准揭示模型“聪明”和“听话”有矛盾,越擅长推理越易忽略指令,还分析了原因并给出让模型更“听话”的方法。

深度学习自然语言处理