「低精度训练」共找到 3124 篇相关文章
为老父亲做的桌面 Agent,不小心在 GitHub 霸榜一周
OpenHuman是TinyHumans AI构建的开源桌面AI Agent,登上GitHub榜单并霸榜一周。它想成桌面级个人AI操作系统入口,但使用体验与愿景有差距,工程架构有亮点,也存在安全风险,其产品哲学有价值但执行粗糙。
从Foundation Model到Physical AI,三星「杀入」大模型核心战场
三星正快速进入大模型核心战场,构建Foundation Model体系,采购GPU用于AI基建。它提出Meki架构、M2RL训练范式和LiveClawBench评测体系,由AI Model TF团队推进,负责人是唐业辉。
留给人类数学家的悬赏不多了!谷歌DeepMind一口气解决9道埃尔德什问题
AI进军数学界速度惊人,谷歌DeepMind发布由Gemini驱动的AlphaProof Nexus框架,解决9个埃尔德什开放问题,还证明44个猜想、搞定代数几何难题、改进凸优化理论边界,推理成本低且代码开源。
Anthropic开源Claude小企业插件:不用写prompt,15套现成流程顶半个运营团队
Anthropic开源面向小企业的Claude插件,有15个基础技能、15套业务工作流及懂大白话的路由模块。支持Claude Cowork和Claude Code,操作待确认。日常使用几乎无学习成本,安装配置较简单,亮点是降低交互门槛。
中国科学家首创万能热缩电子皮肤,加热即贴合,怎么扭曲都不坏
中国科学院理化技术研究所国瑞研究员等联合团队发明“热缩”制造新方法,将半液态金属电路印在热塑性薄膜上,加热后能包裹物体表面,解决传统刚性材料电路失效问题,具高耐用性。
13人干翻Transformer!新架构SSA算力暴减千倍,成本仅Opus 5%
一款基于SSA架构的AI模型SubQ横空出世,其上下文高达1200万Token,计算量比Transformer暴减1000倍,成本不到Claude Opus的5%。打造它的Subquadratic公司仅13人,产品发布后引发AI社区不同反应。
Claude彻底起飞!狂揽亚马逊5GW算力+250亿刀,贝索斯赚麻了
4月20日,Anthropic与亚马逊签署超级大规模AI基础设施协议,1000亿美元十年砸向AWS算力,锁定5吉瓦用于训练和部署Claude。亚马逊追加投资,Anthropic营收猛增,此合作揭示AI竞争转向基础设施。
刚刚,DeepSeek多模态技术范式公布,以视觉原语思考
DeepSeek发布多模态模型并公布技术报告,提出‘以视觉原语思考’。该模型解决多模态大模型‘指代鸿沟’问题,有把坐标变思维单元、7056倍视觉压缩、精心设计冷启动数据等创新,实验在多任务上超主流模型。
“我可能不再建议学计算机”!图灵奖得主炮轰半个行业,并断言:AI Agent最后全是数据库问题
图灵奖得主 Mike Stonebraker 在访谈中称,若重新开始,不确定是否建议 18 岁的人学计算机,他认为计算机科学未来或不再是增长型行业。他还炮轰 Oracle、Google、AWS 等公司的数据库方案,对 AI Agent、大模型写 SQL 等发表看法。
PRSA 2025 | RPI Nithin Somasekharan、Shaowu Pan(潘韶武):突破柯尔莫哥洛夫屏障——面向模型降阶的可学习加权混合自编码器
本文将线性POD与非线性Autoencoder通过可学习参数融合,提出可学习加权混合自编码器架构。在多数据集验证中,该方法克服了POD和纯AE的局限,在复杂PDE系统预测中表现出色,或可降低大规模计算成本。