「科学推理能力」共找到 4793 篇相关文章
Mamba-3惊现AI顶会ICLR 2026!CMU知名华人教授一作首代工作AI圈爆红
Transformer有力挑战者Mamba的最新版本Mamba-3进入ICLR 2026盲审。它有三大改进,在长文本处理、实时推理和成本优化有优势。此外,FBAM也从不同角度探索Transformer下一代框架。
海光整并曙光后,是否会放弃服务器?
5月25日晚,海光信息将合并曙光信息的公告引发关注。二者关系密切且在产业链位置特殊。海光发展势头好,吸并或为提升系统能力。对于曙光是否放弃服务器业务有不同看法,整合还可能冲击华为。
00后中国女孩0产品创业实现3亿估值:斯坦福数学博士的AI量化野心
00后中国女孩洪乐潼创业一鸣惊人,虽无产品和用户,但目标估值3 - 5亿美元。她是斯坦福华人数学博士,公司Axiom想为量化和对冲基金公司提供解决数学问题的模型能力,获投资人关注。
解码加速15倍!EdgeRazor助推大模型在PC/移动端“狂飙”
大语言模型参数膨胀,端侧部署难,量化成主流轻量化方案。开源工具库EdgeRazor由南京大学和微软联合推出,采用MPQAD打破极低比特大语言模型“能力塌陷”,在性能、效率、易用性等方面表现出色,打通AI全生态链路。
盘点过去一个月,大厂悄咪咪上线的 CLI 和 Skill
过去一个月,淘宝、微信支付、支付宝等大厂纷纷将核心能力以 MCP、Skill、CLI 形式交给 AI Agent 调用。如淘宝支持 AI 完成购物操作,支付巨头开放 AI 接入方案,滴滴和千问有打车 Skill 等。
iPhone 17 Pro居然能跑8B大模型!
iPhone 17 Pro竟能跑8B大模型,如Qwen3 - 8B,推理较流畅。作者换机一是因eSIM,二为拍视频。其认为AI普及需端侧落地,此机芯片性能是好信号,盼出优质iOS客户端。
社区供稿丨MiniCPM-V 4.5 技术报告正式出炉
上个月开源的多模态模型 MiniCPM-V 4.5 广受好评,今日其技术报告出炉。报告从架构、数据和训练三方面探索高效路径,提出三大技术,使模型在多任务上突破,小参数规模下性能和推理速度佳。
一夜之间,Claude Code删掉了80%系统提示词
本周五,Anthropic 技术团队成员 Thariq Shihipar 介绍新一代大语言模型工程趋势变化。Anthropic 发现旧提示词工程范式在新一代强推理模型发布后或过时,新的 Claude.md 应精简,大砍系统提示词后可把特定任务上下文交给 Skill。
C罗刚头球破门,AI解说脱口而出!全模态实时流太狠了
2026世界杯正热,阿里云在Flink Forward Asia 2026大会宣布Apache Flink 3.0进入Agentic Streaming For AI时代,推出全模态数据流处理能力,可让AI实时解说比赛。Flink 3.0解决了流式Agent数据处理难题,已有智能运维等应用场景。
2025美国艺术与科学院院士出炉!中国物理巨匠王贻芳,ImageNet作者李凯当选
2025年美国艺术与科学院新科院士公布,近250名院士来自16个国家,涵盖31个专业领域。计算机科学领域有Kai Li、Dawn Song等;物理领域有王贻芳、Donna Sheng等;神经科学领域有Yang Dan、Kang Shen等,微软CEO纳德拉也在名单中。