性能提升」共找到 4074 篇相关文章

开源动态7

这个框架让大模型省下50%内存,合并专家不如直接删掉?

Cerebras Research提出REAP框架,通过专家剪枝和合并技术压缩SMoE模型,能让模型‘瘦身’并保持性能,可省50%内存,但社区测试有不同结果,且存在调度开销等问题。

AI工程化
产品应用7

IDE?字节TRAE搞了个大升级,现在能全流程开发了

国内首个原生AI IDE TRAE推出SOLO正式版,升级为集成多智能体协同架构与全流程开发工具链的AI协作平台。新增SOLO Coder智能体,三栏布局更高效,升级思路贴合开发者需求。

量子位
开源动态8

Kimi K2 Thinking突袭!智能体&推理能力超GPT-5,网友:再次缩小开源闭源差距

Kimi K2 Thinking发布并开源,主打“模型即Agent”,能边思考边用工具,连续工具调用200 - 300次。在多评测基准超GPT - 5等闭源模型,代码权重遵循MIT协议,可在官网和应用实测。

量子位
算法论文8

AI 的本质不是算力,而是「上下文革命」

上交大刘鹏飞团队提出人工智能本质是“上下文革命”,在论文中把“上下文”提升为智能系统核心结构,提出“上下文工程”学科框架,通过实验揭示智能发展规律,为AI发展指明新方向。

AI科技评论
新闻资讯8

中国顶尖科学家数量已超越美国

中国科研正从跟跑变领跑,国际合作领衔比例上升,与美欧渐趋均衡。人工智能等关键赛道加速发展,顶刊与高被引成果、顶尖人才增多。借‘一带一路’放大影响力,重绘全球科技版图。

新智元
新闻资讯8

AI被严重低估!AlphaGo缔造者罕见发声:2026年AI自主上岗8小时

AlphaGo作者Julian发声,指公众对AI认知落后,低估其进展。实验室里AI已能完成复杂任务且指数进化。研究显示AI能力逼近专家,2026年或可自主工作8小时,2027年或超人类。也有人质疑趋势可靠性。

新智元
新闻资讯7

股价翻倍的英特尔,ICU门口的“芯片工厂”

英特尔近两月获多方资金,股价涨幅超116%。但代工业务问题多,如18A产能不足、技术指标不出色、持续亏损等。其要想追上台积电,需合理规划先进节点投资及收缩成熟制程扩张。

芯师爷
开源动态7

DeepSeek-OCR降本增效,10×暴力压缩还能读得清

Deepseek - OCR模型发布,通过光学压缩技术解决长文本处理的计算效率问题,能控制大模型token消耗成本。介绍了其架构设计、数据引擎及训练流程,还展示其用较少token超越现有模型的能力。

CourseAI
开源动态7

Glyph:文本转图片解决长上下文困境,智谱把“DeepSeek-OCR”具像化了

传统 token 扩展方式遇算力成本天花板,DeepSeek 与智谱都想到让 AI“看”文字思路。智谱发布 Glyph 框架工程化实现此思路,将文本转图片处理,降低计算成本,有不错效果但也存在排版敏感等限制。

AI工程化
新闻资讯7

万亿美金赛道,迎中国破局者!AI重构新材料,「智造」时代开启

国产自研RhinoWise智能平台可将材料研发周期从数年缩至数月。背后的鼎犀智创完成数千万级融资,其以‘设计–模拟–制备–表征’闭环提升效率,产品将与国内龙头企业合作落地。

新智元