算力大考」共找到 5560 篇相关文章

开源动态8

文心模型 4.5 系列正式开源,涵盖 10 余款模型

6月30日,百度正式开源文心模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。可在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新多,性能表现优。

AI前线
新闻资讯7

AI浪潮下的算力租赁:欺诈套利、资本炒作、主体脱钩

AI浪潮下,算力租赁市场乱象丛生,有上市公司‘炒概念’推高股价,消纳方套壳毁约‘零成本’,租赁方为订单内卷。不过,市场也在自我调整,国家也有调控举措,行业有望回正轨。

芯师爷
新闻资讯8

深度 | OpenAI携手博通自研芯片:算力终局或是垂直整合?

OpenAI与博通战略合作,2026年下半年推进研发,将部署100亿瓦定制AI芯片系统。这标志其从算力采购转向定义,是摆脱英伟达依赖的标志事件,推动AI芯片市场进入新格局。

芯师爷
开源动态8

腾讯开源WMT2025冠军模型:拿下30个第一,同类最佳

昨晚腾讯开源WMT2025冠军翻译模型Hunyuan - MT - 7B,它在31种语言测试中获30个第一,成同类最佳。文中介绍其架构、训练过程,还通过多场景翻译案例展现优势,有望推动高质量翻译普及。

AIGC开放社区
新闻资讯7

315曝光的“AI投毒”原理:GEO这样操控模型推荐

央视3·15晚会揭开AI“投毒”灰色产业链,利用GEO操控模型推荐。介绍了训练数据污染、检索上下文劫持、提示注入诱导攻击三种“投毒”技术,还阐述了内容生产、渠道投放、效果强化的产业链运转流程。

量子位
算法论文8

多模态模型持续学习系列研究,综述+Benchmark+方法+Codebase一网打尽!

近年来,生成式AI和多模态模型进展显著,但在动态环境下实现持续学习是挑战。中科院自动化所联合香港院AI中心系统性研究,提出综述、方法、Benchmark和Codebase,为相关人员提供全面支持。

机器之心
算法论文8

ICML 2026 | 只用少量Thinking Tokens,模型依然能深度思

近年来,CoT 推理成为提升模型复杂问题求解能力的重要路径,但带来效率问题。浙江学等团队提出 Heima 框架,将冗长 CoT 压缩为少量 thinking tokens,在减少 token 数的同时保留推理能力,已被 ICML 2026 接收。

机器之心
新闻资讯7

光刻机巨头ASML,108亿控股了一家模型公司

光刻机巨头ASML领投法国AI明星公司Mistral AI的C轮融资,砸13亿欧元成第一股东,推高其估值至100亿欧元。Mistral开源与商业化并行,ASML投资或提升光刻机效能。

量子位
算法论文8

LLM-in-Sandbox:给模型一台电脑,激发通用智能体能力

来自中国人民学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
新闻资讯7

模型能复刻这些系统吗?ProgramBench给出了残酷答案

斯坦福NLP组发布ProgramBench,用200个完整代码库重建任务测试主流模型,要求模型仅根据可执行文件还原如SQLite等项目完整代码,结果所有模型实际解决率为0%,说明模型更擅模仿代码表面结构。

AI工程化