在离线混部」共找到 8177 篇相关文章

产品应用8

刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude

阿里巴巴突袭发布新一代基座大模型Qwen3.8 - Max,它总参数量达2.4万亿,多场景表现出色,权威榜单冲进全球第一梯队,性能直逼Claude,且价格实惠,实测反馈良好。

量子位
算法论文8

ICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」

文章介绍了AdaResoner模型,它学会‘何时用工具’,拼图推理上击败GPT - 5。Google为Gemini 3 Flash引入‘Agentic Vision’,与AdaResoner殊途同归。AdaResoner有独特训练方法,提升小模型性能。

机器之心
新闻资讯8

范式跃迁:LLM + EC重构算法设计范式,华为&港城大夺冠CVRP国际顶级赛事

近日,华为与港城大联合团队‘OptVerse - CityU’CVRPLib BKS全球挑战赛夺冠。他们用‘大模型(LLM)+进化计算(EC)’架构,刷新98个历史最优解,51个设新纪录,验证AI算法设计潜能。

机器之心
新闻资讯7

OpenAI将发布AI Agent浏览器,挑战谷歌Chrome

路透社消息,OpenAI将未来几周发布AI Agent驱动的网络浏览器,或挑战谷歌Chrome。其设计让部分交互聊天界面完成,还能整合产品自动执行任务,不过也面临激烈竞争。

AIGC开放社区
新闻资讯8

智源悟界·Emu3.5发布,开启“下一个状态预测”!王仲远:或开启第三个 Scaling 范式

2025年智源发布悟界·Emu3.5,“Next-Token Prediction”基础上实现“Next-State Prediction”。它能力全面提升,或开启第三个Scaling范式,还预训练、强化学习、推理加速上有技术创新。

AI前线
新闻资讯7

Markdown要凉…卡帕西也站HTML了

Anthropic工程师Thariq发文呼吁抛弃Markdown,力推HTML,认为其信息密度、可读性等方面优于MD。卡帕西也认可此观点。不过HTML存费token、版本控制难等问题,文中也给出了应对建议。

量子位
产品应用8

准确率轻松翻倍!不烧钱微调,AI靠“写日记”实现能力跃升

Memento - Skills系统抛弃大量算力微调模型参数的方式,靠读写反思、“写日记”式学习机制,不改变模型参数下实现能力跃升,GAIA和HLE基准实验中准确率显著提高。

AIGC开放社区
算法论文8

快慢Reasoning综述!

大型语言模型复杂推理任务中有‘无差别计算’缺陷,阻碍其多场景应用。本文提出双层效率优化框架,梳理两类前沿技术,通过实验揭示瓶颈,为轻量化推理指明路径。

深度学习自然语言处理
新闻资讯8

GPT-6 Astra 正式登场:烧了 10 万块 GPU、多项跑分逼近满分,OpenAI 总裁:我们迎来 AGI 时代

今天凌晨,OpenAI正式发布GPT - 6 Astra。它多项跑分逼近满分,OpenAI总裁称其或意味着AGI时代开始。该模型多方面能力领先,安全措施升级,将‘未来几天’面向部分用户推出。

AI前线
算法论文8

AAAI 2026 Oral | 告别注意力与热传导!北大清华提出WaveFormer,首创波动方程建模视觉

北大清华团队AAAI 2026 Oral论文中提出WaveFormer,首创用波动方程建模视觉。它将特征传播写成欠阻尼波动方程,实现频率 - 时间解耦,多任务验证中速度、效率与精度全面超越。

机器之心