大模型技术」共找到 10361 篇相关文章

8

实测最强的Cowork Agent模型M2.7,这是龙虾最好的模型搭子

实测MiniMax新发布的M2.7模型,解决了Agent的笨拙感,是国内最强的Cowork Agent模型。它技能命中率高,能自进化,对办公场景做了优化,还能解决生产效率问题,加强了人设保持能力。

开源AI项目落地
产品应用8

阿里发布新一代千问旗舰模型Qwen3.7-Max,登顶最佳国产模型

5月20日,阿里发布新一代千问旗舰模型Qwen3.7 - Max。近三月千问迭代三次,Qwen3.7 - Max在多测评中表现优异,位列国产模型第一。它强化编程等能力,阿里还通过MaaS等连接各环节,布局AI基础设施。

InfoQ
新闻资讯7

codex负责人:codex就要过时了

Codex负责人称两三个月后Codex将过时,因下一代模型要处理规模并发Agent,非其能应对。Huggingface实验显示模型在不同harness下排名差异,脱离模型谈harness过时或不适配说模型Agent能力都不妥。

探索AGI
算法论文8

音频模型安全可信度的全面“体检”!6维度,清华南洋理工联手打造

南洋理工和清华团队提出新框架AudioTrust,将ALLMs评估扩至六个核心维度,探究音频模态特有问题。目前基准及平台已开发,揭示了开源与闭源ALLMs在多维度的潜在风险。

量子位
产品应用8

豆包「打电话」升级 Seeduplex:周围再吵,只认准你的声音

作者分享使用豆包语音通话功能体验,发现它换了新语音模型 Seeduplex。该模型是原生全双工语音模型,解决半双工问题,在复杂场景表现出色,还介绍其技术逻辑及对行业的影响。

特工宇宙
开源动态8

成本不到8千美元!新浪微博1.5B小模型超越近万亿参数模型

新浪微博开源的VibeThinker - 1.5B模型,仅15亿参数、训练成本不足8000美元,却在顶级数学竞赛基准击败近万亿参数模型。它采用频谱到信号原则,分两阶段训练,性能出色,成本低且数据无污染。

AIGC开放社区
开源动态8

工业级 LLM 数据工程:北京学 DCAI 团队 DataFlow 框架的架构设计与实践

2026 年模型研发从‘模型中心’向‘数据中心’演进,数据语义密度与工程精度成突破关键。北京学 DCAI 团队推出 DataFlow 框架,解决数据准备难题,其技术报告登顶 Hugging Face。该框架有多种特性,实验验证其能提升模型性能。

InfoQ
算法论文8

突破单token预测局限!南洋理工首次将多token预测引入微调,编程任务准确率提升11.67%

当前主流语言模型依赖下一token预测训练,难理解跨多token完整概念。南洋理工学提出概念感知微调(CAFT)技术,首次将多token预测引入微调,能让模型理解完整概念,多领域实验显示其可显著提升模型性能。

量子位
新闻资讯8

英伟达:RLP 让 AI 在预训练时就学会思考

英伟达研究团队发布 RLP 技术,与传统语言模型训练不同,它在预训练阶段就让模型学会'先想后说'。通过奖励机制自我监督,实验效果惊人,性能提升显著,不挑数据,打破了模型训练范式。

AI工程化
推荐文章7

亲历两场编程语言迁移“惨案”,谷歌佬揭露技术选型真相:90%决策与技术无关

谷歌佬 Steve Francia 结合自身经历,指出技术选型常受身份认同等非技术因素影响。如早期创业公司因 CTO 执意换语言错失市场,谷歌团队跟风选 Rust。还分析了背后原因及代价,并给出破局建议。

InfoQ