「算力大考」共找到 5684 篇相关文章

算法论文8

用SFT打出RL的效果?微软联合提出高效后训练算法

大模型后训练阶段,SFT 和 RL 各有优劣。微软等联合提出新工作,量化 SFT 和 RL 在数据层面的差距,提出 IDFT 和 Hinted Decoding 等高效后训练技术,实验显示新方法泛化超 SFT、效率超 RL。

机器之心
新闻资讯7

千问模型预览版杀到全球第6,马斯克称中国将赢得地球上的AI竞赛!

LMArena更新榜单,阿里千问新旗舰预览版获1464分,全球排第六、中国第一。阿里在全球大模型实验室排第五,全球前十中有五家中国公司。千问3.5预览版表现出色,正式版值得期待。

探索AGI
产品应用7

智谱发布龙虾基座模型GLM-5-Turbo,还适配了一个养龙虾的盒子

智谱发布专为龙虾场景深度优化的基座模型GLM - 5 - Turbo,从底层训练重塑,增强四项核心能力。发布评测基准ZClawBench,模型表现领先。还推出龙虾套餐和安全管理体系,助力企业实现算力自由与安全管控。

AIGC开放社区
新闻资讯7

阿里AI重组:集团CEO吴泳铭亲征!「Token为王」全面决战ASI

阿里宣布成立全新的Alibaba Token Hub(ATH)事业群,由CEO吴泳铭挂帅,收拢通义千问等团队。这标志阿里AI战略转向,告别技术至上,聚焦B端商业变现与算力应用,围绕Token构建工业化流水线。

新智元
算法论文8

复旦北大联合美团LongCat提出TDAR:用“粗思考,细求证”破解Block Diffusion的速度精度悖论

复旦大学、北京大学联合美团LongCat提出Block Diffusion推理模型Test-Time Scaling新框架TDAR,引入‘粗思考,细求证’范式与有界自适应置信度解码,打破速度与精度零和博弈,在多基准测试表现出色。

机器之心
新闻资讯8

GPT-5.4暴击华尔街!白领工作灭绝时刻,美国5.7万科技岗位被血洗

OpenAI发布GPT - 5.4震惊AI圈。它能力超强,能颠覆白领工作,如让Excel变数据分析平台、超越咨询投行律所。美国科技行业岗位大减,但AI岗位需求飙升,诺奖得主警告AI会加剧不平等。

新智元
开源动态8

14B规模竟也能单卡实时生成视频?多亏这个强大的开源底座

春节期间 Seedance 2.0 爆火,字节跳动等开源视频模型 Helios 家族,参数量 14B,单卡生成速度达 19.5 FPS。它与 UniWorld-OSP2.0 技术栈同源,后者是超百亿级视频生成大模型,有诸多技术突破。

机器之心
开源动态8

OpenClaw 深度解析:一只龙虾凭什么震撼全世界

万字长文深度解析OpenClaw,阐述其核心原理、创新亮点以及对AI行业的深远影响。解读为何大厂难以打造类似产品,剖析简单任务实现困难的根源,还探讨了其设计机制、应用场景、潜在问题及应对策略。

AI科技评论
产品应用8

阿里Qwen3.5小模型发布:0.8B参数就能处理视频,边缘AI时代真的来了

阿里通义千问发布Qwen3.5系列四款小模型,采用Gated DeltaNet混合注意力机制。有原生多模态设计,解决“内存墙”问题。在多基准测试中表现出色,开发者反响好,但也存在幻觉级联、调试局限等问题。

AI工程化
新闻资讯8

比肩OpenAI Simple Codex,中国团队闯入Terminal-Bench全球第二!

Anthropic和OpenAI推出新模型后,基础大模型较量进入实战比拼。中国团队Feeling AI的CodeBrain - 1在Terminal - Bench 2.0榜单排全球第二,它聚焦代码编写运行,还能动态调整计划策略,展现出高含金量。

机器之心