人类在环」共找到 8668 篇相关文章

新闻资讯7

DeepSeek-V3.2被找出bug了:疯狂消耗token,答案还可能出错,研究人员:GRPO老问题没解决

DeepSeek-V3.2虽强且火爆,但被发现存bug,即浪费token问题。研究者指出这源于GRPO算法的‘隐藏偏见’,虽修正了‘难度偏见’,但‘长度偏见’仍,官方也承认token效率是挑战。

量子位
算法论文8

刘鹏飞组提出Agent领域的少即是多:智能不于数据堆砌,78个样本训练出超强Agent,128倍效率提升

刘鹏飞组论文《LIMI: Less is More for Agency》提出颠覆性观点,认为Agent智能培育关键数据质而非量。LIMI用78个样本AgencyBench得分超基线模型,实现128倍数据效率提升,为Agent开发提供新路径。

深度学习自然语言处理
开源动态8

故障率降低100倍,微软突破性技术破解AI算力浪费大难题

AI数据中心,网络链路高故障率制约算力释放。微软“ACM SIGCOMM 2025”大会公布MOSAIC技术,将链路故障率降100倍,实现50米长距传输、最高68%功耗降低,为大规模AI集群提供支撑。

AIGC开放社区
新闻资讯8

重金挖AI人才的Meta,又投资100亿美元建数据中心

MetaAI领域双线作战,一边以四年3亿美元薪酬挖AI人才,引得OpenAI震动;一边投资100亿美元建Hyperion数据中心,虽有反对声音,但政府看好。这显示MetaAI竞赛的决心。

AIGC开放社区
开源动态8

又一个Kimi K3下周开源!Qwen3.8-Max编程、办公、科研都能自己干了

Qwen3.8-Max是Qwen家族迄今最强模型,2.4万亿参数,下周将开源权重。它多项基准测试中表现出色,能连续自主工作数天,编程、办公、科研、长周期任务、多模态等方面全面提升。

AIGC开放社区
算法论文8

清华、快手提出AttnRL:让大模型用「注意力」探索

清华和快手团队提出新框架AttnRL,引入注意力机制提升过程监督强化学习效率与性能。它解决传统方法分支位置选择和采样策略上的效率问题,实验显示多基准测试中表现优异。

机器之心
开源动态7

Qwen-Image-Edit 更新:多图编辑支持,单图一致性增强

阿里8月发布的Qwen-Image-Edit迎来月迭代版本Qwen-Image-Edit-2509,可https://chat.qwen.ai/使用。更新支持多图编辑,有多种玩法,还提升单图一致性,人物、商品、文字编辑上表现显著。

AI进修生
算法论文8

Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?

LLM推理依赖‘思维链’,传统方法离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。

深度学习自然语言处理
产品应用8

海外华人15人团队打造,统一理解与生成的图像模型,超越Nano banana登顶图像编辑

海外AI初创公司Luma发布图像生成模型Uni-1,将「理解」与「生成」统一,多任务测试中表现优于GPT Image 1.5和Google Nano Banana Pro。它采用独特架构,提升理解能力,由华人团队打造。

机器之心
新闻资讯8

黄仁勋、李飞飞、Yann LeCun等六位AI顶级大佬最新对话:AI到底有没有泡沫?

六位 AI 顶级大佬黄仁勋、约书亚·本吉奥等齐聚参加峰会对话,回顾 AI 发展历程,分享职业生涯“顿悟时刻”,探讨 AI 是否有泡沫、何时达人类智能水平等问题,各抒己见展现对 AI 未来的不同思考。

AI前线