人在循环中」共找到 8866 篇相关文章

推荐文章8

Karpathy:很多App就不该出生、类唯一护城河只剩理解、CPU将沦为配角

Sequoia Ascent峰会上,AI先驱Andrej Karpathy分享对2026年技术浪潮思考。他认为LLM是新物种,让部分旧软件多余,未来软件接口或为说明文本,还谈及模型能力不均匀性、创业机会、智能体经济及类价值。

机器之心
开源动态8

多模态长文本理解测评首发:46款模型无一攻克128K难关

香港科大等研究者联合提出MMLongBench,用于评估多模态模型长文本理解能力。它覆盖5大类型任务的16个数据集,对46个模型测试显示,闭源和开源模型长上下文任务均面临挑战,OCR和跨模态检索能力是瓶颈。

量子位
算法论文8

只要9美元!LoRA+强化学习,DeepSeek 1.5B推理性能暴涨20%

南加州大学团队基于LoRA的强化学习训练1.5B推理模型,AIME 24测试上性能提升超20%,成本仅9美元。开源Tina模型结合三大关键技术,与SOTA模型相比竞争力强,研究者还对其有效性提出假设。

新智元
产品应用7

AI 真的能帮你微信下单了!

微信支付发布「AI 专属卡」,WorkBuddy 率先接入。用户 WorkBuddy 能让 AI 找外卖、选套餐、领券、下单及支付。介绍了使用步骤,还说明 AI 专属卡支付安全,绑定还有彩蛋。

腾讯技术工程
开源动态8

字节会师何恺明!开源连续扩散语言模型Cola DLM

字节会师何恺明,开源连续扩散语言模型Cola DLM,释出论文、代码等。该模型跳出离散token束缚,把生成过程交给连续空间,实验中展现出稳定scaling趋势,其动机是表征而非diffusion。

量子位
新闻资讯7

星火燃动海淀!投海Tech Show即将登场,提前解锁创新「星火」档案|甲子光年

4月23日投海Tech Show将海淀启幕,拒绝形式主义,以真实内容和沉浸式体验展示前沿科技。众多创业者携项目而来,涵盖AI、硬科技等领域,现场还有互动环节,选出最“夯”项目。

甲子光年
算法论文8

后训练中的RL已死?MIT新算法挑战传统后训练思维,谢赛宁转发

MIT研究员提出RandOpt新算法,挑战传统后训练思维。该算法通过随机扰动和集成突破限制,多任务中表现出色,揭示了预训练模型权重空间的“神经丛林”现象,引发AI社区关注。

机器之心
新闻资讯7

OpenAI开除内鬼!拿着改变世界的机密去赌博,一夜狂赚几十万

OpenAI开除一名利用公司核心机密预测市场下注牟利的员工。调查发现过去一年多,60个神秘钱包做出77次精准押注。不止OpenAI,其他预测市场平台也出现内幕交易案件,平台陷入尴尬处境。

新智元
算法论文8

给GRPO加上运筹外挂让7B模型比肩GPT-4!Li Auto团队发布多目标强化学习新框架 | ICASSP 2026

文本摘要质量评估需兼顾多维度,但开发者优化时易顾此失彼。Li Auto团队提出HVO,基于GRPO框架,让7B模型摘要任务媲美GPT - 4,且生成内容更简洁,成果被ICASSP 2026接收。

量子位
算法论文8

沉默的进化:LatentMAS 如何通过“潜意识通信”重塑多智能体协作?

这是对多智能体协作领域突破性研究的深度解读。论文提出LatentMAS框架,让智能体直接交换“思维向量”,实现“机器心灵感应”,性能、速度和Token消耗上全方位碾压传统文本交互模式。

深度学习自然语言处理