「人在循环中」共找到 8866 篇相关文章
Karpathy:很多App就不该出生、人类唯一护城河只剩理解、CPU将沦为配角
在Sequoia Ascent峰会上,AI先驱Andrej Karpathy分享对2026年技术浪潮思考。他认为LLM是新物种,让部分旧软件多余,未来软件接口或为说明文本,还谈及模型能力不均匀性、创业机会、智能体经济及人类价值。
多模态长文本理解测评首发:46款模型无一攻克128K难关
香港科大等研究者联合提出MMLongBench,用于评估多模态模型长文本理解能力。它覆盖5大类型任务的16个数据集,对46个模型测试显示,闭源和开源模型在长上下文任务均面临挑战,OCR和跨模态检索能力是瓶颈。
只要9美元!LoRA+强化学习,DeepSeek 1.5B推理性能暴涨20%
南加州大学团队基于LoRA的强化学习训练1.5B推理模型,在AIME 24测试上性能提升超20%,成本仅9美元。开源Tina模型结合三大关键技术,与SOTA模型相比竞争力强,研究者还对其有效性提出假设。
AI 真的能帮你微信下单了!
微信支付发布「AI 专属卡」,WorkBuddy 率先接入。用户在 WorkBuddy 能让 AI 找外卖、选套餐、领券、下单及支付。介绍了使用步骤,还说明 AI 专属卡支付安全,绑定还有彩蛋。
字节会师何恺明!开源连续扩散语言模型Cola DLM
字节会师何恺明,开源连续扩散语言模型Cola DLM,释出论文、代码等。该模型跳出离散token束缚,把生成过程交给连续空间,在实验中展现出稳定scaling趋势,其动机是表征而非diffusion。
星火燃动海淀!投海Tech Show即将登场,提前解锁创新「星火」档案|甲子光年
4月23日投海Tech Show将在海淀启幕,拒绝形式主义,以真实内容和沉浸式体验展示前沿科技。众多创业者携项目而来,涵盖AI、硬科技等领域,现场还有互动环节,选出最“夯”项目。
后训练中的RL已死?MIT新算法挑战传统后训练思维,谢赛宁转发
MIT研究人员提出RandOpt新算法,挑战传统后训练思维。该算法通过随机扰动和集成突破限制,在多任务中表现出色,揭示了预训练模型权重空间的“神经丛林”现象,引发AI社区关注。
OpenAI开除内鬼!拿着改变世界的机密去赌博,一夜狂赚几十万
OpenAI开除一名利用公司核心机密在预测市场下注牟利的员工。调查发现过去一年多,60个神秘钱包做出77次精准押注。不止OpenAI,其他预测市场平台也出现内幕交易案件,平台陷入尴尬处境。
给GRPO加上运筹外挂让7B模型比肩GPT-4!Li Auto团队发布多目标强化学习新框架 | ICASSP 2026
文本摘要质量评估需兼顾多维度,但开发者优化时易顾此失彼。Li Auto团队提出HVO,基于GRPO框架,让7B模型在摘要任务媲美GPT - 4,且生成内容更简洁,成果被ICASSP 2026接收。
沉默的进化:LatentMAS 如何通过“潜意识通信”重塑多智能体协作?
这是对多智能体协作领域突破性研究的深度解读。论文提出LatentMAS框架,让智能体直接交换“思维向量”,实现“机器心灵感应”,在性能、速度和Token消耗上全方位碾压传统文本交互模式。