「渐进式发现」共找到 1657 篇相关文章
MiniMax海螺视频团队首次开源:Tokenizer也具备明确的Scaling Law
MiniMax海螺视频团队首次开源,揭晓视觉分词器难题答案。其推出的VTP框架可提升模型性能,解决传统Tokenizer缺陷,还展示了Tokenizer的Scaling Law,为行业提供新路径。
2026 将近,世界模型到底更「世界」了吗?
近期 Runway 发布相关产品,让「世界模型」讨论再聚焦。其定义从强化学习语境延伸,业内理解不断变化,概念边界变模糊。如今被推到和 LLM 同级,出现概念同名但内核分裂现象。
上下文工程的精髓在于删除?
Hugging Face工程师Philipp Schmid整理分享,Manus团队重写五次代理系统,发现删代码比加功能好。AI模型存在‘上下文腐败’问题,Manus给出清理上下文、避免共享大脑、精简工具等解决办法。
库克怒换苹果 AI 一号位:谷歌系不行、找微软高管救火!Siri 藏“大雷”全靠 OS 团队翻盘?
Siri 重大升级延期危机加剧,苹果任命前微软高管 Amar Subramanya 接替 John Giannandrea 任 AI 业务负责人。此次变动结束 AI 独立运营,并入操作系统团队。苹果还面临 Siri 技术缺陷、外部竞争和人才流失等问题。
华为新开源!扩散语言模型突破32K上下文,还解锁了「慢思考」
今年文本生成领域从自回归向扩散语言模型转变,但长序列训练不稳定是痛点。华为发布 openPangu-R-7B-Diffusion,将上下文长度扩至 32K,在多基准创 7B 参数量级 SOTA,还解析了其技术革新。
熬夜后走神不是你的错,而是自救机制在“洗脑” | Nature
麻省理工学院研究揭示,熬夜后白天易走神是因大脑“洗脑”机制启动。正常“洗脑”在睡眠时进行,清理废物;睡眠不足时,白天也会启动,代价是注意力受损。此前波士顿大学也有大脑清洁相关研究。
「重要性采样」并不「重要」?快手清华ASPO攻克重要性采样权重错配
快手与清华合作团队发现大语言模型结果监督强化学习中,重要性采样机制“失灵”,存在权重错配现象。为此提出算法ASPO,在多基准测试中展现优势,训练更稳定。
AI能否「圣地巡礼」?多模态大模型全新评估基准VIR-Bench来了
来自日本高校和企业团队提出多模态大模型评估基准 VIR-Bench,用于评测 AI 对旅行视频中地理位置与时间顺序的理解。它将任务拆解,构建数据集,实验显示模型虽有改进但性能远未达标,指明了大模型进化方向。
不用跟AI客气了!新研究:语气越粗鲁回答正确率越高
宾夕法尼亚州立大学研究《Mind Your Tone》显示,与AI交流时说话越粗鲁,LLM回答越准。测试发现,对GPT - 4o特别客气时正确率80.8%,粗鲁时升至84.8%,但老模型不适用。
库克虎口夺食:马斯克盯上的北大校友AI公司被苹果抢走
苹果和马斯克旗下公司争抢Prompt AI,苹果与该公司进入后期谈判,欲买走核心团队和技术资产。Prompt AI是2023年成立的CV初创公司,旗舰产品Seemour用于提升家用摄像头智能感知能力。