输入压缩」共找到 436 篇相关文章

算法论文8

PRF | 宾州州立、南科大杨翔、张雯等:粗糙壁湍流的低维建模新范式

传统粗糙壁湍流低维建模依赖经验参数,泛化与精度不足。该研究提出新思路,将粗糙面形貌压缩到低维流形,用自动编码器和前馈神经网络建模,重构效果好、预测准,有生成与泛化性。

力学与人工智能
推荐文章8

深度解析 Claude Code 在 Prompt / Context / Harness 的设计与实践

本文深度解析Claude Code在Prompt、Context、Harness三方面的设计与实践。介绍了Prompt动态组装过程,探讨CLAUDE.md项目说明、上下文压缩体系和记忆系统,还阐述了系统级提醒、多Agent及安全体系等内容,文末分享了项目有趣彩蛋。

阿里云开发者
推荐文章7

别再乱学AI了!我花7天实践了张Zara的方法,从此告别焦虑

作者实践张Zara的AI学习法后告别焦虑,分享学习-实践-链接-输出的心法。包括高质量输入,如看长视频、跟随创造者、深度用产品;内化输出,如公开学习、与创造者交流、实践;还提及启动和持续输出要点及优质信息源。

AI产品黄叔
产品应用8

32个随机数字,1分钟推演地球未来15天丨谷歌DeepMind

谷歌DeepMind发布WeatherNext 2,运行速度比上一代快8倍,分辨率达小时级。其关键是新提出的FGN功能生成网络,通过输入32个随机数字生成多样天气情景,速度快且准确率高,虽有小瑕疵但实用。

量子位
开源动态8

从全局到部件:腾讯全新开源Hunyuan3D-Part和Omni

腾讯全新开源Hunyuan3D - Part和Omni。Hunyuan3D - Omni支持多模态输入,统一信号到跨模态架构提升融合鲁棒性。Hunyuan3D - Part含P3 - SAM和X - Part,分别用于部件分割与生成,在对应领域达先进水平。

带你学AI
算法论文8

让大模型上车:理想汽车硬件协同设计算出最佳边缘模型

长三角洲AI实验室、中科院、理想汽车等找到大语言模型硬件协同设计寻优之路,在相同延迟下降低端侧模型困惑度,压缩模型架构挑选时间。研究揭示缩放定律,打造硬件感知建模框架,找到精度与延迟最优解。

AIGC开放社区
算法论文8

微调已死?Google 和斯坦福论文指出AI 学习新范式

Google的ReasoningBank和斯坦福的ACE两篇新论文引发热议,二者都在解决让AI系统真正学会学习的问题。前者是经验管理系统,后者让输入上下文进化,都绕开微调探索AI持续学习与自我改进能力。

AI工程化
8

刚刚,李飞飞空间智能新成果震撼问世!3D世界生成进入「无限探索」时代

斯坦福大学教授李飞飞创业公司 World Labs 发布限量开放测试预览版空间智能模型 Marble。输入单张图片或文本提示,它就能生成可无限探索的 3D 世界,与谷歌 Genie 有显著区别,还支持导出高斯点云等。

机器之心
推荐文章8

Life of a Token:像调试代码一样看懂大模型如何生成 Token

文章类比 Chrome 的 Life of a Pixel,追踪 LLM 里 token 从输入到输出的全程。以 GPT - 2 Small 为例,详细讲解其管线各阶段,如 Tokenization、Embedding 等,还介绍了残差流、KV Cache 等概念及 GPU 性能瓶颈和优化方法。

AI前线
算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞大的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了后训练量化魔咒,还指出极低比特量化的三大挑战。

AI科技评论