两阶段训练法」共找到 3112 篇相关文章

推荐文章8

很多AI人还在自嗨,外贸人已经用AI卷翻天了。

作者参加OKKI 2025新品发布会,深感外贸人用AI“卷翻天”。总结8条启示,如AI是队友、智能体达L3才成熟等,强调用人类思维理解行业,以AI解决问题,让技术转化为生意增量。

数字生命卡兹克
产品应用7

SkyReels-Audio让嘴型和音频完美匹配不再难

音频驱动的动态人脸生成研究较少,昆仑万维提出SkyReels - Audio框架,基于预训练视频扩散变换器构建,支持无限长度视频生成与编辑,采用混合课程学习等策略,保障视频视觉保真度和时间一致性。

带你学AI
算法论文7

Theory of Agent:构造知行合一的智能体

当前AI(如ChatGPT)存在行为随机性、效率黑洞等问题,论文指出AI缺乏认知地基,需明确认知框架。还提出革命性等式“推理 = 行动”,分析了知识与决策边界,给出最优行为四象限,介绍落地路径和未来发展方向。

深度学习自然语言处理
推荐文章8

Databricks × Snowflake 纷纷下注,PostgreSQL 成 AI 时代数据库标准?

文章结合作者对数据基础设施的实践与反思,探讨生成式AI时代数据系统的挑战与机遇。介绍数据基础设施新趋势,分析Neon、Supabase等公司受关注原因,指出PostgreSQL成行业标准,还提出Data Warebase概念及优势和应用场景。

InfoQ
新闻资讯7

软银与英特尔合作,开发AI存储芯片

Nikkei消息,软银与英特尔宣布成立合资公司Saimemory,开发适用于AI的堆叠式动态随机存取存储器原型,目标年内降低50%功耗,实现与高带宽内存相当性能。双方注资7000万美元,各有布局目的。

AIGC开放社区
开源动态7

Memvid:把你的文档库变成一个小巧的视频,还能瞬间搜出你想要的!

传统向量数据库因高成本和复杂运维让开发者却步。开源项目Memvid将文本数据存入视频文件,能高效检索,解决存储冗余、检索延迟和网络依赖问题,使用简单,虽处概念原型阶段但值得尝试。

AI工程化
算法论文8

扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧

上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量。

量子位
新闻资讯7

被误解的谷歌和百度。

文章指出大模型竞争短期拼产品体验,长期靠系统化落地能力。谷歌和百度虽被误解,但前者在I/O大会展示AI布局,后者营收利润双增,家都构建生态,在AI下半场迎头赶上。

MacTalk
算法论文8

模型越聪明越“不听话”?MathIF基准揭示AI服从性漏洞

上海人工智能实验室与香港中文大学研究团队发布论文,用MathIF基准揭示大模型“聪明”和“听话”有矛盾,越擅长推理越易忽略指令,还分析了原因并给出让模型更“听话”的方法。

深度学习自然语言处理
新闻资讯7

“国产英伟达”沉浮:经历欠薪、二度创业

本文讲述了从 2018 年起,一支人才“梦之队”投身国产 GPU 芯片创业。先后成立中天恒星和砺算科技,却都遭遇资金问题。砺算科技正在流片的 G100 号称对标英伟达,但其资金困境使其未来充满未知,也反映了芯片创业市场现状。

芯师爷