跨平台框架」共找到 3084 篇相关文章

算法论文8

拒绝Reward Hacking!港科联合快手可灵提出高效强化学习后训练扩散模型新范式

使用强化学习微调扩散模型时,常面临Reward Hacking和KL正则化阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则化和多样性感知优化,解决痛点且全面开源。

机器之心
推荐文章7

AI圈最准的消息,都藏在这个小小的Web3网站里。

文章介绍了Web3平台Polymarket,它能提前预测AI模型发布日期等事件,准确率颇高。其玩法基于群体智慧,参与者用钱下注表达观点,价格反映事件发生概率,比KOL分析更靠谱。

数字生命卡兹克
算法论文8

阿里新研究:统一了VLA和世界模型

阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。

量子位
新闻资讯8

2025乌镇峰会看点:人工智能,中国数字世界秩序之巅

2025年世界互联网大会乌镇峰会是战略转折点,议程、展览等聚焦AI,从宽泛论坛变为展示AI驱动发展模式平台。报告剖析议程架构、战略差异,评估其对全球AI格局等多方面的影响。

AI Reading Hub
开源动态8

23.6K star!微软AI项目硬核开源,带飞你的电脑!

微软开源项目 `OmniParser` 是超级智能“数字助手”,能像人一样“看懂”屏幕元素并操作。它精准识别小图标、响应快、开发便捷、兼容大模型且平台,目前在Github获23.6K star。

开源先锋
产品应用8

太强了 Yan!腾讯打造的全能交互视频生成引擎

腾讯提出的面向交互式视频生成的基础性框架 Yan,集 AAA 级模拟、多模态生成和多粒度编辑于一体,为下一代 AI 内容引擎提供可行路径,但也面临长时视频视觉一致性不足等问题。

带你学AI
开源动态8

腾讯开源Stand-In!轻量级身份保留视频生成新突破

生成符合指定身份的高保真视频挑战大,现有方法依赖大参数且兼容性不足。腾讯开源轻量级、即插即用的Stand - In框架,在身份保留文本生成视频任务中性能先进,兼容性强,有广阔应用潜力。

带你学AI
开源动态8

本周推荐的5个超级6的Github开源项目!

文章推荐5个Github开源项目。有基于Firefox内核的浏览器Zen Browser;平台划词翻译工具Pot;异步终端文件管理器yazi;局域网文件传输工具Snapdrop;网页管理服务器文件工具FileBrowser Quantum,各有亮点。

开源先锋
新闻资讯7

A社旗舰Fable 5卖不动了。。两款神秘新模型已现身

支付平台Ramp统计显示,A社旗舰Fable 5上线两月销量不佳,收入仅占整体的11.4%。其价格高、性价比低,拖累公司收入未达预期。同时,X上出现Claude的两个神秘内测代号,或几周内上线。

量子位
算法论文8

TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文

由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。

机器之心