视觉-语言模型」共找到 8149 篇相关文章

新闻资讯9

Claude自主发现类CRISPR新酶系统,但还不知道它能干什么,张锋点评:值得研究

本文报道Anthropic旗下Claude大模型独立完成搜索分析,从噬菌体DNA中发现此前未被发现的类CRISPR新酶系统ART,展示了大模型在生命科学新发现中的独特能力,目前ART功能尚未明确,张锋点评其值得进一步研究。

DeepTech深科技
新闻资讯8

刚刚,DeepMind经典巨作再封神!ICML 2026大奖公布

ICML 2026大奖公布,杰出论文奖中两篇扩散模型论文获奖,立场论文奖指出AI安全工具被挪用问题。时间检验奖颁给DeepMind经典论文。获奖名单显示扩散模型研究热,AI安全需审视,AI研究进入深度清理阶段。

新智元
新闻资讯7

5Y News|GIM 完成数千万元天使轮融资

日前,GIM宣布完成数千万元天使轮融资,由五源资本与Monolith投资。资金用于自研金融大模型迭代等。其定位自进化智能体投资平台,已推自研金融时序大模型,未来将推基金策略与产品。

五源资本 5Y Capital
算法论文8

JCP | 南科大邹欣桐、王建春等:神经算子在三维湍流预测中的不确定度和稳定性分析

本文以三维各向同性湍流为例,提出面向神经算子的可信度评估框架,考察预测误差不确定度、长时迭代稳定性及流场时间相关性对模型可靠性的影响。结果显示,物理约束和合理时间步长可提升模型稳定性与可靠性。

力学与人工智能
开源动态7

Wan2.2-Animate又火了,5分钟让抠脚大汉秒变高冷女神。

阿里开源模型Wan2.2 Animate又火了,用照片和视频就能生成换脸视频,表情动作复刻佳。它上限高,还能变声,可用于舞蹈视频、影视二创等,但手指易崩坏。模型开源,有积极意义也有风险。

数字生命卡兹克
新闻资讯7

GPT-5编程测评大反转!表面不及格,实际63.1%的任务没交卷,全算上成绩比Claude高一倍

Scale AI的新软件工程基准SWE - BENCH PRO测试中,‘御三家’表面解决率低。深入看,GPT - 5已提交任务准确率比Claude高一倍。该基准新题多、更复杂,能真实考验模型能力,当前模型解决商业问题能力有限。

量子位
开源动态7

Karpathy的编程经验Skills,开源了,Star涨疯了。

周末,Karpathy大佬的编程经验开源skills项目火了,它把其吐槽大模型写代码的问题编译成大模型可理解的约束。安装简单,还列举了一些规则示例。如今行业把人的经验编译成Agent可执行格式,开源范式改变。

探索AGI
开源动态8

腾讯混元图像3.0开源榜一,工业级800亿参数可商用,附提示技巧

28日,腾讯开源800亿参数的工业级原生多模态生图模型HunyuanImage 3.0,个人和月活≤1亿公司可免费用。它是全球参数量最大、性能最好的开源图像生成模型,技术强、评估表现优,官方还整理了提示词手册。

AIGC开放社区
新闻资讯7

Cursor只排第6!136国用户实测25款AI编码工具,第一名73%胜率,还是个新面孔

Design Arena评测平台用对抗式评测方法,让用户对AI模型生成的设计作品投票,评估其设计美学表现。文章总结了上榜的编码工具,如new.website胜率约73%排第一,还对比了不同类型模型的排名情况。

AI进修生
新闻资讯8

告别盲目卷参数!科大讯飞1024亮出底牌:all in“更懂你”

模型能力趋同当下,科大讯飞在1024开发者节提出让AI“更懂你”。展示多模态超拟人“小飞老师”和「百变声音复刻」功能,发布星火X1.5大模型,还推出多领域软硬件产品,赋能多行业。

量子位