二分类」共找到 255 篇相关文章

算法论文8

TACL 综述 | 别只卷架构了——长文本模型的能力天花板,其实是数据决定的

该 TACL 综述首次从数据视角审视长上下文语言模型,指出长上下文能力本质是数据驱动。它建立分类体系,明确高质量长文数据条件,给出核心能力的数据配方与评估法,还整理数据集和基准,提出待解问题。

深度学习自然语言处理
算法论文8

19年不丢数据,擦写6万次不坏,原子级材料重新定义未来芯片

上海大学王震宇副教授团队在《自然·电子学》发文,用硫化铌和硫化钼做出新型非易失存储器,能保持数据约19年、擦写超6万次,还具备计算和存储两种本领,对未来低功耗计算和存内计算有吸引力。

DeepTech深科技
开源动态7

Wan2.2-Animate又火了,5分钟让抠脚大汉秒变高冷女神。

阿里开源模型Wan2.2 Animate又火了,用照片和视频就能生成换脸视频,表情动作复刻佳。它上限高,还能变声,可用于舞蹈视频、影视创等,但手指易崩坏。模型开源,有积极意义也有风险。

数字生命卡兹克
推荐文章8

大模型微调评测入门:看懂这些指标,才知道模型好不好

文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。

机器学习AI算法工程
产品应用8

Sora 2刷屏全网:拍《瑞克和莫蒂》、过物理测试,太棒了

OpenAI推出的Sora 2刷屏海外,能完成以往视频生成模型极难实现的任务,在物理准确性、逼真度和可控性上有重大提升。它还能进行创、模拟电脑操作等。OpenAI发布由Sora 2驱动的社交APP,强调促进创作,保障安全。

AI进修生
7

全球首个AI投资大赛落幕!阿里Qwen 20%收益夺冠,GPT-5亏到只剩三成

历时17天的AI实盘投资大赛Alpha Arena落幕,阿里千问Qwen精准操盘,收益率超20%夺冠,DeepSeek位列第,两款中国模型包揽冠亚军且是唯盈利者,美系四大模型全线亏损,GPT - 5亏超60%垫底。

量子位
算法论文8

EMNLP2025 | SFT与RL的结合,vivo AI Lab提出新的后训练方法

vivo AI Lab 算法团队提出新的大模型后训练框架 GTA,综合 SFT 和 RL 优点,解决文本分类场景中 RL 收敛慢问题。论文已被 EMNLP 2025 录用,介绍了 GTA 框架设计思路、实验结果等,未来还将探索更多场景和大模型。

机器之心
产品应用7

微信悄悄上线AI播客,新闻主播们的活儿可能真要被抢了。

微信正在灰度内测AI播客,入口在“快讯”页面。它从重要新闻中挑内容分类改写,以双人对话方式播读。此前公众号后台也尝试AI声音。此功能适合资讯新闻,未来或能盘活更多信息场景。

数字生命卡兹克
新闻资讯7

英伟达给黄仁勋儿女涨薪了!年薪百万美元,“凭能力而不是身份”

英伟达向美国SEC提交的2026财年委托投票说明书显示,黄仁勋女儿Madison、儿子Spencer的总薪酬分别达123.2万和132万美元。英伟达称两人薪资评定与黄仁勋无关,人能力出色,一路晋升。

量子位
新闻资讯8

英伟达再创历史纪录!Q1收入增长69%,数据中心贡献89%,游戏业务大涨42%

英伟达2026财年Q1财报亮眼,总收入441.1亿美元,环比增12%、同比涨69%。数据中心和游戏业务表现出色,分别占比近89%、创新高。不过H20芯片受出口限制影响,预计财季收入减80亿美元。

量子位