「WALL - B」共找到 794 篇相关文章
ACL 2025 | AI字幕慢半拍,不知道大家在笑什么?新方法让同传性能直逼离线翻译
香港中文大学、字节跳动Seed和斯坦福大学团队提出SeqPO - SiMT框架解决同声传译“质量 - 延迟”权衡问题。该方法将同传建模为序贯决策过程,优化决策序列,实验显示其性能直逼离线翻译。
直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?
论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。
我用了13年,与SEO前辈们出现在一起。白杨SEO从网站优化到AI搜索优化经历分享,百度SEO不放弃!
白杨SEO分享从网站优化到AI搜索优化经历,讲述入行缘由、职场项目,介绍自由职业业务,分析百度SEO阶段与变化,建议别放弃,还给出对SEO未来看法,如回归国外、做新媒体SEO等。
Agent学会自己「长」Skill了!从失败里长出经验,比人类写的更好用|ICML 2026
ICML 2026接收论文提出EvolveR,让Agent从自身成败轨迹自动蒸馏“经验”,经闭环生命周期形成“认知Skill”,维护经验库,用强化学习让其学会“使用经验”,在多跳问答表现优。
微信今天上线了 ClawBot,这是腾讯打出的一张大牌
微信推出 ClawBot 插件,将 OpenClaw AI agent 接入聊天界面。OpenClaw 原是开源项目,能让普通人用自然语言指挥电脑干活。腾讯同步推产品矩阵,想成 AI agent“入口”和“管道”,但也有体验粗糙等风险。
逆天!Mata用13个参数26字节让模型正确率从76%飙升至91%
Meta等机构研究人员发布TinyLoRA极致微调技术,配合强化学习,能在几乎不改变大模型原有结构下,用极少数参数激发其推理能力。该技术在数学推理上表现出色,还探索了参数共享策略和存储精度问题。
上海理工男造芯,飙上3000亿
12月17日,沐曦股份登陆科创板,市值超3000亿。创始人陈维良出身AMD,放弃百万年薪创业。他带领强悍班底,精准切入B端数据中心市场,产品落地快,还构建国产供应链,搭上AI东风加快追赶。
ChatGPT群聊来了,Slack和钉钉要哭了
ChatGPT上线群聊功能,目前处于试点阶段。它与Slack、钉钉不同,是在AI里长出协同。有潜水和主动两种互动模式,还将加入多种功能,或改变协作赛道格局。
阿里“闪电战”再发力,这次是千问APP
阿里在AI领域影响力大,Qwen3-Max模型能力强,开源模型Qwen3-235B在Lmarena上开源第一。新发布的千问APP成Qwen模型第一入口,功能丰富免费,体验佳,是同类产品劲敌。
vLLM 正式支持 PaddleOCR-VL
11月4日,vLLM项目宣布正式支持PaddleOCR-VL模型。该模型专注文档解析,参数量仅0.9B。合作降低部署门槛,推理效率更高,官方还给出部署指南和配置建议,流程快速完成可作榜样。