「上科大」共找到 6509 篇相关文章

算法论文8

ICLR 2026 | 这道题是否需要用图思考?模型来告诉你!自适应思考模式切换助力通用视觉推理提升

本文来自复旦大学和阿里巴巴未来生活实验室,已中稿 ICLR 2026。目前视觉推理方法有纯文本和用图思考两种模式,各有优劣。研究者提出 Mixture-of-Visual-Thoughts 范式及 AdaVaR 框架、AdaGRPO 算法,让模型自适应选模式,实验显示其在多任务有提升。

机器之心
开源动态7

智普入局OCR! GLM-OCR 0.9B 也杀进来了~

OCR是上古任务,如今大模型纷纷入局,用1B以下小参数模型搅动解析市场。GLM-OCR能做文本识别等,采用三级架构,有两阶段流水线及训练机制创新,在多场景表现出色。

CourseAI
新闻资讯8

OpenClaw创始人:80%的应用会消失,花哨的AI工作流只会生产垃圾,工程思维才是超能力

OpenClaw创始人Peter Steinberger表示,OpenClaw这类AI助理将取代手机上80%的应用。他分享OpenClaw诞生过程,其能远程修复Bug等。他还批判花哨AI工作流,认为人类品味不可或缺,建议学习AI要去玩。

AI寒武纪
算法论文8

像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境

为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出高质量符号世界模型,开辟 AI 理解现实环境新可能。

机器之心
算法论文7

揭秘!RLVR/GRPO中那些长期被忽略的关键缺陷

近年来大模型任务突破离不开RLVR关键技术,许多RLVR方法会进行组内优势估计,北航等最新工作揭示其存在系统性偏差,困难题优势被低估,简单题被高估。这会影响训练,论文提出校正算法。

机器之心
算法论文8

超越Skill?又一新技术让AI编码准确率从53%跃升至100%

Jude Gao主导的新研究带来上下文工程新发现,仅改动8KB的AGENTS.md文件,就让AI编码智能体表现从53%跃升至100%。对比Skills和AGENTS.md两种方案,后者完胜,还解决了上下文膨胀问题。

AI工程化
新闻资讯7

黄仁勋现身深圳参加年会:没抽红包、没谈芯片、没邀外部企业|甲子光年

1月28日晚,英伟达创始人黄仁勋现身深圳年会。他发言简短,未提芯片进展,抽奖无万元红包,也未邀外部企业。此次来华他在产品业务上低调,或因出口管制,不过私下更“接地气”。

甲子光年
产品应用8

Gemini 3 Pro的位置,Kimi K2.5也想坐坐?

Kimi 发布 K2.5,在视觉编程上表现亮眼。它通过多模态训练涌现审美,能生成美观网页。与 Gemini 3.0 对比各有优势,Kimi Code 开源终端 Agent 功能强大,Kimi 还探索 Agent Swarm 协作新路径。

AGI Hunt
新闻资讯8

Science重磅:AI编程新手与资深开发者之间的差距巨大

《科学》杂志发表的AI编程全球调查研究显示,美国程序员提交的Python代码中29%由AI代笔,资深开发者借此拉大与新手差距。研究团队用GraphCodeBert模型分类器扫描代码,揭示技术扩散差异与隐忧。

AIGC开放社区
新闻资讯8

Mistral 发布 OCR 3,提升了手写及结构化文档识别的准确率

Mistral 发布 OCR 3,在多种文档类型上精度更高,超越前一代产品。能提取文本、识别图像并保留文档结构,输出 Markdown 格式。早期用户认可其性能和多语言支持,生产部署扩展快,价格有优势。

InfoQ