「能力提升」共找到 5252 篇相关文章
阿里千问你别太荒谬!连漫画PPT都能一键生成?我以前那些夜真是白熬了
阿里千问发布AI PPT生成工具Qwen AI Slides,从内容结构到视觉配图全包。实测显示,其语义理解能力不错,文本渲染在简单字体表现好,排版有小瑕疵,适合课堂展示等场景。
Anthropic CEO Dario Amodei 访谈:我们正在接近指数的终点
Anthropic CEO Dario Amodei 三年前预测基本兑现,此次访谈更放豪言,称 1 - 3 年内有 50% 概率出现“天才之国”,10 年内 90% 确信。访谈覆盖诸多关键问题,如 Scaling 原理、AI 编程生产力、AI 公司盈利模式等。
我在手机上也能操作AI OS
作者介绍其AI操作系统,由OpenCode加newtype Profile插件及内容仓库构成。此前只能桌面端操作,现通过OpenCode服务器模式和Discord bot,实现手机与系统打通,让记忆资产随时可用,提升内容生产效率。
清华刘洋团队论文:揭示为何 70B 的医疗模型,反而不如 8B 会问诊丨ILCR 2026
在医疗AI领域,模型静态评测与临床问诊能力存在断层。清华刘洋团队提出DOCTOR - R1,将临床问诊建模为POMDP,用强化学习训练。实验验证了其有效性,对医疗AI发展有深远启示。
ERNIE 5.0:走向原生统一的万亿参数多模态基础模型
过去多模态模型‘拼接式’方案存在理解与生成割裂问题,ERNIE 5.0 借此提出,用统一自回归框架做多模态理解与生成,在架构、训练与系统层面有创新,评测中各模态能力表现出色。
前 Codex 大神倒戈实锤!吹爆 Claude Code:编程提速 5 倍,点破 OpenAl 死穴在上下文
OpenAI Codex 早期研发者 Calvin French - Owen 在播客中锐评代码智能体,偏爱 Claude Code,称其搭配 Opus 模型写代码速度提 5 倍。他强调上下文管理重要性,还对比了 Claude Code 与 Codex 产品理念差异。
AI编程节省95% token,工具调用上限狂飙20倍,开源记忆系统登顶GitHub热榜
Claude - Mem是一款登顶GitHub热榜的持久化记忆系统,直击AI编程助手跨会话失忆痛点。它免费且省token,通过‘三层渐进式披露’架构,常规省90%,测试阶段省95%,工具调用上限提20倍。
基于seekdb,教你从零开始构建智能搜书应用
OceanBase开源AI原生数据库seekdb,它统一处理多种数据,解决AI开发者难题。文章分享上手体验,介绍其优势、适用场景、玩法,还给出基于它实现智能搜书应用的教程。
AI看不懂的色盲测试背后,藏着一场像素与诗意的战争。
作者和同事测试AI色盲测试图,多模态模型Gemini 3 Pro、Claude Opus 4.5等纷纷答错,仅GPT 5.2 Thinking答对且靠代码作弊。研究发现,AI看图断章取义,缺乏人类的“格式塔”能力。
昆仑万维多模态视频生成开源,影音图文全统一
昆仑万维开源的SkyReels-V3,通过统一多模态上下文学习框架,实现参考图像生成视频、视频持续扩展及音频驱动虚拟数字人功能,在视觉质量与指令跟随性上逼近闭源顶尖水平,为开源社区提供强大研究基座。