「模型能力连续体」共找到 9165 篇相关文章
刚刚,DeepSeek开源OCR 2,首创Qwen编码的「双流架构」
年底 DeepSeek 开源新模型 DeepSeek - OCR 2,首创双流注意力架构,model&paper 一同发布。它重构视觉编码器,采用三阶段训练流程,在 OmniDocBench v1.5 评测及生产环境验证中表现良好。
破防了!全球顶尖AI惨败,人类最后防线竟是「重启试试」?
GSMA联合权威组织发起全球电信AI故障排查挑战赛,吸引超1000支队伍。赛事依托权威评估框架,设丰厚奖励,分多个赛道,还将开展智能体任务,预示电信运营模式重构。
硅谷刷屏的ClawdBot,让Mac mini卖爆了!创始人爆料:一人开发、100% AI 写代码,全开源却留 0.00001% 给全网来 hack
个人 AI 助手 ClawdBot 席卷硅谷,网友评价高,项目已开源获 20.8k stars。它几乎 100% 用 AI 写代码,协作方式激进,创始人还留 0.00001% 作为“安全靶子”。其功能强大但有安全隐患,还带火了 Mac Mini。
Dario Amodei 达沃斯访谈全记录:AI 的力量与风险
2026 年 1 月 20 日达沃斯论坛,Anthropic CEO Dario Amodei 接受专访,谈及 AI 发展程度、公司定位、中美竞争等多话题。他认为 AI 呈指数增长,一两年内或超人类,同时警告岗位消失、财富差距等风险。
Gemini盘活了谷歌全家桶,“原生”自带你10年的记忆
谷歌发布由Gemini3驱动的“Personal Intelligence”功能,底层连接旗下四大应用,让AI跨应用获取数据,还内置纠错机制。该功能现处Beta测试,未来覆盖免费用户。谷歌与苹果引入Gemini后路径不同,AI竞争也转向生态构建。
再见,程序员!硅谷全员AI Coding,卡帕西宣告9级地震来了
2025年12月27日,Andrej Karpathy推文指出软件工程职业正被重塑,引发开发者恐慌。知名博主Theo称该领域已到永久性拐点,现在70% - 90%代码由AI生成,程序员角色将重构,还给出应对指南。
QCon 北京 2026 启动|Agentic AI 时代的软件工程重塑
QCon北京2026启动,核心主线为「Agentic AI时代的软件工程重塑」。过去大家关注‘AI能做什么’,如今转向其在生产系统的稳定运行等,智能体成新方向,大会将从六维度探索。
一文搞懂 Agents 评测丨Anthropic 最新万字长文
传统模型评测方法难评估 Agent 系统,Anthropic 摸索出有效评测设计方法。文章介绍评测结构、意义、方法,涵盖编程、对话等 Agent 评测,还给出打造评测路线图及与其他方法结合的建议。
告别碎片化日志:一套方案采集所有主流 AI 编程工具
在AI编程工具普及的当下,有效采集和分析AI代码生成数据成重要课题。该文介绍一套基于MCP架构的多AI工具代码采集方案,支持多种工具和操作系统,有轻量化、用户无感等特点,已和Aone合作。
上海理工男造芯,飙上3000亿
12月17日,沐曦股份登陆科创板,市值超3000亿。创始人陈维良出身AMD,放弃百万年薪创业。他带领强悍班底,精准切入B端数据中心市场,产品落地快,还构建国产供应链,搭上AI东风加快追赶。