「复杂图表理解」共找到 1672 篇相关文章
Claude 这个更新,让模型能力提升10%+!
Claude开放100万上下文长度更新,实际可用空间接近8倍提升。数据显示,上下文越长Claude与其他模型差距越大。API取消溢价,还更新图片/PDF上限、将Adaptive Thinking转正式版。
超20万个高质量Skills!浙大等联合推出SkillNet,告别孤立Skill实现自进化
浙江大学联合多家机构推出开源基础设施SkillNet,拥有超20万个高质量Skills。它能让AI智能体告别失忆式工作,将互联网资源和人类经验转化为可执行Skills,构建Skills网络,经严苛评测,在真实场景验证了强大实战能力。
ICLR2026|东方理工大学、上海交通大学等:GenSR:把“离散的公式搜索”变成“连续的地图寻优”
符号回归(SR)目标是从观测数据自动发现数学表达式,但经典方法在离散方程空间搜索有局限。东方理工与上海交大团队提出GenSR,将方程世界重参数化为连续隐空间,用双分支CVAE构造并搜索,实验效果良好。
CUTLASS 笔记 (2):混合精度 GEMM kernel
文章介绍实现支持不同精度的 GEMM 算子,解析精度转换技术细节,还介绍根据 PTX 文档实现自定义 FP8 精度的 GEMM kernel,包括揭开 MMA Atom 面纱、分析 TV 与 MN Layout 等,最后完成精度验证。
豆包 Seed 2.0 来了:字节模型跨越鸿沟
春节前字节发布豆包大模型 2.0,其在 Text 领域进入榜单前十,视觉能力全球第四且成本低。它定位多模态 Agent 模型,有多种能力升级,文中用多个案例展示其强大,还强调字节重原生能力非简单蒸馏。
1美金时薪雇个全栈替身,MiniMax M2.5让打工人也能体验当老板的感觉
春节档模型大战,MiniMax官宣新模型M2.5,主打智能体和Vibe Coding,性能比肩Claude Opus 4.6。它全栈能力强,能处理长链路任务,推理吞吐量高、成本低,已接管MiniMax 30%真实业务。
别再让语音机器人“答非所问”:AI Force任务型语音对话技术总结
本文围绕企业级任务型语音Agent核心挑战,提出解决“拟人化”与“专业化”问题。介绍三段式语音对话解法、架构演进,还提及‘衍算’推理框架等技术及未来方向,团队来自蚂蚁集团AI force。
永别了,互联网!Anthropic联创爆料:人类彻底出局
Anthropic联创Jack Clark警告熟知的互联网正在消亡。Moltbook作为专为AI智能体打造的社交网络,预示未来互联网将由智能体主宰,人类会感孤独,或需翻译智能体解读局面。
Vercel 开源 Bash 工具:基于本地文件系统的上下文检索
Vercel开源bash - tool,为AI智能体提供Bash执行引擎,让其通过shell命令在文件夹操作获取上下文,有三大核心操作,部署灵活,可节省token,贴合Unix工作流,或影响未来AI开发系统处理本地上下文方式。
怎么做 Long-running Agents,Cursor、Anthropic 给了两种截然不同的思路
业界对让 Agent 长时间运行、执行复杂任务无共识。最近 Cursor 和 Anthropic 分享实践,思路不同。Cursor 用多 Agent 并行执行长时任务,Anthropic 解决单个 Agent 跨工作周期的记忆连续性问题。