「复杂图表理解」共找到 1672 篇相关文章
微软又搞大新闻:GitHub Copilot 开源,VS Code 要变天了。
微软官宣将把 GitHub Copilot Chat 扩展代码开源,重构相关组件到 VS Code 核心,使其成开源 AI 编辑器。还推出 Coding Agent,能自动化处理多种开发任务,目前在 Copilot Pro Plus 版本预览。
图文跨模态“近视”问题破局:360开源新模型 FG-CLIP,实现细粒度图文对齐突破|ICML2025
360人工智能研究院发布 FG - CLIP 模型,攻克图文细粒度对齐难题,成果被 ICML 2025 接收并开源。它采用双阶段训练等策略,在多任务评测中超越对比模型,推动跨模态研究产业化落地。
北大校友,OpenAI前安全副总裁Lilian Weng最新万字博客文章:Why We Think
北大校友Lilian Weng新发布万字博文《Why We Think》,系统梳理让AI模型‘多想一会儿’的前沿方法及逻辑,深入剖析多种机制突破AI性能瓶颈的理论、技术与进展,还提出一系列待解决的开放性问题。
刚刚!OpenAI正式官宣调整公司结构:奥特曼发全员信承认AGI会由多家公司实现
OpenAI宣布调整公司结构,非营利组织继续控制,盈利实体转型公益企业(PBC),采用常规股权结构,非营利组织成PBC大股东。Sam Altman称这非出售,是结构简化调整,目标是让AGI惠及全人类。
刚刚,GPT-6正式发布!OpenAI:欢迎来到AGI时代
OpenAI正式发布GPT - 6 Astra和GPT - 6 Astra Pro,宣布AGI时代开幕。该模型训练规模大,能力升级显著,价格公布。基准测试成绩优异,在多方面表现突出,还展示诸多实际应用案例,已有企业开始测试。
codex负责人:codex就要过时了
Codex负责人称两三个月后Codex将过时,因下一代模型要处理大规模并发Agent,非其能应对。Huggingface实验显示大小模型在不同harness下排名差异大,脱离模型谈harness过时或不适配说模型Agent能力都不妥。
从视觉压缩,到视觉记忆:MonkeyOCRv2以重建保留文档页面证据
文档视觉编码器对LLM理解和推理很重要。MonkeyOCRv2提出‘重建即文档视觉记忆’,通过多组实验验证其有效性,还发布MonkeyDoc v2数据集,推动公平比较的研究文化。
当设计师和PM都开始写代码,产品构建方式又要变天了?
Notion 产品负责人 Max Schoening 与主持人探讨 AI 对软件构建和使用方式的影响。他认为成功产品有强大核心,鼓励设计师和 PM 用代码思考,还谈到岗位融合、可塑性软件、SaaS 趋势等话题。
OpenAI挖来了个F1级别车手搞公关
OpenAI花半年找到CMO Colin Fleming。他经验丰富,曾在Salesforce、ServiceNow任职,擅长让市场理解新技术。OpenAI营销长期缺失,他的到来是弥补的一部分,但公关主管仍空缺。
全球SaaS危!AaaS成主流,Claude 抄中小企业软件的老底了
Claude推出Claude for Small Business,能接入企业常用工具,自动处理常规业务。其操作丝滑、免费使用、安全合规,功能覆盖小企业主日常软件使用场景,定位低价,或颠覆SaaS市场。