「MegaMath-Web-Pro-Max」共找到 600 篇相关文章
谷歌2025年终回顾:Gemini 3领衔,六大领域全线突破
本文回顾谷歌2025年发展,从Gemini 1.5 pro开始有变化,到Gemini 2.5 pro质变。谷歌在模型、产品、创意、科学等六大领域突破,如Gemini 3系列模型表现出色,但Sam Altman仍认为谷歌失败。
谷歌新版Gemini马甲被扒! LMArena实测:唯一能看懂表的AI, GPT-5乱答
谷歌Gemini 3.0疑似上线LMArena,其Pro和Flash马甲被扒。实测中,Gemini 3 Pro能精确看表,GPT - 5等表现不佳;SVG测试有提升但也有不足;还能作曲。不过评测方式老套,希望有新花样。
火山引擎发布豆包大模型1.6,加速Agent大规模应用
6月11日,火山引擎举办Force原动力大会,发布豆包大模型1.6、视频生成模型Seedance 1.0 pro等,升级Agent开发平台。豆包1.6表现优异,应用广泛;Seedance 1.0 pro评测领先。还通过创新定价等推动Agent规模化应用。
谷歌神秘模型Kingfall泄漏!
近日,谷歌AI模型Kingfall在AI Studio平台短暂开放后意外曝光。它具备多模态处理能力,上下文窗口6.5万个token,有两种模式。生成SVG矢量图能力超Claude 4,身份猜测不断。
2w star,网页秒变 AI 助手,厉害了!
阿里项目`PageAgent`登上Github热榜,是纯前端JavaScript GUI智能体框架。它让网页拥有AI Agent,通过自然语言控制界面,无需截图、OCR和多模态大模型,有多种功能特性,使用简单。
GitHub Issues 大改造:用缓存和预取,让页面打开快了数倍
GitHub 重新设计 GitHub Issues 导航架构,通过客户端缓存、预测性预取等机制,提升导航性能,使即时导航体验比例从 4%增至 22%,解决大型 Web 应用常见的延迟问题。
DeepSeek-OCR是「长文本理解」未来方向吗?中科院新基准给出答案
DeepSeek-OCR的视觉文本压缩技术降低长文本处理成本,中科院自动化所等团队推出VTCBench基准测试评估模型视觉认知,含三大任务及衍生版本,测试结果有‘U型曲线’,还评测多种尖端模型。
一键秒懂GitHub仓库,开发者必备!
面对陌生的GitHub项目,直接把代码扔给AI效果不佳。而`Gitingest`这款开源工具,能将Git仓库转化为适合LLM处理的文本摘要,适配各类AI助手输入需求,使用方式灵活,在GitHub上很受欢迎。
Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解
上海人工智能实验室推出多模态扩散语言模型 Lumina - DiMOO,它基于离散扩散建模,打破多模态任务壁垒。相比传统自回归架构模型,它解决了生成慢、质量受限等问题,在多项评测中夺魁。
突发!谷歌 AI 大换血:Hassabis 卸任 CEO、Jeff Dean 离职创业
谷歌 AI 高层大换血,Demis Hassabis 卸任 Google DeepMind 的 CEO 转任主席兼 Alphabet 首席科学家,传奇工程师 Jeff Dean 离职创业,创办 Discovery Loop 做「自动化科学发现」。