「多模态处理能力」共找到 4467 篇相关文章
社区供稿丨35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源
5月15日,上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,参数35B,多领域比肩万亿参数模型。它深化与昇腾算力生态协同,探索‘通专融合’,强化科学及智能体能力,‘算法 - 系统 - 算力’协同提升训推效率。
谷歌Gemini 3.2偷跑上线!2200行代码一镜到底,Claude/GPT坐不住了
发布会未开,谷歌Gemini 3.2 Flash网页端静默上线,编码实力强悍,代码量大幅提升。其核心技术是蒸馏与稀疏化,推理成本大降。Gemini App集成第三方应用,谷歌I/O大会多款产品将曝光,此次发布对谷歌至关重要。
Figma 自研了 Redis 代理,实现六个 9 可用性
Figma发布自研Redis代理服务FigCache详细实践,替换旧缓存栈。自2025年下半年上线,实现六个9可用性。它基于ResPC构建,分离前后端,配置灵活,处理Redis Cluster问题,迁移策略可回退。
谷歌首度证实:黑客已开始用AI发动真实网络攻击!
谷歌5月12日报告,犯罪黑客用AI大模型发现零日漏洞并准备攻击,谷歌拦截。还发现PromptSpy恶意软件调用Gemini API自主决策。目前攻击方借助AI加速,美国政府紧急行动但监管有分歧。
Karpathy公开附议:AI Agent 的输出格式,正在从 Markdown 走向 HTML
随着 Agent 处理任务变复杂,Markdown 在长文档中可读性与排版局限凸显。HTML 能无损表达信息、支持双向交互,但生成耗时久、版本控制难。AI 研究者 Karpathy 附议,HTML 成探索方向。
ChatGPT那一套要过时了?翁荔实测创业首个模型,回合制AI被“原生实时交互”秒了
Thinking Machines推出交互模型TML - Interaction - Small,可实时接收多模态输入并响应,性能超现有实时系统。该模型未开放,计划先有限预览再广泛发布,若开放将为企业带来巨大价值。
大模型能复刻这些系统吗?ProgramBench给出了残酷答案
斯坦福NLP组发布ProgramBench,用200个完整代码库重建任务测试主流大模型,要求模型仅根据可执行文件还原如SQLite等项目完整代码,结果所有模型实际解决率为0%,说明模型更擅模仿代码表面结构。
和Anthropic CEO一起发过Nature,他用Claude Code复活三年烂尾代码
华盛顿大学首席开发者Brendan MacLean用Claude Code复活三年烂尾代码。他像带实习生一样带Claude,构建上下文让其理解代码库。同一周OpenAI开源Symphony,实现任务自动派Agent。二者路线不同但目的相同,都在探索让AI融入工程流程。
OpenAI 也把工程师经验“蒸馏”进 skill 了!Harness 爆文作者曝内部玩法:一个百万行代码系统,全程零人工编码和审核
OpenAI的Ryan Lopopolo分享Frontier团队工作方式,他们维护超百万行代码库,零人工编码和审核。实验产出Symphony,推动coding agent成“队友”。还探讨模型使用、构建速度、人类角色等问题,认为人成瓶颈,软件要适配模型。
Anthropic出手,一批Agent创业公司死去
Anthropic推出Claude Managed Agents,号称几天就能上线生产级智能体。它提供全托管、开箱即用的智能体基础设施,让传统SaaS公司与AI初创公司面临危机,AaaS时代正开启。