「网络信息获取」共找到 1038 篇相关文章
AdaGen: 让图像生成模型学会自适应策略
当前主流图像生成模型多步策略依赖手工静态调度规则,存在需大量调参、无法适配样本特性的问题。本文提出AdaGen框架,通过强化学习训练策略网络,在四大生成范式上实现性能提升与效率优化。
Claude Mythos Preview来了!强大又危险,Anthropic还专门组了个研究团
今日凌晨,Anthropic发布Claude Mythos Preview新模型及AI网络安全项目Project Glasswing。该模型虽性能卓越,但有安全风险,Anthropic暂不全面开放。Project Glasswing汇聚众多巨头,获巨额资金支持,旨在构建AI防御联盟。
谷歌TurboQuant会绕过“内存墙”?这个判断有点过了|甲子光年
谷歌发布的TurboQuant论文引发市场震动,其算法可将大语言模型推理的KV缓存大幅压缩并加速。但将其视为绕过‘内存墙’判断过度,它提升单位字节信息密度,改变边际需求曲线,代表范式转移。
用 AI Coding 工具生成 60 万字奇幻世界设定的实践记录
作者先尝试用 Python/C# 编排 LLM 调用生成小说世界设定,遇节点信息查看、输出形态等问题。后用 AI Coding CLI,经搭建骨架、基础层展开等阶段生成 60 万字奇幻世界设定,还基于此创作叙事。
arXiv变天:将脱离康奈尔大学独立,招聘CEO,网友:以后还能白嫖吗?
arXiv发布官方信息,将脱离康奈尔大学转型为独立非营利组织,还发布CEO招聘公告。它始建于1991年,在康奈尔经历从个人项目到机构基础设施的转型,现面临AI投稿井喷、审核困境和技术债务等挑战。
Cursor 慌了:当 AI 不再需要代码编辑器
Anthropic新模型Opus 4.5编程能力强大,开发者无需逐行审查代码,可直接向智能体下达指令获取成品,这冲击了Cursor代码编辑器业务。虽Cursor收入增长,但面临焦虑,正努力自研模型、拓展企业客户。
英伟达世界模型再进化,一个模型驱动所有机器人!机器人的GPT时刻真正到来
英伟达GEAR实验室提出DreamZero,是基于预训练视频扩散骨干网络的世界动作模型,有140亿参数,能让机器人通过文本提示完成未见任务。它解决了传统模型问题,在多方面表现出色,代码已开源。
老外傻眼!明用英文提问,DeepSeek依然坚持中文思考
DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用中文思考。评论有两种观点,相关论文显示中文省token但非最有效,大模型选思考语言并非只看效率。
团队授权:分散化的架构决策
文章以黏菌创建网络为隐喻,探讨软件团队去中心化架构决策。介绍转型历程,包括重组团队、建立建议流程、创建上下文图等,阐述各环节作用、挑战与收益,强调其能提升决策质量与团队参与度。
基于Spring AI Alibaba 的 DeepResearch 架构与实践
本文基于 SpringAI Alibaba Graph 构建 Java 版 DeepResearch 系统,实现信息搜集到报告生成的全自动流程。介绍系统能力、架构、核心功能节点及技术点,还阐述 RAG、搜索、MCP、报告生成等功能,给出使用、部署和社区参与方式。