「3D世界模型2.0」共找到 8977 篇相关文章
1899个MCP服务安全研究:7.2%存在漏洞,5.5%暗藏「工具投毒」
研究人员对1899个开源MCP服务器扫描,发现7.2%项目有漏洞、5.5%遭工具投毒。MCP虽成事实标准且发展好,但代码质量堪忧,传统安全工具难检测其风险,为生态敲响警钟。
8.9K Star!号称 Notebook LM 开源平替,支持 16+AI 模型,一键部署!
Google Notebook LM 虽方便,但有数据泄露风险且被平台绑定。开源工具 `open-notebook` 是其平替,支持 16 + 家 AI 模型提供商,可处理多模态内容,能本地部署保障数据安全,还具备多种实用功能。
AI开始替人类调用AI!token用量已是人类5.2倍
据OpenRouter统计,截至8月10日,Agent类token用量半年涨14倍,人类仅2.8倍。差距源于用法差异,虽智能体部分token计价低,但用量大仍烧钱。省钱关键在配套,且智能体任务验收缺人手。
北大团队发布首篇大语言模型心理测量学系统综述:评估、验证、增强
随着大语言模型(LLM)能力迭代,传统评估方法难满足需求。北大宋国杰教授团队论文首次系统梳理LLM心理测量学研究进展,革新评估原则,扩展测量构念与方法,还给出增强方法与未来研究方向。
Google 悄悄升级了 Deep Think,ARC-AGI-2 直接干到 84.6%
Google DeepMind 升级了 Gemini 3 的专用推理模式 Deep Think,跑分屠榜。ARC - AGI - 2 拿下 84.6%,在多个基准测试中表现优异。它不仅是解题机器,还能解决真实科学工程问题,已向部分用户推送,科研人员和开发者可通过 API 使用。
永别了,终端!OpenAI疯狂升级Codex,接管Mac人类全程0操作围观
OpenAI的Codex迎来重大更新,从代码工具进化为通用个人助理。开发者实测中,它能接管Mac完成多项任务,人类全程0操作。还支持多应用集成,功能强大,获开发者青睐,或重新定义使用电脑方式。
三分之一arXiv沦陷!CS论文65%被判「AI味」,数学仅0.7%
一份unslop研究显示,过去一年arXiv计算机科学领域65%新论文被检测器标红,但可能只是闻起来像AI。数学论文仅0.7%,或因检测器只认文字。研究有局限性,真实用AI比例可能更高。
Nature Machine Intelligence颠覆有机化学研究范式,上海交大发表化学合成大语言模型
上交大AI4S团队依托平台,联合多团队在AI for Chemistry领域获突破。相关研究发表于《Nature Machine Intelligence》,介绍白玉兰化学合成大模型Chemma,它加速有机合成全流程,在多任务表现出色,还能解决数据稀疏等问题。
Hermes Agent 发布更新 Herald:实时语音 + Agent 之间可以互相通信了
Hermes Agent 更新到 v0.20.0 代号 Herald,增加实时语音对话与唤醒词,可验证引用来源可信度,集成签名Webhook,支持代理到代理协议,还有性能与安全方面更新,顺应新 Agent 发展趋势。
DeepSeek接入智慧小浪,「评论罗伯特」爆梗进化!背后大模型全揭秘
新浪新闻推出AI辅助工具「智慧小浪」,接入DeepSeek深度思考能力,依托知微大模型,能总结资讯要点、提供延伸阅读。微博「评论罗伯特」升级,更懂用户情绪、回复有深度。此外,微博还有博主AI助手等爆款应用。