「Claude Opus 4.8」共找到 3002 篇相关文章
当 Agent 尝试接管浏览器,连“我是人类”都证明不了?上海交大开源发布交互评测基准 HLL
随着多模态大模型发展,Web Agent 面临验证码挑战。上海交通大学等团队发布 HLL 评测基准,解耦真实度为三维度,对 8 款前沿模型测试,揭示 Agent 在多步交互微操上的短板。
DSpark推理速度提升80%后,OpenAI宣布新方法将推理成本降低了一半
近日,OpenAI 工程师开发优化技术,将模型推理成本降一半。业内猜测或基于公开成果,也有人认为是模型量化。此前 DeepSeek 推出 DSpark,使 V4 模型推理速度提升 60%-85%,还引入峰谷定价机制。
视频版Nano Banana来了!内置Gemini世界知识;原版香蕉出图仅需4秒
谷歌开放Gemini Omni Flash API,将多模态推理与视频生成编辑结合,有4项关键能力,也有局限。Nano Banana 2 Lite出图快且便宜。二者串联使用,图像生成与视频创作可无缝衔接。
笑死,网友支招,破Agent长对话"变蠢"
文章指出用AI编程时,上下文一长模型就易“变蠢”,如违反约束、反复改文件等。分析原因是难从海量历史找重点,给出应对策略,还介绍Claude Code、Cursor、Codex等工具操作方法。
英伟达MoE新开源:一行import,微调加速3.7倍
英伟达开源NeMo AutoModel,基于Hugging Face Transformers v5,不改代码API,添一行import就能更快速微调MoE模型。实验显示,它能提升3.4 - 3.7倍训练吞吐,减少29% - 32% GPU显存占用。
刚刚,DeepSeek陈德里与两个AI,合写了一篇论文
DeepSeek研究员陈德里与DeepSeek-V4-Pro、GPT - Image2合写论文《From Copilots to Colleagues: A Survey of Autonomous Research Agents》。文章是兴趣驱动的尝试,分析自主科研智能体,提出自主等级分类、架构模式分析及未解难题。
这种“半光半物质”粒子,有望补上AI光计算最后一块拼图
宾大物理学家 Bo Zhen 团队造出激子-极化激元,用约 4 飞焦能量完成光信号全光开关切换。光子计算在非线性环节依赖电子器件,该成果有望补上缺失环节,但距商用还有关卡。
独家丨华为、联想、富瀚微罕见「同框」,00后空间智能创业者连续获得两轮融资
魔芯科技近日完成新一轮近亿元融资,近两月连续获两轮近亿元融资。其创始人是00后浙大在读博士生。2025年公司研究成果被CVPR2026接收,还发布交互式视频世界模型。采用纯隐式空间表示,在多领域有突破。
AI 时代到底该怎么管一个工程团队
Fiona Fung在Anthropic大会分享AI时代管理工程团队经验,指出软件工程瓶颈转移,需重构流程,介绍了少做和多做的事、技术辩论方式、代码评审分工等内容,还提及组织形态、指标及未解决的问题。
老黄秘密武器曝光:AI一夜设计芯片,顶人类顶级工程师10个月!
英伟达在GTC大会揭露用AI设计GPU,原本8名工程师10个月的任务,AI一夜完成。其开发NB - Cell、Prefix RL等工具,还推出内部大模型Chip Nemo和Bug Nemo,不过完全端到端自动化设计仍有距离。