AI 资讯热文 - 大模型动态

DeepSeek识图模式破局:大模型迈向空间计算

本文聚焦DeepSeek大范围开放“识图模式”的技术跃迁,深度拆解其“以视觉原语思考”框架如何突破传统OCR局限,实现复杂空间推理与可交互代码生成的实质性跨越。结合近期融资传闻澄清、车企辟谣AI生成虚假名单及行业高管对AI验证局限的表态,透...

DeepSeek 多模态大模型 视觉原语
4 0 0 2026-05-10

xAI预训练核心离职,Grok底盘迎重组

xAI 预训练核心负责人庄钧堂近日正式宣布离职,恰逢公司并入 SpaceX 启动重组。作为 GPT-4 技术报告联合作者与 AdaBelief 优化器提出者,庄钧堂的离开不仅标志着 xAI 早期技术班底的进一步流失,也折射出大模型厂商在高速...

xAI Grok预训练 庄钧堂
5 0 0 2026-05-10

ChatGPT口头禅背后的大模型对齐困局

聚焦《连线》报道的ChatGPT中文高频口头禅“我会稳稳地接住你”,拆解其背后的“模式坍缩”机制与RLHF后训练对齐策略的副作用。结合跨语言翻译错位、真实办公场景中的交互摩擦,以及索尼AI个性化内容生成专利、车企AI谣言辟谣等跨界案例,探讨...

大模型对齐 模式坍缩 ChatGPT中文优化
7 0 0 2026-05-09

AI未能给3A游戏降本,Take-Two的清醒账本

面对大模型“重塑一切”的行业叙事,Take-Two CEO施特劳斯·泽尔尼克给出了截然不同的答案。本文开篇即亮明立场,以《GTA6》超十亿美元的开发预算为切入点,拆解3A游戏工业的真实成本结构。通过分析AI工具在Take-Two内部的落地现...

大模型应用 3A游戏开发 Take-Two
10 0 0 2026-05-09

中国移动发布MoMA,开启算力集约化运营

本文聚焦中国移动在2026移动云大会发布的MoMA平台与全国一体化算力网建设计划。文章将详细拆解其首创的Token集约化运营模式,分析该机制如何有效破解大模型调用碎片化与成本高昂的行业痛点。同时深入探讨依托国产异构算力与自研推理引擎构建的底...

中国移动 MoMA平台 算力网络
10 0 0 2026-05-09

30TB/s带宽破局内存墙,新紫光“紫弦”架构重塑大模型算力

大模型迭代正深陷“内存墙”与算力成本挤压,传统HBM方案在带宽与供应链上渐显瓶颈。新紫光发布“紫弦”三维近存计算架构,以3D DRAM搭配3.5D异质集成,将存储带宽推至30TB/s,访存延迟最高压降至1/18。模拟数据显示,同等算力下其T...

近存计算 大模型算力 3D DRAM
9 0 0 2026-05-09

三部门定调智能体:安全划底线,算力标准双轮驱动

网信办等三部门联合印发《智能体规范应用与创新发展实施意见》,首次在国家层面明确智能体定义与治理框架。面对高自主性带来的隐私泄露、越权操作及行为失控风险,文件将安全可控确立为不可逾越的产业底线,并从夯实技术底座、构建分类分级治理体系、划定19...

智能体 AI监管 算力网络
9 0 0 2026-05-08

文章排行榜