【AI资讯】
AI算力重心转向“推理时代”:2026年企业如何重新评估芯片选型与算力部署?
面向2026年,企业算力规划正从训练规模转向可控成本的持续推理服务。文章比较GPGPU与DSA的适用负载,分析端云协同和分层部署,并建议以延迟、吞吐、每百万Token成本、能耗及全生命周期TCO评估芯片、软件栈与运维体系。
智能体进入工程化竞争期:企业评估工作流自动化方案要看哪些技术条件?
智能体进入工程化竞争期,竞争重点从模型参数规模转向真实流程中的稳定性与可核验价值。企业应先判断任务是否适合智能体,再评估工程化技术条件,重点考察任务编排、工具调用、知识接入、权限安全、全链路监控,并让真实反馈回流评测集,形成持续改进闭环。
智能体AI算力采购不能只看GPU:如何评估CPU、内存与工具调用链?
智能体AI算力采购不能只看GPU型号与峰值吞吐,CPU调度、内存带宽和工具调用链往往才是瓶颈。评估应围绕完整任务耗时与尾延迟展开,核心数多不等于工作流更快,需按链路考察数据搬运和一致性问题。
工信部部署“人工智能+软件”:企业如何把专项行动转化为数字化增长机会?
【软盟资讯·新闻导读】2026年9月11日,工信部印发《“人工智能+软件”专项行动实施方案》,提出到2028年推动软件和信息技术服务业智能化水平显著提升,推广应用覆盖2万家规模以上软件企业,实施100项软件企业智能化技改项目,并在重点行业打…
从半年到几天:中策橡胶如何利用 AI 智能体将研发周期缩短 90%?
中策橡胶自2025年6月起陆续投用18个AI智能体,覆盖研发、生产和测试,通过虚拟工厂批量生成轮胎方案、仿真筛选并回流数据,部分花纹方案几分钟可生成。公开资料显示研制周期缩短50%,但尚不足以证明“半年到几天”或整体缩短90%,案例关键在于重构研发闭环。
DeepSeek V4.1 Flash发布:原生视觉、MoE与KV缓存如何影响企业模型选型
DeepSeek V4.1 Flash采用原生视觉与MoE架构,输入、输出阶段分别激活约80亿和160亿参数,并以较小KV缓存支持长上下文与高并发。企业选型不能只看5520亿总参数,还应综合权重显存、专家通信、视觉输入、缓存管理及端到端成本,在目标硬件和业务负载下实测。
从训练转向推理:企业如何评估Prefill与Decode分离的AI算力架构?
智能体场景下,AI推理应从单卡峰值转向系统级评估。Prefill与Decode分离可分别优化TTFT和TPOT,但会引入KV Cache传输、路由、故障处理及网络开销。企业需结合上下文长度、并发、显存带宽、互连网络、分层存储与单位Token成本测试整体收益。
置顶 每日AI必读资讯:AI人工智能领域最新热点资讯汇总(2026年09月11日)
每日AI必读资讯:(2026年09月11日)今日AI看点密集:工信部印发”人工智能+软件”专项行动方案;OpenAI考虑放缓前沿AI开发,奥特曼呼吁行业协同;美国加州签署儿童AI安全新规;DeepSeek发布V4.1 Flash,燧原科技登陆科创板,”国产AI芯片四小龙”齐聚资本市场;OpenAI推出实时语音GPT-Live-1;京东开源视听世界模型,宇树公开人形机器人通用大脑,高德发布3D原生城市世界模型。