维拉·鲁宾全球推广:每兆瓦令牌成为新的AI基础设施标准
NVIDIA的维拉·鲁宾正在主要云平台和数百个工厂现场推广,将竞争优势重新定义为每兆瓦令牌数、每令牌推理成本和机架级效率。这一转变有利于自主工作负载、极端协同设计和将机架转变为统一加速器的网络结构。

获取最新的 AI 洞察和故事,直接发送至您的收件箱。
探索更广泛的 AI 行业新闻以及围绕 AI 落地应用、公司动态、产品趋势、初创公司动向、监管政策、搜索变革、具身智能、自动化和业务转型的有用背景信息。此类别让 NexusAI 用户了解更广泛的 AI 全景,而不侧重于财务、股票或投资建议。


NVIDIA的维拉·鲁宾正在主要云平台和数百个工厂现场推广,将竞争优势重新定义为每兆瓦令牌数、每令牌推理成本和机架级效率。这一转变有利于自主工作负载、极端协同设计和将机架转变为统一加速器的网络结构。

Kimi 拒绝讨论敏感政治问题,显示了可下载模型和免费访问不应自动被误认为是知识自由的原因。

OpenAI 的新小型企业计划整合了培训、工作流程手册和合作伙伴集成,表明下一波 AI 增长依赖于让日常团队能够在会计、营销和运营中部署代理。以下是创始人、运营者和供应商的变化,以及如何在 90 天内实现投资回报。

医疗人工智能部署正从花哨的多工具推广转向以证据为导向、融入工作流程的系统。联影的谨慎策略强调了医院真正购买的内容:具备前瞻性证明的模型、紧密的PACS/RIS集成、正常运行时间保证以及操作员信任。对供应商而言,可靠性胜过口号;对买家而言,投资回报率跟随产能、安全性和减少重复扫描。

Infinity正在构建一个CUDA替代的推理堆栈,能够自动生成并调优跨多种加速器的低级内核,旨在使模型部署更加便携且成本更低。凭借新一轮融资和早期芯片合作伙伴,它瞄准了Nvidia的软件护城河以及AI构建者面临的成本和容量压力。

微软七月的安全发布修补了570个Windows及平台问题,显示出AI辅助发现现已覆盖庞大代码库。瓶颈已转向企业运营:分流、验证和安全部署必须加速,才能在对手利用自身AI工具武器化新漏洞之前完成。

42个州的抗议,142起记录在案的行动,以及6月份一项调查显示只有14%的人欢迎本地设施,这些都表明了一个新现实:人工智能数据中心必须赢得社会许可。电力、水资源、税收优惠和噪音现在是董事会层面的风险,而非许可的附注。以下是领导者应如何应对。

Agility Robotics 在弗里蒙特的新培训中心将人形机器人从炫目的演示转向经过审计的、可重复的工厂工作。重点是技能库、安全认证以及与仓库和企业系统的端到端集成——这表明未来 12 到 24 个月内,人形机器人市场将由真实部署而非原型塑造。