找到
1978
篇与
互联网
相关的结果
- 第 52 页
-
OpenAI发布GPT-5.2迎战Gemini,号称智能体编码最强,赶超人类专家,Altman料1月解除红色警报 OpenAI周四正式发布GPT-5.2系列模型,打响了迎战谷歌Gemini 3的第一枪。CEO Sam Altman淡化Gemini 3带来的冲击,预计明年1月就可以解除所谓“红色警报”的状态,以非常强劲的姿态重回常态GPT-5.2是OpenAI迄今最先进的人工智能(AI)模型,针对专业工作场景进行了全面优化,创多个基准测试的行业记录,其中的GPT-5.2 Thinking刷新了SWE编码能力测试的历史最高分,也是OpenAI首个性能达到或超过人类专家水平的模型。OpenAI应用业务的CEO Fidji Simo表示,GPT-5.2在创建电子表格、制作演示文稿、图像识别、代码编写和长文本理解等方面均优于前代产品,旨在"为人们创造更多经济价值"。OpenAI的研究副总Adain Clark称,GPT-5.2在数学推理方面的进步意味着它能更好地处理金融建模、预测和数据分析等任务。 OpenAI宣布,周四当天GPT5.2就在ChatGPT上线,面向Plus,、Pro、Go、Business和 Enterprise这些付费套餐的用户, 共推出Instant、Thinking和Pro三个版本,API也同步开放给所有开发者。在ChatGPT中,付费用户可使用三个版本的GPT-5.2,且在未来三个月内仍可继续使用GPT-5.1。在API平台,GPT-5.2定价为每百万输入token 1.75美元、每百万输出token 14美元,缓存输入可享受90%折扣。虽然单token价格高于GPT-5.1,但OpenAI表示,由于模型效率更高,达到相同质量水平的总成本反而更低。 新模型发布是OpenAI对Gemini 3掀起又一轮竞争的正式回应。本周稍早媒体称OpenAI的CEO Sam Altman最近发布内部"红色警报"备忘录,要求公司将资源集中用于改进ChatGPT。几周前,谷歌推出的Gemini 3因其推理和编码能力广受好评,迅速登上LMArena和Humanity's Last Exam等权威排行榜榜首,给OpenAI带来压力。评论认为,GPT-5.2 与其说是重新发明,不如说是对OpenAI最近两次升级的整合。8月发布的 GPT-5 是一次重置,为统一系统奠定了基础,它可以在快速默认模型和更深入的“思考”模式之间切换。11月发布的 GPT-5.1专注于使该系统更加友好、更具对话性,并更适合智能体和编码任务。GPT-5.2似乎进一步提升了所有这些进步,使其成为生产应用更可靠的基础。三个版本GPT5.2分别主打快速、深度、智能可靠 对于周四提供的三个版本GPT 5.2,OpenAI分别介绍称,Instant是快速高效的日常工作和学习助手,在信息查询、操作指南、技术写作和翻译方面均有显著提升。,并延续了 GPT-5.1 Instant 中更亲切的对话风格。早期测试者尤其注意到,GPT-5.2 的解释更加清晰,能够直接呈现关键信息。Thinking 专为深度工作而设计,能够帮助用户更高效地完成更复杂的任务,尤其是在编码、总结长篇文档、回答有关上传文件的问题、逐步进行数学和逻辑运算、以更清晰的框架和更有用的细节辅助规划和决策方面。Pro是需要高质量回答难题时“最智能、最可靠”的选择。早期测试表明,它在编程等复杂领域表现更出色,且重大错误更少。性能全面领先,多项基准测试创新高GPT-5.2在多个关键基准测试中刷新了行业纪录。在GDPval测试中,该模型在涵盖44个职业的知识工作任务上,有70.9%的表现达到或超过行业专家水平。OpenAI称,GPT-5.2 Thinking完成这些任务的速度是专家的11倍以上,成本不到专家的1%。 在编码能力方面,GPT-5.2 Thinking在SWE-Bench Pro上取得55.6%的成绩,在SWE-bench Verified上更是达到80%的新高。这一基准测试真实世界软件工程任务,涵盖四种编程语言。OpenAI的产品负责人Max Schwarzer表示,GPT-5.2在代码生成和调试方面取得重大进步,Windsurf和CharlieCode等编码初创公司报告称该模型实现了"最先进的智能体编码性能"。 OpenAI声称GPT-5.2 Thinking是"世界上最好的视觉模型",在图表推理和软件界面理解方面的错误率降低了约一半。在长文本处理上,该模型在OpenAI MRCRv2测试中率先在25.6万token范围内实现近100%的准确率,使其特别适合深度文档分析和多源信息工作流。在科学研究领域,GPT-5.2 Pro在GPQA Diamond测试中达到93.2%的准确率,GPT-5.2 Thinking紧随其后为92.4%。在专家级数学测试FrontierMath上,GPT-5.2 Thinking解决了40.3%的问题,创下新纪录。OpenAI称GPT-5.2 Pro和GPT-5.2 Thinking是"世界上最好的科学家助手模型"。 Altman称Gemini 3影响没担心的大面对Gemini 3带来的竞争压力,Altman周四接受媒体采访时表示:“Gemini 3对我们指标的影响可能没有我们担心的大。”他预计,OpenAI将在明年1月前以“非常强势的地位”退出红色警报模式。关于红色警报的原因,Simo在记者会上解释称:"我们宣布红色警报是为了向公司发出信号,表明我们希望将资源集中在某个特定领域,这是明确优先事项和可降级事项的方式。" 她强调,虽然ChatGPT获得了更多资源投入,但GPT-5.2的发布已筹备多月,并非因红色警报而匆忙推出。虽然Altman据称在内部备忘录中将图像生成列为优先事项,但此次OpenAI的新品发布并未包含新的图像生成器。据报道,OpenAI计划在明年1月发布另一款新模型,将提供更好的图像生成、更快的速度和更强的个性化能力,但公司周四未确认这一计划。OpenAI还宣布推出年龄预测软件,以便为18岁以下用户提供内容保护。Simo透露,公司将在明年第一季度推出"成人模式",Altman此前表示该模式可能允许"为经过验证的成年人提供情色内容"等用途。企业客户成为争夺焦点GPT-5.2的发布明确瞄准企业市场。OpenAI本周早些时候发布的新数据显示,过去一年其AI工具的企业使用量大幅飙升。公司称,ChatGPT Enterprise平均用户表示AI每天为他们节省40至60分钟,重度用户每周节省超过10小时。Notion、Box、Shopify、Harvey和Zoom等企业客户观察到,GPT-5.2展示了最先进的长周期推理和工具调用性能。Databricks、Hex和Triple Whale发现该模型在智能体数据科学和文档分析任务上表现出色。Cognition、Warp、Charlie Labs、JetBrains和Augment Code则表示GPT-5.2提供了最先进的智能体编码性能。在工具调用方面,GPT-5.2 Thinking在Tau2-bench Telecom测试中达到98.7%的准确率,展示了其在长时间、多轮次任务中可靠使用工具的能力。在一个涉及航班延误、转机失败和医疗座位需求的复杂客户服务案例中,GPT-5.2成功协调了重新预订、特殊协助座位和补偿等全部流程。 这一战略转向正值关键时刻。OpenAI已承诺在未来几年投入超过1万亿美元用于AI基础设施建设,但如今谷歌正在迎头赶上。据报道,OpenAI的推理计算支出大部分以现金支付而非使用云积分,表明公司的计算成本已超出合作伙伴关系和积分所能补贴的范围。对推理模型的加倍投入可能形成恶性循环:为赢得排行榜而增加计算支出,然后为大规模运行这些高成本模型而进一步增加支出。在定价策略上,虽然ChatGPT订阅价格保持不变,但API中的GPT-5.2单token价格高于GPT-5.1,不过仍低于其他前沿模型。OpenAI目前没有弃用GPT-5.1、GPT-5或GPT-4.1的计划,并承诺会提前充分通知开发者任何弃用计划。 -
GPT-5.2首发评测:大神深度体验两周,强到离谱,但慢得抓狂 ↑阅读之前记得关注+星标⭐️,,每天才能第一时间接收到更新为了紧急对抗谷歌的Gemini 3 ,OpenAI 刚刚推出了GPT-5.2,sam Altman 叫喊这是很长时间以来最大的更新 基准测试分数官方的发布博客文章都有,跑分屠榜,编程能力非常强,但现在的这些分数看看就好了,感兴趣的看这里https://openai.com/index/introducing-gpt-5-2/ GPT-5.2 的幻觉减少了大约 30-40% 价格更贵了 另外圣诞节还有发布,估计是图像模型更新?ChatGPT 的“成人模式”目前计划于明年第一季度推出 这里我分享一下大神OthersideAI CEO Matt Shumer 对 GPT-5.2 深度评测,这哥们已经拿到内测两周了核心要点先放在前面:指令遵循和任务意愿:GPT-5.2 Thinking 在指令遵循和尝试完成困难任务的意愿上,迈出了有意义的一步代码生成能力提升巨大:比 GPT-5.1 好得多。能力更强、更自主、更谨慎,并且愿意编写多得多的代码视觉和长上下文:大幅改进,尤其是在理解图像中的位置和处理大型代码库方面速度是主要缺点:作者体验中,Thinking 模式在处理大多数问题时都非常慢(尽管其他测试者反馈不一)。他几乎从不使用 Instant 模式GPT-5.2 Pro:在深度推理方面强到离谱,但速度很慢,而且偶尔会陷入长时间思考后仍然失败的境地Codex CLI:GPT-5.2 是作者在命令行工具中使用过的最接近 Pro 级编码能力的模型,但实现这一能力的高级推理模式有时需要漫长的等待以下是详细评测内容。GPT-5.2 Thinking:直觉的提升 GPT-5.2 最引人注目的地方在于它遵循指令的方式——不是基础的“我说你做”,而是“真正完成我所描述的整个任务”作者举了一个例子。在测试创意写作时,他要求模型先想出50个情节构思,然后再选出最好的一个来写故事。大多数模型会走捷径,可能只给出10个想法,选一个就开始。而 GPT-5.2 确实生成了全部50个构思,然后才进行选择。这听起来是小事,但并非如此。在进行创意工作或研究时,多出来的40个想法中可能就包含了那个真正有趣的火花。模型信任流程,而不是为了速度而优化,这一点至关重要。作者进一步测试,要求它写一本200页的书。虽然书页内容本身很弱且简短,模型还无法一次性写出可出版的小说,但令人印象深刻的是,它确实尝试去做了。它构建了整本书的结构,甚至设置成了PDF格式。大多数模型会假设自己做不到,甚至不会尝试,它们会告诉你“这太长了”,或者只给你一个大纲GPT-5.2 则是直接上手。这种愿意尝试宏大任务(即便不完美)的意愿,开启了新的工作流。代码生成:真正的进步 GPT-5.2 在代码生成方面确实比以前的模型有了巨大进步。它写的代码质量更高,能处理的任务也更庞大例如,作者用 Three.js 动画来压力测试其空间推理能力。他要求模型构建一个棒球场景,它生成的风格比大多数模型更逼真(纹理/光照效果很棒),但空间感知和物体放置仍有很大改进空间 此外,该模型愿意编写比之前版本多得多的代码,并且能持续工作更长时间不中断。这是实实在在的能力提升。视觉和长上下文 5.2 版本的视觉能力有显著提升。它对图像的理解,特别是位置和空间关系,有了很大的不同(尽管空间生成能力仍在开发中)。这对操作计算机的智能体来说是个好消息。它的长上下文能力也很出色。在处理大型代码库、大量数据和长篇分析时感觉比以前更稳定,这也是 GPT-5.2 在智能体编码工作流中表现出色的原因之一。作者在这里吐槽了一点:模型已经变得如此强大,但 OpenAI 的 ChatGPT 界面却完全没跟上。例如,ChatGPT 中的 Canvas 界面仍然无法处理大量代码。他最初在 Canvas 中尝试 Three.js 测试,但模型输出的代码量超出了 Canvas 的处理能力另外,Pro 模式仍然只能在 ChatGPT 内部使用,而不能在 Codex CLI 中使用,这让作者持续感到沮丧。为了解决这个问题,他使用一个叫 RepoPrompt 的工具:将本地代码库转成提示词粘贴给 5.2 Pro,再把模型的回答粘贴回 RepoPrompt,由后者将变更应用到代码库。虽然多了一个步骤,但这让他能在真实代码库上利用 Pro 级别的推理能力。风格 用过 OpenAI 模型的人都知道它们对项目符号(bullet points)的执着。GPT-5.2 延续了这一传统。当你让它解释某件事时,往往会得到一个项目符号列表,而其实几段清晰的文字效果会更好。通过精心设计提示词(比如明确要求流畅的散文风格),可以规避这个问题。除了项目符号,写作风格整体有所改善。虽然不是对 GPT-5.1 的巨大飞跃,但确实更好了一些积极的一面是,GPT-5.2 学会了在回答中保持简洁。当我问一些简单问题时,偶尔能得到简单的答案。作者表示,虽然这还没成为默认行为,但已是进步。速度问题 这一点影响了作者的日常使用:标准的 GPT-5.2 Thinking 很慢。根据他的经验,即使是简单直接的问题,速度也非常非常慢。不过,他也提到其他测试者报告了不同的速度表现,有些任务快,有些任务慢。在实际工作中,这意味着他很少使用 GPT-5.2 Thinking。他的工作流变成了: • 快速问题 → Claude Opus 4.5 • 深度推理 → GPT-5.2 Pro 标准的 Thinking 模型处于一个尴尬的中间地带:比 Opus 慢,又没有 Pro 完整的推理优势。各模型横向对比 作者同时使用 Claude Opus 4.5、Gemini 3 Pro 和 GPT-5.2,它们在他的工作流中形成了明确分工:用于快速提问:“X的语法是什么”或“提醒我Y如何工作”这类问题Claude Opus 4.5 胜出。它更快,更直接。用于研究和复杂推理:GPT-5.2 Pro 明显更胜一筹。当任务需要从多个角度思考、需要整合大量上下文时,Pro 的表现最优用于前端UI生成:GPT-5.2 Thinking 和 Pro 都比之前的 GPT 模型有进步,但两者都不及 Gemini 3 Pro。这里的区别很微妙:Gemini 3 Pro 有最好的审美感,其 UI 看起来很棒。但它在布局和前端工程方面的可靠性稍差。所以,如果需要功能正确、能处理边缘情况的UI,作者还是会用 Opus 或 GPT。如果只是追求漂亮,并愿意自己修复代码,Gemini 3 Pro 是目前最佳选择GPT-5.2 Pro:一个缓慢的天才 Pro 模式是真正有趣的地方。它是一个独立的系统,且只在 ChatGPT 中可用。简而言之:Pro 聪明到离谱。Thinking 和 Pro 之间的智能差距立即可见。但比原始智能更重要的是 Pro 的思考意愿。它会花费比以往 Pro 模型长得多的时间来解决一个问题。对于研究任务,如果需要,它会进行极长时间的资料搜集。食谱测试作者举了一个具体例子。他向模型寻求膳食计划帮助,并强调自己“没有时间做饭”,需要一个7天的计划(每天三餐两点)。Pro 提供了出色的食谱计划,但最突出的是它的配料表——比其他模型建议的简单得多。它理解了“没时间”不仅限制了烹饪时间,也限制了购物的复杂性、准备工作和心力开销。它领会了作者的心态,而不仅仅是字面请求。作者表示,看到这种程度的理解相当令人震惊。他把同样的提示发给了所有其他前沿模型,没有一个考虑到这一点。提示词编写 GPT-5.2 非常擅长编写提示词,这对于充分利用 AI 模型和构建集成 LLM 的软件都很有帮助。它写的提示词考虑周到,并且能预见到作者未曾考虑的边缘情况。在这方面,它与 Claude Opus 4.5 不相上下,并且明显优于 Gemini 3 Pro。Codex CLI 实测 在 Codex CLI 中,作者对 GPT-5.2 进行了广泛测试,结果是越用越印象深刻。这是他所见过的在命令行中最接近 Pro 级模型的体验。它一次性做对的频率远超其他工具。美中不足的是,他只能使用“超高推理模式”,这个模式有时会花费漫长的时间,甚至比 Pro 还慢。其自主性比以前的模型有明显提升。但真正的区别在于它收集上下文的方式。Claude Opus 4.5 倾向于在完全理解问题前就开始写代码,它会做出假设,然后碰壁。而 GPT-5.2 不会这样。它会先提问、读取文件、探索代码库。先收集上下文,再编写代码。这改善了作者的工作流。他检查模型工作的次数越来越少。除非任务至关重要(例如生产代码),他常常让它直接运行而不审查每一处更改。一些小怪癖 作者也遇到了一些 Pro 模式的奇怪行为。它似乎会卡在相互冲突的指令之间,在犹豫几分钟后,把一个简单的任务退回给用户。偶尔,它会思考很长时间,然后仍然失败,这非常浪费时间。据称 OpenAI 已经知晓并正在调查。使用场景总结 经过两周测试,作者给出了他的实用分工: 1. 快速提问和日常任务 : Claude Opus 4.5 仍是首选。它快、准,不浪费时间。 2. 深度研究、复杂推理 : GPT-5.2 Pro 是目前最好的选择。在这种场景下,正确性比速度更重要。 3. 前端样式和UI美学 : Gemini 3 Pro 目前能生成最好看的结果,但需要准备好自己做一些工程清理工作。 4. 在 Codex CLI 中进行严肃的编码工作 : GPT-5.2 是首选,其上下文收集行为和可靠性使其成为智能体编码任务的默认选项。 最后总结GPT-5.2 是一次真正的改进。指令遵循能力明显提高,Pro 模式的智能和可靠性令人印象深刻。对于需要审慎推理的复杂任务,这是作者用过的最好的模型。然而,标准 Thinking 模型的速度问题使他日常很少使用。他最终的用法是:快速任务用 Opus 4.5,深度工作用 Pro。但对于那些 GPT-5.2 擅长的任务,它的表现确实非常亮眼source:https://shumer.dev/gpt52review--end-- 最后记得⭐️我,每天都在更新:欢迎点赞转发推荐评论,别忘了关注我 -
GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型" 财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。 图为OpenAI官网截图OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。 在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。 OpenAI给出的示例除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。 GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。 图为奥尔特曼社媒发文截图OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。 -
迪士尼10亿美元投资OpenAI 并授权漫威星战等IP 财联社12月12日讯(编辑 夏军雄)当地时间周四(12月11日),迪士尼宣布将向人工智能(AI)研究公司OpenAI投资10亿美元,同时授权后者在AI视频生成工具Sora使用旗下众多IP。受此消息提振,迪士尼周四美股早盘一度涨超2%。根据授权协议,从明年年初开始,Sora和ChatGPT Images将可以使用迪士尼、漫威、皮克斯和《星球大战》等超过 200 个角色创作内容,但不包含任何演员的肖像或声音。迪士尼将获得购买更多OpenAI股权的认股权证,并成为OpenAI的主要客户之一。此外,部分由用户生成的视频将被放到迪士尼Disney+流媒体平台上播放。双方将利用OpenAI的模型开发新产品和客户体验,包括面向Disney+用户的功能,而迪士尼也将向公司员工部署ChatGPT。迪士尼CEO鲍勃·艾格在声明中表示:“AI的快速发展标志着我们行业的一个重要时刻。通过与OpenAI的合作,我们将在尊重和保护创作者及其作品的前提下,以更周到、更负责任的方式借助生成式AI扩展我们的叙事力量。”OpenAI首席执行官萨姆·奥尔特曼表示:“迪士尼是全球叙事领域的黄金标准,我们很高兴与迪士尼合作,让Sora和ChatGPT Images能够拓展人们创作和体验精彩内容的方式。”据知情人士透露,过去一年里,OpenAI一直在与迪士尼及其他好莱坞公司接洽,寻求合作伙伴。此举标志着迪士尼在AI方面的战略发生重大转变。此前,在OpenAI与多家公司讨论Sora的版权政策时,迪士尼曾决定不允许旗下角色出现在该应用中。好莱坞对于AI的崛起如临大敌。今年10月,代表数千名演员、导演和音乐人的创意艺术家经纪公司(CAA)表示,OpenAI 通过Sora让艺术家面临“重大风险”,并质疑这家AI公司是否认为创意工作者“值得为他们创作的作品获得报酬与署名”。 -
理想高管回应王兴兴质疑:VLA是自动驾驶最好的模型方案 版权声明:本文版权为网易汽车所有,转载请注明出处。 网易汽车12月11日报道 近日,理想汽车自动驾驶研发高级副总裁郎咸朋通过微博,就宇树科技创始人王兴兴此前提出的“VLA技术路线担忧”进行了回应。郎咸朋明确指出,VLA是理想认为最优的自动驾驶模型方案,而具身智能的关键在于整体系统能力。这一表述不仅回应了技术争议,也提供了理想对自动驾驶未来发展路径的清晰判断。 用效果说话:OTA 8.1是VLA方法论的阶段性验证 郎咸朋强调,“空谈架构不如看疗效”,理想坚持VLA路线的前提,是基于数百万辆车形成的数据闭环。OTA 8.1的更新为这一观点提供了直观验证。感知能力的升级是首要变化,通过使用2D ViT技术将感知分辨率从1K提升至2K,识别距离从100米延长至200米,车辆能够更早识别红绿灯,实现更加平顺和舒适的制动体验。感知能力提升,为模型生成轨迹和控制信号提供了更高质量的输入,这与郎咸朋提出的“模型必须与具身智能系统整体适配”高度契合,也说明具身智能不是单一大脑强就够,而是系统协同的重要体现。 OTA 8.1在路径选择与决策能力上的优化同样显著。在主辅路切换和岔路选择等关键场景中,无效变道明显减少,决策更加精准。理想通过约600万Clips优质驾驶数据对模型重新训练,使VLA能够持续通过强化学习迭代,不断接近人类驾驶逻辑。郎咸朋同时指出,世界模型更适合云端考场,用于仿真和数据生成,而车端推理仍由VLA执行。这种车端务实、云端高逼真训练的分工模式,体现了理想对系统架构的务实思考。 VLA为何是理想的长期坚持:系统论逻辑下的生成式模型 郎咸朋与王兴兴在观点上最大差异在于,前者认为模型关键不在于架构本身,而在于与具身智能系统的适配度。VLA作为生成式模型,可直接生成轨迹与控制信号,表现出用户反馈中的拟人化行为。通过结合大量真实数据与云端仿真数据的持续迭代,VLA逐步形成对空间关系、交通意图和驾驶习惯的理解能力。相比传统端到端+VLM模仿学习,VLA强化学习机制能够处理“未学过”的场景,实现更广泛泛化能力。 百万辆车构建的数据闭环是理想对VLA信心的核心。郎咸朋指出,理想不仅拥有十几亿公里的存量数据,还通过150万辆车获取实时新增数据。在筛选过程中发现,约40%的驾驶数据存在偏向道路一侧或不严格遵守限速的现象,这些数据被保留以保持对真实世界驾驶行为的学习。VLA追求的是接近真实驾驶的自然行为,而非几何意义上的规范轨迹。 系统适配也在底盘层面体现。以VMM(车辆运动管理)模块为例,减速任务中车辆会根据策略划分卡钳制动与液压制动比例,实现安全性和舒适性的平衡。这说明理想的技术体系不是单一模型,而是通过感知、模型、操作系统、芯片与底盘的全链路协同,将系统能力贯穿到每一个决策与执行环节。从这个视角看,“VLA是否最优”已经不是孤立模型问题,而是系统架构下的路径选择问题。 具身智能视角:VLA是通往“汽车类具身机器人”的关键 郎咸朋的回应还明确了理想未来发展方向,自动驾驶是具身智能,而具身智能不是单一技术点,而是系统能力的综合体现。李想曾在内部会议中指出,未来五到十年,具身机器人将呈现汽车类与人形类两种形态。理想选择以汽车类具身机器人为核心,这是其技术与产品战略的基础。 理想在具身智能方向的积累体现在感知、模型、操作系统、算力和本体的全栈协同。郎咸朋强调,“整体系统能力”才是具身智能的本质定义,单项突破无法构建真正的智能体。 VLA之所以成为汽车具身智能的核心,是因为它能够理解物理世界,并在空间理解、思维推理与驾驶行为生成上形成统一逻辑。它融合视觉、语言与行为,具备链式推理能力,生成接近人类司机风格的轨迹,同时通过语言交互形成记忆与驾驶偏好。这正是理想坚持VLA作为长期技术路线的核心逻辑,也是其认为VLA是“最好的自动驾驶方案”的根本原因。 结语:技术争议仍将持续,但路径选择更清晰 郎咸朋的回应并不是一场“技术路线之争”的终局,而是一家深度投入自动驾驶与具身智能的企业,基于技术能力、资源禀赋与产品策略所作出的长期判断。 对于行业来说,VLA、世界模型、端到端等路线的争论不会马上结束,但随着更大规模的车端部署、更成熟的云端仿真体系以及更长期的数据闭环积累,技术路线最终会通过效果决胜,而非观点决胜。 从OTA 8.1的体验提升,到理想具身智能系统框架的逐渐清晰,可以确认的是:理想正在用一个越来越系统化、越来越工程化的方式构建其自动驾驶体系。而VLA是否最终成为定义行业的主流路径,仍需时间验证。 对于用户与行业观察者来说,此次回应至少提供了一个清晰信号:VLA不是一个模型,而是一个系统;自动驾驶不是一个功能,而是具身智能的第一场战役。 -
Robotaxi发生伤人事故 哈啰出行自动驾驶业务暂停运营 界面新闻记者 | 周末 林鑫龙 界面新闻编辑 | 文姝琪 自动驾驶商业化提速之际,哈啰株洲Robotaxi的一起伤人事故,再度将技术成熟度与安全边界的疑问推向台前。12月6日,多段网传视频显示,在湖南省株洲市,一辆车身贴有“哈啰自动驾驶”字样的车辆停在斑马线附近,有行人被卷入车底,市民与民警合力抬车救援。据新京报报道,事发地在斑马线处,湖南省直中医院确认在事发当日从现场接收了两名伤者。截至12月10日,当地交警部门尚未公布具体的事故责任认定及后续情况。多名株洲市民对界面新闻表示,当地连日有密集的洒水车作业,“一整天地就没干过”,此前亦有电动车滑倒的情况发生。截至发稿,哈啰方面未对事故作出回应。界面新闻致电哈啰自动驾驶客服获悉,湖南株洲地区的自动驾驶业务现已“暂时停止运营”, 恢复时间未定。记者实测发现,截至12月10日,将哈啰APP定位调整至湖南株洲、江苏溧阳两地时,应用主页仍保留“自动驾驶”入口;但在实际操作选定上车点时,软件均显示“不在运营区域”。此外,发布于12月6日下午的一则本地抖音视频显示,大量标识为“哈啰自动驾驶”的车辆成批驶出。短视频评论区中,部分当地用户反映已无法打到自动驾驶出租车。 哈啰自动驾驶车辆成批驶出 图片来源:抖音账号@株洲摄影家值得注意的是,在此次伤人事故发生前一周,已有株洲市民在社交媒体平台反应乘坐哈啰自动驾驶出租车时发生碰撞事故。该用户向界面新闻记者透露,11月28日早晨,其乘坐的哈啰自动驾驶车辆在行程中与社会车辆发生碰撞,导致“车门撞瘪了”。据该用户描述,事故发生地距离目的地不足200米,但涉事车辆在碰撞后并未紧急制动或停留,而是继续行驶直至终点。事发后,该乘客通过哈啰城市运营群反馈情况。客服人员回应称,安全员在事故发生后已介入并接管车辆。然而,该乘客表示其在体感上“无法辨别”是否有人工接管,并对处置流程的合规性有所疑问:依据交通法规,事故发生后应立即停车报警并保留现场;即便是为了乘客安全,在仅剩百余米的情况下,让乘客下车步行显然是更合理的选择,而非由事故车辆继续载客行驶。 用户在抖音平台发布的事故后与客服沟通聊天记录 图片来源:受访者提供据株洲日报报道,哈啰智能网联汽车属于L4级别的高度自动驾驶,于8月4日在天元区许可道路上开放示范活动。哈啰株洲方面相关负责人曾表示,“我们在株洲市配置了道路车辆的远程监控,通过远程云舱中心的远程驾驶员可以随时接管。”此前,哈啰自动驾驶团队曾因当地“超预期的乘车需求”,就用户平均等待时间增长致歉。国际自动机工程师学会定义了从 L0(完全手动)到L5(完全自动)的汽车自动驾驶技术标准,L3及以上即为自动驾驶。L4为高度自动驾驶,指在特定环境和条件下,车辆可实现自动驾驶,无需人类驾驶员干预。无论是上述乘客的个案遭遇,还是事发后舆论场的广泛讨论,都指向了同一个核心疑问:当自动驾驶车辆发生事故,责任主体究竟该如何界定?上海大邦律师事务所高级合伙人游云庭律师对界面新闻表示,事故中车辆与行人的责任划分需依据交警部门认定。若L4级自动驾驶车辆被判担责,责任方应归属于车辆的运营平台。游云庭指出,鉴于现行交规主要归责于驾驶员,此类事故更适用产品质量法,民事赔偿责任首先由运营平台承担;技术提供商若明知产品存在重大缺陷仍投入使用,则可能面临更严厉的法律追究。若造成严重后果,技术提供商可能涉嫌生产、销售不符合安全标准的产品罪或重大责任事故罪。但他也强调,此类案件面临较高的证据壁垒,需要对应数据或内部沟通证据证明技术方明知产品缺陷存在,且缺陷导致了事故发生。作为国内共享单车头部运营商,哈啰出行在Robotaxi赛道是典型的“后来者”。直至今年6月,哈啰出行才正式宣布进军Robotaxi(自动驾驶)赛道。此前,哈啰联合蚂蚁集团、宁德时代一起成立“上海造父智能科技有限公司”,专注于L4级自动驾驶技术研发、安全应用和商业化落地,三方首期合计出资超过30亿元。据界面新闻此前报道,哈啰Robotaxi业务首席科学家Yolanda当时曾公开表示,称Robotaxi业务目前会以国内为主,公司目标是三年内落地商业化,并如此解读哈啰Robotaxi的业务模式:“蚂蚁集团在AI基础建设,AI算力、算法的研究上可以给到我们很大的助力。宁德时代可以在车辆上提供滑板底盘、电池动力技术等方面的集成和支持。”今年9月的2025Inclusion:外滩大会上,哈啰公布了首款前装量产Robotaxi车型“HR1”,并宣布规划于2026年实现量产下线,2027年部署超5万辆Robotaxi车型。 哈啰首款前装量产Robotaxi车型“HR1”(Hello Robot1)全球首发亮相但本次事故现场图片及网传视频显示的涉事车辆并非此前亮相的“HR1”。一名业内人士对界面新闻指出,Robotaxi的大规模商用通常需要大量里程的路测数据积累作为安全支撑,“即使路测数据可以购买、技术短时间内可以突破,但哈啰出行成立至今的短短半年,难以积累足够的路测里程数。”从有安全员到无安全员,不载客到载客,没有企业可以跳过此类路测步骤,哈啰出行显然也不例外。一位年初自哈啰离职的人士则对界面新闻表示,今年刚刚组建的团队,可能都是“拿来主义”,“在Robotaxi的技术算法方面的积累并不深厚”;去年公司曾计划购买百度高精地图,后因资方原因未成行。BOSS直聘平台显示,目前哈啰普惠检索“智驾”“自动驾驶”的相关在招岗位达数十个,包括产品负责人- Robotaxi、智驾工程部署负责人、智驾硬件产品专家、智驾系统架构专家、智驾专项电控专家、智驾量产项目专家等等,不一而足。根据哈啰出行官方信息,在“HR1”亮相的同日,为加速推进规模化目标实现,哈啰还分别与启辰汽车、阿里云、地平线、禾赛等签署战略合作协议,宣布将共同推进Robotaxi从技术研发到量产落地。这意味着,Robotaxi技术版图仍在搭建中的哈啰出行,或许才刚刚出发不久。 -
通用AI助手灵光正式上线网页版,开启多端生态 封面新闻记者 张越熙12月9日,全模态通用AI助手灵光正式推出网页版,补全了灵光的多端生态。 记者看到,网页版延续了“30秒用自然语言生成小应用”的核心优势,实现了与移动端的数据与创作同步。用户可在电脑上描述需求,快速生成、编辑并管理对话和闪应用,并在手机端继续使用和分享。灵光网页版灰测数据显示,灵光网页版主要被用于工作和学习场景的生产力提升。此次网页版正式开放,聚焦职场和教育场景功能优化。通用AI助手领域竞争激烈,豆包、通义千问、DeepSeek等头部企业各以多模态交互、场景渗透或技术纵深构筑优势。在此背景下,行业正呈现三大关键趋势:一是全场景覆盖成为核心竞争维度,单一终端难以满足用户碎片化需求,多端协同(移动端+网页端+智能硬件)成为行业标配;二是技术融合加速生态构建,如“闪应用”生成等创新功能需跨端能力支撑,推动AI助手从工具向平台化生态演进;三是用户体验驱动技术落地,网页端拓展强化了办公、学习等生产力场景的渗透力,与移动端形成互补,标志着行业从“流量争夺”转向“价值深耕”。多端生态的布局本质是AI助手行业成熟化的必然选择——通过打破设备壁垒,整合技术能力,行业参与者正共同推动AI从“尝鲜体验”转变为“深度依赖的生产力工具”。这一转变不仅提升用户效率,更倒逼技术迭代与场景适配,加速AI助手从单点突破迈向全链条价值释放,为行业规模化应用奠定生态基础。 -
微软AI帮你定制年终高情商话术:写总结、谈加薪、不得罪同事 IT之家 12 月 10 日消息,微软昨日(12 月 9 日)发布博文,为缓解员工年底的职场压力,升级 Microsoft Copilot,引入了年终绩效考核辅助功能,辅助用户撰写年终总结等。针对许多员工唯恐避之不及的敏感对话,如预算申请、职位晋升或职责调整,Copilot 能够提供具体的指导。微软在演示中举例:一名 25 岁的营销人员如何在公司预算紧缩的背景下申请加薪。 IT之家援引博文介绍,Copilot 对此生成了一份完整的沟通脚本,既恰当地表达了对公司的感激,又客观陈述了工作量的增加,同时提出了符合现实的期望。这一功能将员工从繁琐的措辞推敲中解放出来,让其能专注于核心诉求的传达。在个人自评环节,Copilot 展现了强大的数据整合能力。该工具能够从用户的电子邮件、OneNote 页面、状态报告及演示文档中抓取关键信息,自动生成一份详尽的自我评估报告。 根据微软展示的案例,Copilot 成功梳理了员工的季度销售业绩、新流程开发的贡献以及导师辅导工作等核心亮点,确保这些容易被遗忘的“隐形贡献”被完整纳入年终考核中。此外,Copilot 在处理同事互评(Peer Review)时充当了“职场润滑剂”的角色,提出建设性批评通常被视为职场“雷区”,稍有不慎便会引发矛盾。 微软表示,Copilot 能有效软化语言基调,建议使用鼓励性而非严厉的措辞。例如,当员工需要评价一位能力尚可但态度消极的同事时,Copilot 能够重写评价内容,在指出问题的同时保持支持性的语调,从而降低沟通风险。 -
冒牌ChatGPT Atlas浏览器现身:利用用户信任窃取账户密码 近期,一款假冒的ChatGPT Atlas浏览器出现在互联网上,其攻击方式主要是利用用户的信任感来窃取电脑内存储的账户和密码。据研究机构Fable在12月2日的报道,该假冒浏览器的下载入口位于搜索结果的广告位头牌。其官网与ChatGPT Atlas正版官网几乎完全一样,布局、设计、文案都被完美复制,但域名是Google Sites的,这是一处明显的破绽。现代黑客通常会使用v0.dev这样的工具来克隆正规网站,并将其托管至Google Sites,以此让不熟悉互联网的用户产生“谷歌等于可信”的错觉。对于懂电脑知识的人来说,一眼就能看出其中的问题,但不熟悉计算机的用户往往不会察觉,而是会照做。这段命令看起来无害,只是一段base64编码的字符串,敲入终端后通过curl传入并交由bash执行。之后,木马会弹出窗口要求用户输入管理员密码。一旦用户输入,它就会以sudo权限运行第二阶段的恶意载荷,在电脑上为所欲为,并窃取电脑里存储的账户密码等敏感信息。这种攻击手段实际上是ClickFix的变体,黑客的手段并不高超,只是利用了社会工程学,利用普通用户的天然信任感,诱导用户手动执行命令。 -
8点1氪|山姆回应“麻薯盒内出现活老鼠”;水银体温计明年起禁产;京东外卖回应“随心囤”Bug :将承担商家全部损失 今日热点导览 QQ密集更新功能,上线消息新形态 特朗普宣布:允许英伟达向中国出售H200芯片 业内人士称苹果取卡针没有回收价值 雷军回应小米AES紧急转向辅助功能 努比亚总裁与抖音副总裁回应豆包AI手机问题 TOP3大新闻山姆回应“麻薯盒内出现活老鼠”:初步判断在取货点放置期间被偶然侵入12月9日凌晨,深圳一名消费者晒出其日常订单,其于12月8日晚通过山姆App的“极速达”服务,购买了一盒24枚装Member's Mark原味麻薯在内的商品。但当晚送达的银色保温袋中出现了一只老鼠。对此,山姆向界面新闻回应,山姆已第一时间联动专业虫害公司开展全链路核查;经回溯商品制作、包装、仓库上架、拣货等环节的巡查记录与仓内监控视频,均未发现虫害痕迹或异常。山姆称,该订单地址的取货点位于室外;第三方专业虫害技术人员赴取货点现场勘察发现,该地点周边有花木丛,为野生虫害提供了栖息条件,且现场发现相关活动痕迹;综合商品制作、储运环节的虫害检查结果和第三方虫害技术人员鉴定结果,初步判断商品系在取货点放置期间,被周边虫害偶然侵入所致。目前,山姆已与消费者及时沟通并妥善解决,后续将加强包装管理和配送服务。山姆表示,对于此事件给会员带来的困扰与不便深表歉意,后续将加强包装管理和配送服务。(界面新闻、中新经纬)水银体温计血压计明年起禁产水银体温计明年起就不再被允许生产了,据国家药监局的通知,从2026年1月1日起,中国将全面禁止生产含有的“汞”元素体温计和血压计产品。据悉,因测量精准、价格便宜,它们一直以来是家庭医疗“老伙计”。为啥要禁它?核心只有一个词,安全。水银,也就是汞,是一种毒性很强的重金属。打碎一支体温计需通风近一个月,一支小小的体温计如果被打碎,里面泄露出来的那不到1克的汞,就足以让一个15平方米的房间,空气中汞浓度短时飙升近百倍,且需要近一个月通风才能恢复安全水平。记者查询线上购药平台显示,有多家药店水银体温计售空。某药店客服称:应不会再上架水银体温计。此外,还有药店工作人员表示,今日水银体温计销量大增。(海报新闻、大河报)京东外卖回应“随心囤”出现Bug:平台将承担商家全部损失12月7日晚,京东外卖“随心囤”功能出现BUG。多名网友反馈称,购买京东外卖100张券后申请全额退款,平台只收回了1张券,剩余99张还在用户手里。为此,有网友连续下了上百单外卖。12月8日晚,京东外卖发文表示,平台将承担商家全部损失。(红星新闻)大公司/大事件 SpaceX计划2026年IPO募资超300亿美元据媒体周二报道,埃隆・马斯克旗下的SpaceX正推进IPO计划,拟募资规模将远超300亿美元,目标估值约1.5万亿美元。报道援引知情人士消息称,SpaceX管理层及顾问正推动整家公司于2026年年中至年末完成上市。IPO时间可能根据市场状况及其他因素调整,有消息人士表示上市可能推迟至2027年。(新浪财经)QQ密集更新功能,上线消息新形态12月8日,腾讯QQ宣布经典版QQ回归,瞬间引发众多用户的关注。财报显示,QQ目前的日活用户超过5亿。除了经典模式回归,QQ也迭代了不少新功能。根据应用内的“功能介绍”显示,最近一个阶段,QQ推出或者更新的功能有10多个,包括Q泡消息、QQ闪传、跨应用分享、群接龙、特色互动以及AI头像等。其中,Q泡消息被定义为“新消息形态”,区别于图文、语音,为15秒自带滤镜的短视频消息,在10月份完成测试后,近期正式上线。(中国网财经)特朗普宣布:允许英伟达向中国出售H200芯片据路透社、彭博社等媒体报道,美国总统特朗普当地时间8日在社交媒体上发文宣布,美国政府将允许英伟达向中国出售其H200人工智能芯片,但对每颗芯片收取一定费用。《纽约时报》称,H200芯片为英伟达“性能第二强”的芯片。特朗普表示,美方将从相关芯片出口中收取25%的分成。他还称,美国商务部正在敲定相关安排细节,同样的安排也将适用于超微半导体公司、英特尔等其他人工智能芯片公司。(环球时报)努比亚总裁与抖音副总裁回应豆包AI手机问题36氪获悉,12月9日,努比亚技术有限公司总裁倪飞发文称,团队已收到一些问题与反馈,正在与合作伙伴积极沟通与解决。抖音集团副总裁李亮转发并配文称:AI带来的变革是真实存在的,用户的需求也是真实存在的。豆包和中兴的探索是一个开始,不论这次是否会成功,但AI一定是未来。雷军转发小米安全辅助驾驶实测,重申辅助驾驶不是自动驾驶小米创办人、董事长兼CEO雷军在个人社交平台上表示,再次提醒大家辅助驾驶不是自动驾驶,驾驶仍需保持专注。雷军转发第三方媒体对小米安全辅助驾驶功能实测,结果成功通过高速、城区、夜间三大场景的全部11项测试。具体来说,高速场景下,小米YU7的紧急转向辅助(AES)表现亮眼,在130km/h时速下成功通过静止假车测试,儿童鬼探头场景通过时速达110km/h,AES与AEB(紧急制动辅助)组合测试也以120km/h时速顺利通过。针对日常高频风险,80km/h时速下的二轮车斜穿场景,其紧急制动辅助系统精准响应,稳稳规避碰撞。城区低速场景中,小米YU7同样表现扎实,误加速抑制(MAI)功能顺利通过验证,有效降低驾驶员操作失误引发的安全隐患。测试更跨越白昼与深夜、晴路与雨天,在雨天80时速盲测等复杂环境中依旧稳定发挥。(新浪科技)现货白银首次站上60美元/盎司金十数据12月9日讯,交易员押注美联储降息,国际现货白银持续走强,首次站上60美元/盎司心理关口,日内涨超3%,年内涨幅超过31美元或108%。(金十数据APP)特斯拉机器人演示被质疑远程操控12月7日,特斯拉“擎天柱”机器人在美国迈阿密被拍到做出怪异动作后,遭质疑受远程操控。机器人在倒下过程中,双手上抬做出抓握动作,被怀疑是模仿操作员摘下VR头显。特斯拉首席执行官马斯克曾强调,“擎天柱”演示由AI驱动,非远程操控。目前,特斯拉官方尚未作出回应。(都市快报)业内人士称苹果取卡针没有回收价值近日,苹果官网原价60元的取卡针,被传是“铂金材质、回收超300元”,引发了投机热潮,部分线下店铺甚至出现库存紧俏现象。苹果官方售后工作人员对记者明确表示,公司从未宣称取卡针使用铂金材质,也不清楚相关说法从何而来。有卖家称,自己知道苹果取卡针不是真铂金,但有人信有人买。一名从事贵金属回收的业内人士表示,从未回收过所谓的“苹果铂金卡针”,它没有专门的回收价值。 (闪电新闻)“反诈老陈”举报两名百万网红销售的“果冻”里疑有泻药?官方回应12月8日,网民“反诈老陈”举报两名百万网红销售的“火龙果果冻”“西柚果冻”中疑违规添加泻药成分比沙可啶衍生物。上述产品生产商所属的赣州市市监执法稽查局章贡分局称“早就在调查”。销售公司所属的安徽灵璧县市监局回应称,已立案调查,涉事公司在接到举报之前申请注销,但因为牵扯到了投诉举报事项,“我们不会给他注销的”。此外,记者注意到“反诈老陈”举报的其中一名百万网红“雪糕姐”账号已被平台封禁。(新京报)泡泡玛特4个月跌近44%,市值蒸发超2000亿港元12月9日,港股泡泡玛特股价继续下挫。截至发稿前公司股价下跌4.94%,与8月高点相比跌约44%,市值蒸发超2000亿港元(约合人民币超1800亿元)。德银最新研报指出,为应对需求激增,泡泡玛特将Labubu产能从上半年的1000万只大幅提升至年底月均5000万只。该行警示,对于依赖独特设计与稀缺性驱动的潮流玩具品牌而言,大规模量产往往是热度消退的前兆。(每日经济新闻)梦龙冰淇淋业务收入666亿元,目前已如期上市12月8日,全球最大冰淇淋公司梦龙正式开始在阿姆斯特丹泛欧交易所、伦敦证券交易所和纽约证券交易所三地上市交易。梦龙旗下拥有梦龙、和路雪、可爱多、Ben & Jerry’s等众多知名品牌。据联合利华披露,2024年,其冰淇淋业务收入达到79亿欧元(约合人民币666亿元)。梦龙亦是此种态势。在2024年、2025上半年,该公司在华收入分别为3.17亿欧元(约合人民币26.16亿元)、2.7亿欧元(约合人民币22.29亿元),2025年上半年同比录得双位数增长。(21世纪经济报)美股三大指数收盘涨跌不一,百度跌超4%36氪获悉,12月9日收盘,美股三大指数涨跌不一,道指跌0.38%,纳指涨0.13%,标普500指数跌0.09%。大型科技股涨跌互现,特斯拉、谷歌、Arm涨超1%,微软、亚马逊小幅上涨;Meta跌超1%,英伟达、苹果小幅下跌。热门中概股普跌,百度跌超4%,小鹏汽车、理想汽车跌超3%,B站跌超2%,阿里巴巴、爱奇艺、腾讯音乐、蔚来跌超1%。中国首个燃机发电无人智控系统成功投运记者12月9日从中国华能获悉,中国首个燃机发电智能自主运行控制系统在华能上海燃机电厂成功投运。这是中国首次实现火电燃气机组从启动、并网、负荷调节到停机的全过程无人干预智能自主控制,标志着中国火力发电技术从“传统人工监控”进入“智能自主运行”新阶段。(央视新闻)雷诺集团与福特签署乘用车及商务车战略合作,将在欧洲市场推出两款电动车型12月9日消息,雷诺集团与福特宣布达成战略合作伙伴关系,双方签署了有关两款全新福特品牌电动车型的合作协议,新车型将基于安培平台开发,并在安培电动汽车城(ElectriCity)投产。两款全新车型将由福特主导设计,与雷诺集团共同开发。除电动汽车合作外,雷诺集团还与福特签署了一份关于欧洲轻型商用车型合作的意向书。根据该意向书,双方将共同探索联合开发与生产雷诺及福特品牌旗下特定轻型商用车型的可能性。(界面新闻)银河通用回应拟赴港上市:消息不属实12月9日,有市场消息称国内人形机器人独角兽银河通用正在筹备赴港上市,并称银河通用上市已经筹备数月,预计明年一季度交表。对此,银河通用相关负责人表示:“以上信息不属实,公司股改是为了满足后续正常融资需求,引入新的一级市场投资人。”公开信息显示,11月27日,银河通用完成股改,公司名称从“北京银河通用机器人有限公司”变更为“北京银河通用机器人股份有限公司”,市场主体类型从有限责任公司(外商投资、非独资)变更为股份有限公司(外商投资、非上市)。(每日财经)特朗普抨击欧盟重罚X平台美国总统特朗普12月8日在白宫表示,欧盟对美国企业家马斯克旗下社交媒体平台X处以1.2亿欧元(约合9.9亿元人民币)罚款一事“糟糕且不妥”。特朗普表示,马斯克并未就此事向他打电话求助,并表示不理解欧盟“怎么能这么做”,将会在收到关于此事的完整报告后再谈论此事。特朗普还警告欧洲得“非常小心”了,因为欧洲正走向糟糕的方向。(环球时报)美初创公司申请重新注册使用“推特”商标,称马斯克已弃用美国初创社交媒体平台Operation Bluebird近日向美国专利与商标局提出申请,要求注销“推特”(Twitter)的商标,并由该公司重新申请注册。该公司称,马斯克旗下的X公司已经从其产品、服务和营销中“根除”了推特品牌。(上证报)小米中国区开启人事调整,涉及手机、汽车、大家电等核心运营类岗位小米中国区近期开启一系列人事调整,涉及手机、汽车、大家电等核心运营类岗位。此次的调整跟小米近期中国区业绩“承压”有关。(界面新闻)斯特兰蒂斯将在美国推出纯电微型车,最高时速45公里克莱斯勒母公司斯特兰蒂斯(Stellantis)12月8日宣布,将在美国推出一款名为菲亚特Topolino的全电动小型“汽车”。该公司没有宣布这款车的上市时间,但菲亚特CEO奥利维尔·弗朗索瓦证实了将这款车推向美国市场的计划,“更多细节将在明年公布。”(新浪财经)齐普策将不再担任宝马管理委员会主席,内德尔科维奇明年5月起接任宝马监事会12月9日宣布,米兰·内德尔科维奇(Milan Nedeljković)将于2026年5月14日起正式就任宝马集团管理委员会主席,接替奥利弗·齐普策。内德尔科维奇自2019年起担任宝马管理委员会成员,目前负责生产部门。(新浪财经)投融资 “云深处科技”完成超5亿元C轮融资36氪获悉,12月9日,“云深处科技”宣布完成超5亿元人民币C轮融资。云深处科技本轮融资,由招银国际和华夏基金联合领投,中国电信、中国联通旗下基金参与战略投资,云晖资本、中芯聚源、浙大基金会、首程控股等多家机构跟投,达晨财智、前海方舟、央视融媒体基金、北京机器人产业发展投资基金和华映资本等老股东在本轮继续加持。“智与芯行”完成近亿元天使+轮融资近日,“智与芯行”宣布完成近亿元天使+轮融资。本轮融资由博原资本领投,东方嘉富、一苇资本跟投,老股东蓝驰创投本轮继续加注。一苇资本担任独家财务顾问。本轮融资,公司引进产业投资方博原资本,未来将于工业AI通信等领域展开深入合作。通过本次融资,公司将进一步拓展未来通信、感知、计算融合需求,通过AI网络产品及AI通信芯片产品的研究和开发,为未来的智能世界提供使能的智能化基础设施。AI最前沿 智谱开源“会使用手机的”模型AutoGLM36氪获悉,智谱深夜开源其核心AI Agent模型AutoGLM。该模型被业界视为全球首个具备“Phone Use”(手机操作)能力的AI Agent,能够稳定完成外卖点单、机票预订等长达数十步的复杂操作流程。OpenAI报告称企业人工智能应用激增OpenAI发布首份企业人工智能现状报告,显示人工智能工具正被快速采用,ChatGPT每周用户量已突破8亿。报告指出,企业正从试验阶段转向大规模应用,这与过去主要通用技术的采用周期相呼应。(新浪财经)谷歌与XREAL联合发布Project Aura36氪获悉,在12月9日举行的The Android Show上,谷歌首次公布了Project Aura产品和Android XR系统的关键细节。作为谷歌官方认可的系统级参考硬件,Project Aura标志Gemini AI第一次真正拥有“看见世界”的能力。根据官方信息披露,Project Aura将在2026年正式面向市场。群核科技发布Aholo空间智能开放平台36氪获悉,12月9日,在群核科技2025酷+大会上,群核科技宣布将系统性持续开放其底层空间智能相关能力,发布了Aholo空间智能开放平台。以助力技术在千行百业的加速落地。Meta或将于明年一季度推出新AI大模型Avocado据报道,Meta正在开发一款新的AI大模型,代号为Avocado。知情人士表示,公司内部许多人预计该模型将在今年年底前发布,但目前计划是在2026年第一季度发布。(界面新闻)OpenAI推出首期OpenAI认证课程OpenAI当地时间12月9日宣布推出首期OpenAI认证课程,旨在提供实用的人工智能技能:“人工智能基础课程”将通过与一批企业和公共服务合作伙伴的试点项目在ChatGPT平台推出;“教师版ChatGPT基础课程”则已在Coursera平台上线。(界面新闻)卡塔尔成立国家人工智能公司Qai卡塔尔宣布成立国家人工智能公司Qai,旨在开发先进数字生态系统,以支持创新并促进可持续发展。(财联社)酷产品 三星Galaxy Z TriFold国内亮相36氪获悉,12月9日,三星旗下首款三折叠旗舰Galaxy Z TriFold正式在国内亮相。售价方面,16GB+512GB版本建议零售价19999元,16GB+1TB版本建议零售价21999元。整理|晨曦 -
印度拟推新规:OpenAI、谷歌等公司用版权内容训练AI必须交钱 IT之家 12 月 10 日消息,印度拟推强制性版权使用费制度,要求 AI 公司为其模型训练中使用的受版权保护内容付费,此举或将重塑 OpenAI 和谷歌等公司在这一全球最重要、增长最快的市场之一的运营方式。 当地时间本周二,印度工业和内贸促进部(DPIIT)发布了一项拟议框架:AI 公司将获准使用所有受版权保护的作品进行模型训练,但须向一个由权利人组织组成的新型集体管理机构支付版权使用费,相关费用随后将分配给创作者。该提案主张,这种“强制性一揽子许可”机制可在降低 AI 企业合规成本的同时,确保作家、音乐人、艺术家及其他权利人在其作品被用于商业模型训练时获得合理报酬。印度此项提案出台之际,全球市场对 AI 公司利用受版权保护材料训练模型的做法日益担忧。在美国和欧洲,此类做法已引发作者、新闻机构、艺术家等权利人的多起诉讼。目前,法院和监管机构仍在评估此类训练行为是否构成“合理使用”,导致 AI 企业在法律不确定性中快速扩张业务,而缺乏明确的监管框架。与美国和欧盟仍在就透明度义务和合理使用边界展开政策辩论不同,印度此次提出的方案堪称迄今为止最具干预性的举措之一,即在强制付费的前提下,自动授予 AI 公司使用受版权保护内容的权利。今年 4 月下旬,印度政府成立了一个八人委员会,负责制定相关机制。该委员会认为,这一制度可避免多年法律争议,同时确保创作者从一开始就能获得报酬。在一份 125 页的正式提交文件中,委员会为该制度辩护称,一揽子许可“旨在为 AI 开发者提供便捷的内容获取渠道…… 降低交易成本…… 并确保权利人获得公平报酬”,是管理大规模 AI 训练数据最不具负担的方式。文件还指出,单一集体管理机构将作为“一站式窗口”,免除逐项谈判的繁琐流程,并确保注册与未注册创作者均能获得版税分成。委员会同时强调了印度作为生成式 AI(GenAI)工具市场的重要性。文件援引 OpenAI 首席执行官山姆・奥尔特曼(Sam Altman)的说法称,印度已是该公司仅次于美国的第二大市场,“很可能成为我们最大的市场”。委员会据此指出,鉴于 AI 公司既从印度用户身上获得可观收入,又依赖印度创作者的作品训练其模型,理应将部分价值返还给这些创作者。这正是建立“平衡框架”以保障创作者获得报酬的核心逻辑之一。印度此项提案正值全球围绕 AI 公司能否合法使用受版权保护内容训练模型的法律争端不断加剧之际。在印度国内,新闻通讯社 ANI 已在德里高等法院起诉 OpenAI,指控其未经授权使用 ANI 的文章。该案促使法院审视 AI 训练本身是否构成“复制行为”,抑或属于“合理使用”(fair dealing)范畴。美国和欧洲的法院也正面临类似纠纷,创作者普遍指控科技公司基于未授权内容构建其 AI 模型。然而,并非所有人都认同印度政府提出的模式。代表谷歌、微软等科技企业的行业协会 Nasscom 提交了正式异议,主张印度应采纳更广泛的“文本与数据挖掘”(Text and Data Mining, TDM)例外条款,允许 AI 开发者在合法获取的前提下使用受版权保护内容进行训练。Nasscom 警告称,强制许可制度可能抑制创新,并建议应允许持异议的权利人选择退出(opt-out),而非强制企业为所有训练数据付费。代表 Adobe、亚马逊云服务(AWS)、微软等全球科技企业的商业软件联盟(BSA)也敦促印度政府避免采用纯许可制。BSA 呼吁印度引入明确的 TDM 例外条款,指出“仅依赖直接许可或法定许可来规范 AI 训练数据可能不切实际,且未必能产生最佳结果”。BSA 进一步警告,若将 AI 模型训练限制于规模较小的已授权或公共领域数据集,可能导致模型性能下降,并“增加输出结果仅仅反映有限训练数据中趋势与偏见的风险”。相比之下,清晰的 TDM 例外条款更能兼顾技术创新与权利人利益。对此,印度政府委员会表示,其未采纳“广泛 TDM 例外 + 选择退出”模式,理由是此类机制要么削弱版权保护,要么难以有效执行。取而代之的是,委员会提出一种“混合模式”:AI 公司可自动访问所有合法公开的受版权保护作品,但必须向中央集体管理机构缴纳版税,再由该机构将收益分配给创作者。目前,印度政府已就该提案启动公众咨询程序,给予企业和相关利益方 30 天时间提交意见。委员会将在汇总反馈后形成最终建议,再提交政府审议。截至IT之家发稿,OpenAI 和谷歌均未回应置评请求。 -
微软宣布未来四年将在印度投资175亿美元,布局AI与云计算业务 IT之家 12 月 10 日消息,微软计划未来四年在印度投资 175 亿美元(IT之家注:现汇率约合 1238.64 亿元人民币),扩大其在该南亚国家的人工智能(AI)与云计算业务布局。印度庞大的互联网用户和智能手机用户群体,正使其成为全球科技公司竞相争夺的关键市场。 这项于当地时间周二宣布的投资是微软在亚洲有史以来规模最大的一笔投资,将用于 2026 至 2029 年间新建数据中心、部署 AI 基础设施,并开展数字技能培训项目。此举是在今年 1 月微软已承诺向印度投资 30 亿美元的基础上进一步加码。微软的这一举措正值美国主要科技公司加速在全球范围内投资数据中心和 AI 算力之际。凭借快速增长的开发者群体以及全球规模最大的互联网和智能手机用户池之一,印度正迅速成为战略要地。此次加码也对谷歌、亚马逊和 OpenAI 等竞争对手构成压力,这些公司正积极扩大在印业务,以满足当地企业、初创公司及政府机构对云服务和 AI 工具日益增长的需求。此外,该投资与印度政府推动各行业加速数字基础设施建设和 AI 应用的战略高度契合。印度正致力于打造全球科技中心,同时也在着力解决数据治理与公平获取技术资源等问题。这一消息是在微软首席执行官萨提亚・纳德拉访问印度期间宣布的,周二,他与印度总理纳伦德拉・莫迪(Narendra Modi)举行了会晤,并将于周三在新德里发表主题演讲。微软公司还宣布,将于 2026 年中在海得拉巴启用新的数据中心区域,这将是其在印度规模最大的数据中心区域,包含三个可用区,占地面积约相当于两个加尔各答伊甸园体育场(Eden Gardens)。微软表示,将继续扩展其在钦奈、海得拉巴和浦那现有的三个数据中心区域。作为此次战略推进的一部分,微软还将与印度劳工与就业部合作,将其先进的 AI 能力整合进两个国家级数字公共平台 ——“e-Shram”(非正规部门工人登记平台)和“国家职业服务平台”(National Career Service),为超过 3.1 亿非正规就业者提供 AI 驱动的服务。微软表示,这两个政府平台将采用 Azure OpenAI 服务,提供多语言访问、AI 辅助职位匹配、技能与市场需求趋势的预测分析、自动化简历生成以及个性化职业发展路径等功能。此外,微软还宣布面向印度客户推出全新的主权云(Sovereign Cloud)解决方案,包括现已在其印度各区域上线的“主权公有云”(Sovereign Public Cloud),以及基于 Azure Local 构建、支持联网与完全隔离(air-gapped)运行模式的“主权私有云”(Sovereign Private Cloud)。公司指出,这些方案将帮助企业在满足监管合规与数据本地化要求的同时,运行高性能工作负载,并获得最新的英伟达 GPU 和 Microsoft 365 服务支持。在人才培养方面,微软也在加速推进。公司透露,自今年 1 月启动“ADVANTA (I)GE India”倡议以来,已培训 560 万人,远超其原定到 2030 年培训 1000 万人的目标;其中已有超过 12.5 万人通过相关项目成功就业或创业。如今,微软将目标翻倍,计划到 2030 年为 2000 万印度人提供基础 AI 技能培训,并将联合政府机构、产业伙伴及数字公共平台,扩大培训覆盖面。微软此次投资承诺距谷歌宣布 150 亿美元在印建设 AI 枢纽和数据中心基础设施的计划仅数月之隔,这也是谷歌在印度历史上最大规模的投资,此前该公司曾在 2020 年承诺投入 100 亿美元。近几个月来,随着全球科技公司寻求拓展 AI 版图,印度因其庞大的互联网用户基数、数亿智能手机用户、快速成长的初创生态以及政府雄心勃勃的数字化议程,正成为极具吸引力的市场。上述因素共同催生了巨大的消费规模和企业级需求。今年以来,这一趋势明显加速:OpenAI 和 Anthropic 相继在印度设立办公室;谷歌和 Perplexity 则分别与印度电信巨头信实 Jio(Reliance Jio)和巴帝电信(Bharti Airtel)达成合作,以深化市场渗透。然而,尽管全球科技巨头纷纷加大投入,超大规模数据中心运营商(hyperscalers)在印度仍将面临显著挑战:部分地区电力供应不稳定、能源成本高昂以及水资源短缺等因素,可能延缓 AI 基础设施的建设进度,并推高云服务商的运营成本。尽管如此,印度政府正积极推动吸引更多大型科技投资,将大规模数据中心和 AI 项目视为实现其经济与数字公共基础设施雄心的核心支柱。面对现实制约,新德里已出台针对 AI 和半导体项目的激励政策,简化部分监管流程,并鼓励跨国企业与本土电信及 IT 公司建立合作关系,以将更多全球 AI 价值链环节锚定在印度。微软印度及南亚区总裁普内特・钱多克(Puneet Chandok)在一份声明中表示:“微软扎根印度已逾三十载。当这个国家坚定迈向‘AI 优先’的未来时,我们很自豪能作为值得信赖的合作伙伴,共同推进基础设施建设、激发创新活力、创造发展机遇,助力十亿人的梦想。”目前,微软在班加罗尔、海得拉巴、浦那、古尔冈、诺伊达等城市雇用员工逾 2.2 万人,其中包括多个工程团队,负责开发面向全球市场的 AI 产品,如 Copilot Studio、Azure AI 搜索、AI 智能体、语音与翻译工具以及 Azure 机器学习平台,同时也支撑公司在印度的本地业务运营。 -
抖音副总裁李亮:AI手机助手本质是机主授权 与入侵、黑客、隐私无关 快科技12月9日消息,"豆包手机"因为深度内嵌系统,在用户同意后,可以自动进行各种操作,比如直接下单外卖等等。因权限过高带来一些隐患,很多主流App开始禁用"豆包手机",比如微信、银行App、阿里系App都已经禁止登录,最新测试是美团也已经封禁。抖音副总裁李亮发文表示,AI手机助手本质上是"机主"授权"助手"完成了这一切,与什么所谓入侵、黑客、隐私都没有关系。 原文如下:机主:"XX手机助手,请帮我叫辆车到机场"助手:"好的,车辆大约20分钟到达你住处"机主:"大约多久可以到机场?"助手:"目前早高峰,有点堵车,需要60分钟;走高速可以节省20分钟"机主:"那就请走高速吧,用车和高速费用是多少"助手:"用车费用120元,高速费10元"机主:"请替我直接支付用车和高速费用"助手:"好的,这需要你自己登入付款"这种以前在影视作品中看到的场景,从技术上已经可以实现了。整个过程"机主"可以通过"助手"丝滑完成,但其中需要调用地理位置、打车软件、地图导航、路况信息、支付等多个APP及数据,本质上是"机主"授权"助手"完成了这一切,与什么所谓入侵、黑客、隐私都没有关系。而这只是AI数以万计的应用中最普通的场景之一,距离实现这一切的路已经很近了,但又困难重重。但无论如何,这些终将都会实现。 -
报道称谷歌明年在Gemini上推出广告服务,谷歌否认 谷歌AI聊天机器人Gemini能否成为新的广告投放平台,目前正陷入一场“罗生门”。广告行业买家与科技公司高管的公开表态出现矛盾,凸显出AI货币化路径的不确定性以及市场对这一新兴广告场景的高度关注。周二,据AdWeek报道,谷歌近日在与广告客户的沟通中透露,计划于2026年在其AI聊天机器人Gemini中引入广告投放。至少两家广告代理商的买家确认,谷歌代表在独立通话中提及了这一时间表,但具体的广告格式、定价和测试细节尚不明确。谷歌全球广告副总裁Dan Taylor随即在社交媒体平台X上公开否认这一报道。他表示:"这篇报道基于不知情的匿名消息源,他们提出了不准确的说法。Gemini应用中没有广告,目前也没有改变这一现状的计划。"这一矛盾表态引发市场关注,广告商正密切关注AI助手内部的货币化机会,许多人将其视为下一个重要的广告前沿阵地。广告客户获悉2026年投放计划据熟悉相关对话的广告代理商买家透露,谷歌在最近几天的通话中告知广告客户,Gemini的广告投放目标为2026年推出。一位要求匿名的买家表示,该计划独立于今年3月推出的AI Mode中的广告投放。AI Mode是谷歌基于AI技术的搜索体验。两位买家均表示,谷歌未分享任何原型或关于广告如何在Gemini中呈现的技术细节。他们将这些对话描述为探索性质,技术细节较少。这是广告商首次直接从谷歌方面听到关于Gemini聊天机器人货币化的信息。谷歌高管公开驳斥报道Dan Taylor在X平台上直接回应称,AdWeek的报道基于"不知情的匿名消息源"的"不准确说法"。他明确表示Gemini应用中没有广告,且目前没有改变这一状况的计划。这一公开否认与广告买家的说法形成鲜明对比,凸显出谷歌在AI货币化策略上的谨慎态度,或是内部沟通与对外表态之间的差异。AI广告市场争夺升温广告行业对AI助手内部的广告投放机会保持高度关注。任何在高用户参与度的聊天机器人中增加付费广告位的举措,都可能重塑广告预算分配、改变用户行为,并创造出独立于搜索之外的新广告界面。关于AI聊天机器人应保持纯粹实用工具属性,还是发展成为新广告平台的争论正在升温。即便是关于Gemini中引入广告的早期传闻,已促使广告代理商开始制定相应计划。目前谷歌坚称Gemini仍保持无广告状态,但竞争对手已在测试从AI中获利的方式,广告商也渴望寻找新的广告投放场景。围绕Gemini广告的争论不会消失,变化的只是时间表。 -
刚演示过丝滑跑步,特斯拉机器人莫名倒地,姿势怪异 12月8日消息,在上周末美国迈阿密举办的一场演示活动中,特斯拉派出“擎天柱”Optimus人形机器人与参观者互动。在互动中,机器人尝试递送瓶装水,但由于动作过快,导致手中水瓶掉落,并且机器人失去平衡向后摔倒。 图:机器人在倒下过程中做出的特定手部动作,来源:红星资本局然而真正引发外界关注的并非摔倒本身,而是机器人在倒下过程中做出的特定手部动作,该动作与远程操作员在慌乱中摘下VR头显的动作极为相似。就在不久前,特斯拉CEO马斯克还曾激烈反驳外界关于Optimus演示依赖远程操控的说法,他特别强调一段 Optimus 表演功夫的最新演示“完全由AI驱动,非远程操控”。 目前,特斯拉机器人摔倒疑似“露馅”一词已冲上百度热搜,对于这一事件,特斯拉官方尚未做出回应。值得一提的是,马斯克相当重视特斯拉机器人的发展,曾多次在个人社交平台上转发有关“擎天柱”的最新动态。10月4日,马斯克在社交平台X上发布了一段该公司开发的人形机器人“擎天柱”学习中国功夫的视频。在该条视频评论区,有网友提问“擎天柱”是由远程操控还是人工智能(AI)驱动的。马斯克回应称,“AI,而非遥控操作”。12月3日,马斯克在社交平台X转发特斯拉擎天柱(Optimus)团队发布一段“擎天柱”人形机器人跑步的短视频。该团队配文称:刚在实验室刷新了个人纪录(PR,Personal Record),该话题还一度冲上国内热搜第一。 事实上,特斯拉机器人的发展于与马斯克“万亿薪酬计划”密不可分。11月6日,特斯拉股东投票批准了马斯克的10年期薪酬计划。根据该计划,马斯克未来有望获得近1万亿美元市值的特斯拉股票作为酬劳。薪酬方案通过时,马斯克在欢呼中走上舞台,与机器人一起跳舞。他说,特斯拉未来不仅要开启新篇章,还要开启一本“全新的书”。据了解,这项薪酬计划为特斯拉未来发展制定了颇具挑战性的阶段性目标。马斯克只有完成这些目标,才能获得数亿只特斯拉新发行股票作为薪酬。这些目标包括,实现100万辆自主驾驶的“机器出租车”的商业应用,以及特斯拉市值从目前的1.5万亿美元提升至8.5万亿美元等。届时,马斯克获得的股票市值将达1万亿美元。 图片来源:新华社(曾慧摄) 在当日晚的股东大会上,马斯克阐述了加快人形机器人“擎天柱”生产速度的愿景,明年其生产线就将建成投产。在财报会议上,马斯克描绘了一个“可持续富足”的世界。他预测,“擎天柱”机器人每年的生产力将是人类的5倍,因为它可以每周7天、每天24小时工作。马斯克说,一旦“擎天柱”实现批量生产,他希望这种机器人能以2万至3万美元的价格出售。编辑|许绍航 杜恒峰校对|金冥羽封面图片来源:视频截图(图文无关) 每日经济新闻综合自每经网、红星资本局、新华社及公开信息 -
福莱新材发布TPU:打造机器人“第三大脑”,破解具身智能核心痛点 11月27日,福莱新材(605488.SH)在上海正式推出第三代电子皮肤新品。此次发布会的核心焦点,是公司创新性提出的 “触觉智能TPU(Tactile Processing Unit)” 概念。这一概念将触觉系统提升至与CPU(逻辑大脑)、GPU(视觉之眼)并列的架构高度,被视为破解当前机器人“拿不稳、捏不准”难题的关键,或重演计算产业历史上的 “英伟达时刻”。产业的“高分低能”困局与历史的镜像当前人工智能呈现出一种显著反差:大模型智力超群,机器人运动能力卓越,“但是,当你让这个‘智商150、运动神经发达’的机器人,去厨房帮你洗一个沾满泡沫的盘子时,它瞬间变得有些低能了。” 这揭示了具身智能的核心痛点:巅峰的大脑,麻木的手。 每一次笨拙的抓取,都在消耗市场对机器人进入日常场景的信心。其根源在于,机器人“看懂”世界与“触摸”世界是两个维度的挑战。现有机器人虽具备强大的AI大脑和敏锐的机器视觉,但在指尖接触物理世界的瞬间,却近乎于“盲态”——无法感知软硬、摩擦力变化,无法预判物体滑脱。“现代机器人是精密的工业品,但还不是有真正感知能力的智能生命。”这一困境与GPU诞生前夜的计算机产业高度相似。当年,复杂的图形渲染让擅长串行逻辑的CPU不堪重负。英伟达革命性地将图形处理任务剥离,创造了专用的GPU,由此定义了CPU(脑)与GPU(眼)的分工架构。历史总是惊人的相似。今天的具身智能机器人,正站在当年的那个十字路口。 当机器人交互时,其皮肤会产生海量的高频复杂数据。若将这些原始数据全部上传至中央处理器,将导致算力崩溃或反应迟钝。因此,业界认为当前架构缺失了处理物理接触的专用单元。福莱新材提出的 “触觉智能TPU” ,正是对这一需求的回应。在此架构蓝图中,一个稳固的智能铁三角得以形成:CPU负责逻辑,GPU负责视觉,TPU则专司一切与物理世界的真实交互。“TPU不仅仅是一个传感器,它是一个包含感知、传输与边缘计算的完整智能系统。” 这一定位,被认为具有重新定义机器人交互架构的产业意义。触觉的不可替代性:从“知道”到“确信”的认知革命为何触觉如此关键?一个思想实验可清晰揭示:假设一个人运动能力和视觉完好,但双手完全失去触觉,那么从口袋取钥匙开门这样简单的任务都将变得极其困难。“这正是目前人形机器人面临的真实处境。”这背后是AI认知与物理世界之间巨大的“认知鸿沟”。大模型可以通过阅读知晓“海绵柔软多孔”,却从未真正“触摸”过海绵,无法理解手指陷入时微妙的包裹感。“ChatGPT是‘读万卷书’的智者,而触觉智能TPU,是让机器人成为‘行万里路’的行者。” 没有触觉,AI只能是悬浮云端的“缸中之脑”。从认知层面看,视觉是基于概率的预测,可能被材质伪装、光线所欺骗;而触觉提供的是Ground Truth(事实真相)。当机器人指尖接触物体,反作用力、剪切力、微震动带来的是关乎硬度、摩擦系数的确定信息。“视觉是‘预测’,触觉是‘确信’。” TPU的核心价值,正是为机器人提供对物理世界的关键‘确信’,使其从“猜世界”迈向“确信世界”的从容。生物学原理也佐证了这一架构的合理性。人类碰到烫水杯时,由脊髓反射弧在0.1秒内控制缩手,无需大脑思考。机器人同样需要一个独立的边缘处理单元。福莱触觉智能TPU的生态位,正是机器人的“末梢神经+脊髓中枢”——它在本地处理高频信号,实现毫秒级反射,仅将提炼后的高级认知上报中央大脑。“把逻辑交给CPU,把视觉交给GPU,把接触交给TPU”,被认为是符合进化规律的终极架构形态。“芯感一体”攻克三大技术山,定义触觉新标准概念落地面临严峻挑战。福莱新材的第三代产品,旨在通过“芯感一体”技术,跨越速度、认知、覆盖三座技术大山。第一,攻克速度之山:重构“反射弧”。 传统方案中,传感器信号传输至中央大脑的延迟是致命的。福莱的解决方案是将算力下沉至指尖,把处理芯片直接集成在传感器旁。这赋予了TPU边缘计算能力,使之成为“指尖脊髓”,能实现毫秒级极速反射。“让条件反射发生在指尖,而不是云端的服务器。”第二,跨越认知之山:翻译“物理语言”。 大模型无法理解原始电压信号。福莱TPU集成了物理引导机器学习算法,将电压值实时转化为机器人大脑能理解的物理属性:硬度、纹理、滑移状态。配合硬件上实现的 <0.1mm的空间分辨率,TPU输出的是直接的环境认知,而非杂乱数据。第三,突破覆盖之山:构建安全边界。 触觉不应只存在于指尖。福莱TPU实现了从指尖到身体的全域覆盖,为机器人穿上“有感觉的衣服”。这不仅为了灵巧抓取,更是为了人机共存的本质安全,为拥抱、碰撞等交互提供天然的安全缓冲。生态共建与商业化前景福莱新材正积极构建产业生态:在硬件端,与浙江清华柔性电子技术研究院共建实验室;在算法端,与通智人工智能科技等团队合作,推动触觉信号与AI大脑的深度融合。商业化进程同步提速。该公司的触觉技术方案在量产规模与经济性上具备优势,已获得全球头部人形机器人及灵巧手企业的认可,可提供完整的可量产化触觉解决方案。目前产品已收获多项批量订单,并在北美市场实现交付。“英伟达用GPU点亮了AI的眼睛,福莱要用TPU唤醒AI的身体。” 市场观察指出,随着福莱新材向智能传感平台转型,其触觉智能TPU概念及产品体系,不仅是一条清晰的增长曲线,更有望在具身智能的感知层占据核心位置,为机器人赋予一双灵巧、温暖、有感觉的手,推动智能从云端真正走向物理现实的触摸。 -
Oculus创始人拉奇为在战争中使用AI辩护 IT之家 12 月 8 日消息,安杜里尔(Anduril)公司联合创始人帕尔默・拉奇(Palmer Luckey)上周日为在战争中使用人工智能(AI)技术进行生死决策的做法进行了辩护。 包括安杜里尔在内的一批国防科技初创企业,正与传统国防承包商一道,开发用于全球冲突场景的自动化 AI 武器和相关工具。这一趋势引发部分人士的担忧,他们认为该技术尚未成熟到足以应用于如此高风险的环境。拉奇在接受福克斯新闻周日节目(Fox News Sunday)主持人香农・布里姆(Shannon Bream)采访时表示:“在涉及生死抉择的问题上,我认为这是一个道德上极其复杂、也极其关键的领域,因此无论采用何种技术,都必须应用你所能获得的最佳技术。”他称,“无论是 AI、量子计算,还是其他任何技术。如果你谈论的是致人伤亡的行动,就必须尽可能减少附带损害,并在所做的一切决策中力求最大程度的确信。”拉奇还强调,作战行动必须“尽可能高效”,“因此,在我看来,使用落后的技术并无道德高地可言 —— 即便这样做能让你宣称‘我们从未让机器人决定谁生谁死’。”安杜里尔工业公司成立于 2017 年,是一家专注于研发自动化系统的国防科技企业,其使命是通过各类先进技术 —— 包括监视设备、空中载具和自主武器系统,推动美军现代化。该公司的人工智能软件平台“Lattice”为其各项技术提供核心支撑。在创立安杜里尔之前,拉奇于 2012 年创办了虚拟现实公司 Oculus VR,并于两年后以 20 亿美元(IT之家注:现汇率约合 141.64 亿元人民币)的现金加股票交易将其出售给了 Facebook(现 Meta)。今年 2 月,安杜里尔宣布接手微软与美国陆军之间一项价值 220 亿美元(现汇率约合 1558.01 亿元人民币)的合同。该合作已于 4 月获得美国国防部批准,意味着安杜里尔如今负责管理“集成视觉增强系统”(Integrated Visual Augmentation System, IVAS)项目,该项目旨在为士兵开发融合先进增强现实(AR)与虚拟现实(VR)技术的可穿戴设备。今年 10 月,该公司发布了名为“鹰眼”(EagleEye)的新系统,据称该系统“将任务指挥与人工智能直接集成到作战人员的头盔中”。在“福克斯新闻周日”节目中,拉奇表示,他创办安杜里尔的初衷是“把人才从科技行业吸引出来,他们原本从事的问题在我看来并不那么重要,比如广告、社交媒体和娱乐,转而投身于国防和国家安全等真正重要的问题”。尖端技术正在深刻改变军队的运作方式,从行政事务到战场能力均受到影响。近年来,无人机已成为关键作战工具,助力新兴国防科技企业赢得政府合同与资金支持。在特朗普政府大力投资人工智能并表现出重启核武器试验兴趣的背景下,国防科技产业正蓬勃发展。拉奇今年 4 月曾表示,美国早已打开了“潘多拉魔盒”,在战争中使用 AI 已无回头路可走。“常有记者质问我:‘你不该打开潘多拉魔盒。’而我想告诉他们的是,这个魔盒早在反辐射导弹 —— 那种能自动搜寻地对空导弹发射装置的武器 —— 问世时就已经被打开了。”