每日科技资讯 | 2026-08-14

今日精选 15 篇科技资讯 — 2026-08-14

科技资讯总览

今日资讯涵盖多个高价值议题:AI 领域迎来 DeepSeek-V4-Pro、Gemini 3.7 Flash 等密集发布,同时 AI 在网络安全攻防两端的角色愈发凸显;安全方面,大规模供应链攻击与多项新防护技术同时成为焦点;中国科学家在高温超导与量子通信领域取得领跑级突破;基础设施侧则有 SQLite 十六年隐患被挖出等工程故事。以下是今日精选摘要。

🤖 AI 与机器学习

DeepSeek 正式发布 V4-Pro,Agent 能力全面升级

DeepSeek 今日官宣推出 V4-Pro 大模型,主打 Agent 场景的重大升级。新模型在灵活推理控制上做了细化:简单任务可用低推理模式,日常 Agent 工作流用高模式,复杂任务则支持最高强度的推理预算。同时原生支持 OpenAI Responses API,针对 Codex 做了开箱即用的优化,V4-Pro 已同步上架 App、Web 的“专家模式”与 API 接口。此前 DeepSeek 在开发者社区积累的高关注度,使得这次版本迭代被普遍视为对 OpenAI 与 Anthropic 新一代模型的有力回应,尤其是推理成本与 Agent 稳定性的平衡值得持续观察。

原文链接:https://x.com/deepseek_ai/status/2087864585504305397

Gemini 3.7 Flash 发布,瞄准编码与智能体开发

Google DeepMind 宣布推出 Gemini 3.7 Flash,定位在编码、知识工作与 Web 开发场景的强化升级。虽然官方尚未公布完整能力基线,但从该系列一贯的定位来看,3.7 Flash 继续以低延迟和性价比为核心卖点,面向高频调用场景。业内普遍认为,随着 GPT-5.x、DeepSeek V4 同步发力,轻量级模型赛道已然进入“既要跑得快、又要答得准”的深水区,开发者可重点关注其在真实项目中的代码生成连贯性与多步骤工具调用表现。

原文链接:https://x.com/GoogleDeepMind/status/2087948366294515977

Meta 开源 Muse Glimmer,30B 多模态模型主打本地 Agent 场景

Meta 再次入局开源多模态赛道,发布 Muse Glimmer,一个面向本地化、智能体化使用场景的 30B 参数模型。Hugging Face 已提供 Day-0 支持,社区开发者迅速开源了多个交互 Demo。最亮眼的尝试是给 Glimmer 配上工具,让它完成自己对自己的量化压缩。这类“模型自我优化”的玩法既直观展示了指令跟随能力,也侧面印证了 Meta 对端侧和私有化部署场景的野心。相较于庞大的指令模型,30B 这一规模配合量化技术,有望成为中小团队落地多模态 Agent 的低成本选择。

原文链接:https://x.com/ben_burtenshaw/status/2086758382241763824

从零在浏览器里跑 DeepSeek-R1:WebGPU + Transformer.js 全链路实战

掘金热榜出现一篇硬核教程,作者详细拆解了如何借助 WebGPU 与 Transformer.js 在浏览器本地完整运行 DeepSeek-R1 模型。文章从源码层面梳理了 WebGPU 算子适配、显存管理与 Transformer.js 推理管线,并提供了可直接上手的实践路径。这类“前端跑大模型”的技术方案对于隐私敏感场景(如本地文档分析、离线助手)有显著价值,也让浏览器作为 AI 推理容器的可行性得到进一步验证。

原文链接:https://juejin.cn/post/7671475529255321610

Meta 发布 Muse Glimmer 开源模型,面向本地 Agent 工作流优化

Meta 正式推出 Muse Glimmer,一款专注于本地始终在线 Agent 工作流的开源权重模型。其参数量为 300 亿,在关键 Agent 任务与基准测试中表现优于同尺寸竞品,且设计目标是完全在消费级硬件(如 Mac 或高性能 GPU 的 PC)上运行。模型权重采用宽松的 Apache 2.0 许可发布,延续了 Meta 开放基础 AI 研究的传统。在云端推理成本与隐私顾虑日益上升的当下,本地化 Agent 模型是降低部署门槛的重要方向。

原文链接:https://x.com/AIatMeta/status/2086757844544811485

Claude 未解黎曼猜想,但将零点下界从 41.6% 提升至 67.2%

Anthropic 透露,其未发布的研究版 Claude 尝试冲击黎曼猜想,虽未给出最终证明,却在相关问题上取得了可观进展:将黎曼 zeta 函数满足假设的零点占比下限从 41.6% 提高到了 67.2%。这虽然不是终点,却展示了 AI 在深层数学推理中的潜力——不仅是验证已有结论,还能在人类尚未走通的方向上提出有价值的中间成果。此类尝试预示 AI 将越来越多地作为”数学研究伙伴”而非简单计算工具进入前沿科学。

原文链接:https://x.com/AnthropicAI/status/2086867246073401655

阿里首次开源 Max 级模型:Qwen3.8-2.4T-A95B,原生 256K 上下文

阿里 Qwen 团队在魔搭 ModelScope 社区正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次开源。模型总参数达 2.4T,每个 Token 激活 95B 参数,原生支持 262,144 Token 上下文并可扩展至 1,010,000。Qwen3.8 延续混合架构,重点提升编程、办公、科研和长周期 Agent 任务的端到端能力。官方评测显示其在 PaperBench、IFBench 等基准中取得较高分数,与 Opus 4.8、Fable 5、GPT 5.6 Sol 等模型互有高低。对于希望在私有环境部署超大规模 MoE 模型的研究机构与企业而言,这是一个极为关键的选项。

原文链接:https://www.ithome.com/0/989/001.htm

机器人基础模型 DYNA-2 发布:100 万小时人类视频训练,任务成功率可达 90%

具身智能公司 Dyna Robotics 发布机器人基础模型 DYNA-2,其预训练完全基于超过 100 万小时第一人称人类视频,相当于约 170 年人类经验。该模型被定义为”世界动作模型”,通过同时预测下一帧视频画面和应执行的动作,学习空间关系、运动方式与物体接触后的物理响应。相比依赖人工遥操作数据,这种”观察人类即学习”的策略显著降低了数据采集成本,官方数据显示其任务成功率最高可达 90%。

原文链接:https://www.ithome.com/0/989/200.htm

OpenAI 预览 GPT-5.6 Sol 超快模式,API 先行开放

OpenAI 通过 X 平台预告了 GPT-5.6 Sol 的 Ultrafast 模式,宣称推理速度最高可达此前的 14 倍。该模式将率先面向精选 API 客户开放,随着算力扩容逐步向更多企业用户推广。这标志着大模型竞争从参数规模转向响应速度与服务密度,尤其对实时交互场景和 Agent 工作流意义重大——更快的推理意味着更复杂的多步任务可以在用户可接受的延迟内完成。对依赖 API 构建应用的开发者而言,这可能是下半年最值得关注的能力升级之一。

原文链接:https://x.com/OpenAI/status/2087947721936359705

谷歌发布 Gemini 3.7 Flash,编码与网页开发能力显著增强

Google DeepMind 正式推出 Gemini 3.7 Flash,在调试、问题解决等关键编码任务上相较 3.6 Flash 提升明显,同时能用更少的提示词设计出功能性更强的网页布局和应用程序,并在真实业务工作流中展现出更优的推理与准确性。该模型已在 Antigravity、Google AI Studio 和 Android Studio 中提供 API 接入,Google AI Pro 和 Ultra 订阅用户可通过 Gemini 应用中的 Spark 界面使用。此次迭代聚焦开发者的日常痛点,意图在 AI 编程助手赛道对 GitHub Copilot 和 Claude 形成更直接的竞争压力。

原文链接:https://x.com/GoogleDeepMind/status/2087948368957894859

外媒爆料:哈萨比斯曾欲离开 Alphabet,最终转任董事长留任

据 Pathfounders 报道,2024 年诺贝尔化学奖得主、Google DeepMind 前 CEO Demis Hassabis 在 Alphabet 近期高管大变动前曾有意离开公司。消息人士透露,哈萨比斯本想与原 Alphabet 首席科学家 Jeff Dean 同步离职,但 Alphabet 认为短时间内失去两位 AI 业务领袖将导致股价崩盘,最终说服他转任 DeepMind 董事长兼 Alphabet 首席科学家。这一安排使哈萨比斯能将更多精力投入 Isomorphic Labs 等 AI 科学探索项目,同时也为未来可能的离开铺设了平缓的过渡路径。Jeff Dean 已与多位同事出走创立 Discovery Loop。这次人事调整折射出顶级 AI 人才与科技巨头之间微妙的权力博弈。

原文链接:https://www.ithome.com/0/987/775.htm

Meta 演示 Muse Glimmer:一句提示词完成整套智能体任务

Meta 展示了其 Muse Glimmer 模型的新能力——仅凭一条自然语言提示,就能端到端完成多步骤 Agent 任务。演示中,模型自主通过网络工具调用发现本地 Home Assistant 实例,查询设备 API,从零编写响应式 HTML/CSS/JS 仪表盘,并部署本地服务器进行验证。这意味着大模型已从“对话生成”迈向“自主执行复杂工作流”,对智能家居控制、自动化运维等场景的落地具有示范意义。虽然仍是演示阶段,但端到端的自主性展示了 Agent 产品的可行形态。

原文链接:https://x.com/AIatMeta/status/2086757849217257760

实践分享:如何用 LLM 高效学习复杂知识

一篇来自 Hacker News 热榜的实践文章引发广泛共鸣(505 分,286 条评论)。作者系统梳理了将 LLM 作为学习伙伴的方法论:不是简单提问寻求答案,而是通过苏格拉底式追问、概念类比、错题诊断等方式,让模型帮助自己建立知识框架并填补盲区。文章强调,LLM 最适合充当“永不厌烦的导师”,帮助学习者主动构建理解,而非被动接收信息。在信息过载时代,这套方法为知识工作者提供了可复用的学习范式。

原文链接:https://laurentiugabriel.github.io/blog/articles/how-i-use-llms-to-learn/

手语翻译首次进入消费级:谷歌 DeepMind 推出手语转文本模型

谷歌 DeepMind 于 8 月 12 日宣布推出一款大规模多语言手语转文本(SL2T)模型,这是手语 AI 首次真正落地到消费级产品。Pixel 11 系列智能手机上的 Gboard 和 Live Transcribe 现将支持手语转文本输入,初期面向美国手语,后续将扩展至更多手语和设备。全球约 7000 万听力障碍人士使用 200 余种手语,手语的语法和词汇与口语完全不同,这意味着 SL2T 需要真正的机器翻译能力,而非简单的手势到文字的序列映射。DeepMind 用超过 50 种手语、10 万小时的数据训练模型,并通过将手语转化为姿势特征点来保护用户隐私,原始视频流无需上传服务器。这一产品的突破性在于:手语交流首次获得了类似语音输入的“打字替代”体验,且经测试,使用美式手语比英文打字更快、更自然。不过目前 Google 尚未开源模型或提供完整技术细节,其多语言扩展能力还有待验证。

原文链接:https://www.ithome.com/0/989/105.htm

AI Agent 进军材料科学:Discovered Materials 为半导体行业发现新材料

YC 孵化的新创公司 Discovered Materials 推出用于新材料发现的 AI Agent。联合创始人 Advaith 和 Akash 在 HN 上介绍,该项目瞄准半导体行业的一个核心痛点:功耗失控。GPU 的散热问题正以惊人的速度恶化——Nvidia H100(2022 年)TDP 为 700W,Blackwell(2024 年)达 1.2kW,而 Rubin(2026 年)预计将达到 2.3kW。传统材料研发周期漫长,难以跟上芯片迭代节奏。该公司用 AI Agent 自动化材料筛选与发现流程,试图在新材料层面找到散热问题的解。这是 AI for Science 在硬科技领域的一次直接应用,方向具有很高产业价值,但目前尚未披露具体的材料发现成果,其科学有效性仍需论文或实际产品验证。

原文链接:https://discoveredmaterials.com/research/

今日焦点: AI 正在迅速从“通用对话助手”进化到“垂直领域行动者”——从材料发现、手语翻译到糖尿病智能诊疗,真正的突破在于模型能否在真实世界的复杂约束下解决具体问题;与此同时,安全攻防与科学发现的提速,正在为这一进程不断设定新的边界与可能性。

热点文章池

  1. github_trending huggingface/transformers
  2. ars_technica Terabytes of credentials leaked in massive supply-chain attack
  3. ithome 证实高温超导的二维本质,复旦大学首次制备单铜氧层高温超导体
  4. techcrunch Anthropic is turning Claude Code’s auto mode on by default
  5. juejin 实战从零开始构建一个Coding Agent:Violin |得物技术
  6. hackernews Muse Glimmer: 30B-parameter model optimized for always-on local agent workflows
  7. hackernews Exploiting System Management Mode with a very long interrupt
  8. ars_technica A researcher bought noreply.net. Companies started sending him secrets.
  9. x We’re expanding our cybersecurity initiative Daybreak and introducing GPT-5.6-Cyber, a new model for advanced,...
  10. x Meta is back with Muse Glimmer
  11. techcrunch As AI-led attacks multiply, OpenAI launches a new cyber model
  12. ithome 我国科学家研制出 455Wh/kg 高能量密度水系锌碘软包电池,800 圈稳定循环
  13. ithome 未公开的新模型“立功”,Anthropic 宣布 Claude 攻克黎曼猜想取得重大突破
  14. ars_technica New Pass-ta-key attack reveals all the things we didn't know about passkeys
  15. hackernews DeepSeek V4 Pro 0813
  16. hackernews Tailscale Traces Database Corruption to 16y/o SQLite WAL-Reset Bug
  17. hackernews Show HN: Woxi - Open-source Mathematica / Wolfram Language reimplementation
  18. github_trending smicallef/spiderfoot
  19. ars_technica Have physicists finally discovered glueballs? New evidence points to yes.
  20. ars_technica Chrome adopts what may be the best protection yet against account takeovers
  21. techcrunch After Microsoft threatened legal action, a security researcher publishes a new Windows zero-day bug
  22. juejin 从零在浏览器里跑 DeepSeek-R1:WebGPU + Transformer.js 全链路实战
  23. ithome 我国科学家将量子存储器间纠缠距离提升至 420 公里
  24. devto The Mechanical vs. The Semantic: What Happens When AI Memory is Wrong?
  25. x We’re launching DeepSeek-V4-Pro today
  26. x Gemini 3.7 Flash is here. It’s stronger for coding, knowledge work, and web development
  27. github_trending infiniflow/ragflow
  28. hackernews How We Pushed CDC into Postgres
  29. hackernews OpenChamber: An Agentic Development Environment
  30. devto From Threat Model to Framework: Closing the Real Gaps in Agent Skill Security
  31. techcrunch The AI safety test is becoming a safety risk
  32. devto Everything Was Working. AWS Wanted $1,665/Month More.
  33. ithome 通用百万比特光量子计算迎来可行路径,合肥硅臻芯片等发布片上 MBQC 技术突破
  34. juejin Agent Skills 完全指南:从目录规范到渐进式加载的工程实践
  35. x Introducing Muse Glimmer, an open-weight 30B-parameter model optimized for local, always-on agent workflows
  36. hackernews Show HN: Needle2: 14MB agentic LLM for phones, wearables, smart home and robots
  37. hackernews Tl;dv: Over 180k meetings left wide open
  38. github_trending ruvnet/RuView
  39. github_trending firecrawl/firecrawl
  40. devto Self-hosting a lite agent backend on one TPU: Gemma 4 E2B + vLLM on a v5e-1
  41. techcrunch A data breach at shipping giant Ceva Logistics is rippling across banks, retailers, Steam gamers, and beyond
  42. x We've used GPT-5.6-Cyber extensively in real-world vulnerability research, including work that uncovered previously...
  43. x We asked an unreleased research version of Claude to take a stab at the Riemann hypothesis
  44. hackernews Antirez/h3.c: MiniMax H3 inference engine for Mac computers
  45. x Today we're also opening the weights for Muse Glimmer, a great 30B parameter dense model that can run locally
  46. hackernews LFM2.5 2.6B model competitive with 4x larger models
  47. github_trending stablyai/orca
  48. juejin 不用LangChain:用 200 行代码手搓 Agent 对话记忆与上下文压缩
  49. ithome 我国科研团队突破量子网络规模化部署难题,实现百用户级 MDI 量子网络验证
  50. hackernews How to organize Claude Code for product work
  51. hackernews Qwen3.8-2.4T
  52. hackernews Grok 4.6
  53. hackernews AI is removing the middle class of software engineering?
  54. github_trending Lightricks/LTX-2
  55. ars_technica Researchers found a way to hijack devices through Zoom screen sharing
  56. devto Pi Agent vs Claude Code After 100 Hours of Real Use 🔥
  57. ithome 阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文
  58. ithome 2026 最大规模 AI 供应链泄露:40 分钟搜刮英伟达等全球约 2500 家共 195TB 数据
  59. ithome 6000+ 条评论 AI 编程智能体真实安全事故洞察:Cursor 问题最多
  60. ithome 科学家发现 200 万个活跃黑洞、爆发恒星等高能天体,人类已知 X 射线源数量翻倍
  61. ithome 机器人 AI 模型 DYNA-2 登场:超 100 万小时人类视频训练,任务成功率可达 90%
  62. hackernews Codex in ChatGPT desktop app for Linux is now in preview
  63. techcrunch In a first, US will allow some private firms to carry out cyberattacks
  64. x Previewing Ultrafast mode
  65. x 🔵 It shows strong gains over 3.6 Flash in key coding tasks like debugging and issue resolution
  66. hackernews Single log line is 49KB+ (ext4) / 110KB+ (btrfs) of systemd-journald disk writes
  67. hackernews How I use LLMs to learn complex topics
  68. github_trending cactus-compute/needle
  69. hackernews Show HN: A Project Oberon System version running on RISC-V instead of RISC-5
  70. techcrunch This ‘adversarial’ pattern can prevent surveillance cameras from detecting you
  71. juejin AI 测试提效 | 别搞万能 Skill,推荐用 5 个 Agent Skill 串起 UI 自动化全流程
  72. ithome 曝诺奖得主哈萨比斯曾有意离开谷歌母公司 Alphabet
  73. hackernews Auto mode is now the default in Claude Code
  74. ithome Linux 内核曝出 18 年历史漏洞 SCTPhantom:存在于 SCTP 网络通信功能中、可提权控制宿主机
  75. ithome 数十亿美元机器人公司,为何都盯上了叠衣服
  76. ithome CIS 最大 AI 工厂亚美尼亚投运,建设方 Firebird 获 NVIDIA 投资
  77. ithome 室温可用:SAXON Q 宣布 128 / 512 量子比特计算机开启预定
  78. hackernews Tail-Call Interpreters in Rust – Jimmy Ostler
  79. x Muse Glimmer can complete multi-step agentic tasks end-to-end from a single natural language prompt
  80. hackernews Sonic Pi v5