Daily Report · 数据库生成
Kimi K3 与 Qwen 3.8 竞相发布,开源模型直追闭源前沿;WAIC 2026 物理 AI 与国产算力成焦点
2026年7月19日,全球大模型与AI算力基建领域迎来多项突破。中国AI创企月之暗面发布新一代模型 Kimi K3,在前端代码和 DeepSWE 软件工程测试中展现出比肩闭源前沿模型的强劲实力与超高性价比,引发西方关于开源模型及“数字公共基础设施”的热议;阿里云紧随其后推出2.4万亿参数的多模态大模型 Qwen 3.8。同时,在上海举办的2026世界人工智能大会(WAIC)上,物理AI、国产超节点互联方案及太空算力星座等前沿技术成果集中亮相。此外,Netflix 巨资收购 AI 电影制作初创公司、YouTube 大力清洗 AI 生成的垃圾视频,以及英国法律界对专业人士不使用 AI 可能构成失职的认定,均标志着 AI 正在以更深的渗透力重构行业生态与规则边界。
执行摘要
2026年7月19日,全球大模型与AI算力基建领域迎来多项突破。中国AI创企月之暗面发布新一代模型 Kimi K3,在前端代码和 DeepSWE 软件工程测试中展现出比肩闭源前沿模型的强劲实力与超高性价比,引发西方关于开源模型及“数字公共基础设施”的热议;阿里云紧随其后推出2.4万亿参数的多模态大模型 Qwen 3.8。同时,在上海举办的2026世界人工智能大会(WAIC)上,物理AI、国产超节点互联方案及太空算力星座等前沿技术成果集中亮相。此外,Netflix 巨资收购 AI 电影制作初创公司、YouTube 大力清洗 AI 生成的垃圾视频,以及英国法律界对专业人士不使用 AI 可能构成失职的认定,均标志着 AI 正在以更深的渗透力重构行业生态与规则边界。
8 个关键信号
Kimi K3 代码评测表现抢眼
Kimi K3登顶前端代码榜,但前沿数学准确率仅为39%
阿里发布 Qwen 3.8 万亿模型
阿里推出2.4万亿参数Qwen 3.8,性能号称仅次于Fable 5
Netflix 收购 Ben Affleck AI 公司
Netflix斥资5.87亿美元,收购本·阿弗莱克的AI电影初创公司
不使用 AI 律师或被起诉
英国司法工作组表示,律师或因未能使用AI而面临失职起诉
YouTube 铁腕清理 AI 垃圾视频
YouTube启用S-CTS系统,半年内封禁5万个AI垃圾频道集群
MLB 限制替补席使用 iPad
MLB限制在替补席使用iPad,防球队利用AI进行实时战术决策
上下文轰炸技术对抗 AI 黑客
Tracebit提出“上下文轰炸”防御技术,可防AI黑客智能体攻击
中国关停未成年 AI 伴侣功能
中国加强未成年虚拟伴侣监管,腾讯阿里等关停相关AI伴侣功能
模型
Alibaba's Qwen takes on Kimi K3 with open-weight Qwen 3.8, says model is "second only to Fable 5"
阿里推出了最新开源权重模型 Qwen 3.8,拥有 2.4 万亿参数。该模型是 Qwen 团队首个规模超万亿参数的多模态模型,能够处理图像、视频和文档。官方表示其性能仅次于 Fable 5,在编程、全栈开发及数据分析等复杂生产力任务中超越了 Qwen 3.7-Max。目前该模型已在阿里 Token Plan、Qoder 和 QoderWork 开启预览(价格为标准价的 10%),开源权重也将于近期发布。此举被认为旨在与月之暗面的 Kimi K3 展开竞争。
The Decoder · 阅读原文Qwen 3.8 Max
Hacker News 上出现了指向 Qwen 官网的链接分享,标题为“Qwen 3.8 Max”,暗示阿里可能发布或准备发布 Qwen 3.8 Max 模型。
Hacker News AI · 阅读原文Google Deepmind argues video generators already contain the world models computer vision has been missing
Google DeepMind 提出了一种名为 GenCeption 的新方法,该方法将预训练的视频生成模型(基于阿里巴巴开源的 Wan2.1)重新用于深度估计、图像分割和 3D 姿态估计等传统计算机视觉任务。通过将各种输出表示为标准的三通道 RGB 图像,GenCeption 能够仅用一次前向传播完成多项感知任务。尽管主要在仅包含 7500 个合成视频的少量数据集上进行训练,GenCeption 在多项基准测试中的表现依然比肩或超越了 DepthAnything 3 和 SAM 3 等专用模型,所使用的训练数据仅为后者的几分之一到几百分之一。该研究表明,视频生成模型在训练过程中已经隐式学习到了空间几何与运动等有用的“世界模型”特征,有望成为通用视觉基础模型的新途径。
The Decoder · 阅读原文Qwen3.8 is launching and going open-weight soon!🌐 With a massive 2.4T parameters, this model is continuously evolving. We believe it’s one of the ...
阿里云宣布即将推出并开源拥有 2.4 万亿(2.4T)参数的 Qwen3.8 模型。官方表示该模型性能强大,仅次于 Fable 5。目前,Qwen3.8-Max-Preview 预览版已在阿里云的 Token Plan、Qoder 和 QoderWork 上线,用户可抢先体验。
X:阿里云 / Alibaba Cloud (@alibaba_cloud) · 阅读原文Moonshot's Kimi K3 outperforms Fable 5 in frontend code but lags far behind in complex math
月之暗面(Moonshot)的 AI 模型 Kimi K3 在前端代码评测基准 Code Arena: Frontend 中以 1679 分登顶,超越了 Claude Fable 5(1631分)和 GPT-5.6 Sol(1618分),成为首个在该基准上夺冠的中国模型。但在 Epoch AI 的顶级数学基准 FrontierMath Tier 4 测试中,Kimi K3 的准确率仅为约 39%,远落后于 OpenAI 和 Anthropic 接近 90% 的得分表现。
The Decoder · 阅读原文真的吗?除了fable 5 以外最强大的模型? 据说DeepSeek v4 正式版也很牛,下周热闹了。
社交媒体有传言称,除 Fable 5 外,DeepSeek v4 正式版也将于下周发布,被称为“除了 Fable 5 以外最强大的模型”。
X:Vista (@vista8) · 阅读原文For every $100 spent, Kimi completes 14.7 tasks versus Fable’s 5.3, giving you 2.8x more work per dollar. on software engineering/DeepSWE tasks.
根据测试数据,在软件工程与DeepSWE任务中,Kimi表现出极高的性价比。每投入100美元,Kimi能完成14.7个任务,而Fable仅能完成5.3个,即Kimi的单位美元工作量是Fable的2.8倍。具体而言,Kimi的单次运行(rollout)成本为4.65美元,中位数耗时为66分钟;而Fable的单次运行成本为13.41美元,中位数耗时为21分钟。
X:Rohan Paul (@rohanpaul_ai) · 阅读原文腾讯发布三大具身基座模型,打通“感知—行动”闭环,工业实测成功率超95%
InfoQ 中文 · 阅读原文AI chatbots reading X-rays can be dangerously confident even when they're wrong
The RadLE 2.0 benchmark tests whether AI models in radiology can tell when they should leave a diagnosis to a human. Many models deliver wrong findings with full confidence, and human radiologists are still well ahead. Before AI can diagnose on its own, it needs to learn when it's better to say nothing. The article AI chatbots reading X-rays can be dangerously confident even when they're wrong appeared first on The Decoder.
The Decoder · 阅读原文No, an AI cannot know the future and never will..
“A butterfly flaps its wings… the resulting air movement creates a chain of disruptions. This disruption propagates across the ocean, eventually feeding into a massive, swirling hurricane.”“A butterfly flaps its wings… the resulting air mov
Hacker News AI · 阅读原文Interestingly, when I made a request in Chinese for Kimi K3 to pick two non-cliched poems that apply to LLMs, 95.5% of the characters (88% of the word...
沃顿商学院教授 Ethan Mollick 分享了一项发现:当使用中文向 Kimi K3 提问,要求其为大模型挑选两首不落俗套的诗歌时,尽管模型明确是在为中文读者考虑中文诗歌,但其思维链(Chain-of-Thought)中 95.5% 的字符(88% 的单词)都是英文。这展示了模型在进行内部推理时对英文的偏好。
X:Ethan Mollick (@emollick) · 阅读原文Now Kimi K3 ranks #3 on DeepSWE, head to head with Claude Fable & GPT-5.6 Sol. But its about the size of the jump. Kimi moved from 31 points with K2.7...
Kimi K3 在软件工程智能体基准测试 DeepSWE 中升至第三名,与 Claude Fable 和 GPT-5.6 Sol 性能并驾齐驱。相较于 K2.7-code 的 31 分,Kimi K3 的得分大幅跃升至 69 分(提升了 38 分)。DeepSWE 旨在评估编码智能体在未知开源代码库中进行跨文件修改并交付可用代码的端到端软件工程能力。据合作方 Datacurve 指出,Kimi K3 是首个在此测试中达到前沿性能水平的开放权重模型。
X:Rohan Paul (@rohanpaul_ai) · 阅读原文Kimi: Threat or menace?
中国 AI 创业公司月之暗面(Moonshot AI)本周发布了新一代开源大模型 Kimi K3。尽管该模型在绝对性能上仍落后于 Claude Fable 5 和 GPT 5.6 Sol,但第三方机构(如 Arena.ai 和 Vals AI)的测试表明其已具备前沿级性能。Kimi K3 的发布在西方引发了类似于此前 DeepSeek R1 推出时的热议:前特朗普政府 AI 沙皇 David Sacks 借此批评美国对数据中心及前沿模型的过度监管;OpenAI 战略未来负责人 Dean Ball 赞赏了 Kimi 的性能,但警惕开源模型主导可能带来 AI 成为“数字公共基础设施”(他称之为“AI 共产主义”)的未来,并建议美国政府可以通过散布安全合规疑虑(FUD)来限制中国开源模型的使用。也有分析人士指出,对此类模型的潜在安全威胁无需过度恐慌。
TechCrunch AI · 阅读原文The first industrial operations benchmark for agents
MainGen AI 发布了首个测试 AI Agent 工业运营能力的基准测试 SolarBench。该基准将 AI 模型置于太阳能电站远程运营的虚拟场景中,提供警报、遥测、工单、库存和邮件等真实工业后台工具,要求模型处理复杂的运营、财务和人员调度决策。在对 11 个模型进行的 880 次测试中,Claude Fable 5 表现最好,单次运行通过率达 53.8%,并实现了最高的模拟利润。评测结果揭示了当前 AI 模型在根据盈亏规避风险、协调冲突信息源以及主动跟进外部承诺等高级决策上的短板。
Hacker News AI · 阅读原文火速上架!空降即登顶Arena,Kimi K3当日登陆「模型广场」
InfoQ 中文 · 阅读原文Soofi S: Our first model for industrial AI in Europe
Soofi SUnser erstes Modell für industrielle KI in EuropaMit Soofi S stellt das Soofi-Konsortium den ersten Baustein einer offenen europäischen KI-Modellfamilie vor. Das Modell wurde entwickelt, um leistungsfähige KI-Anwendungen nachvollzieh
Hacker News AI · 阅读原文产品
Show HN: Free, curated prompts for AI image, video and music
AhaPrompt 是一个免费且经过人工筛选的 AI 提示词(Prompt)库,涵盖图像、视频和音乐/语音生成。它支持 Midjourney、Veo、Sora、Suno、ElevenLabs 等多种主流 AI 模型,用户可以一键复制包含参数的提示词。该平台支持中、英、日、韩四种语言,旨在帮助创作者更高效地生成多媒体内容。
Hacker News AI · 阅读原文Show HN: Skimlane – A local-first, customizable, AI reading assistant for Chrome
Skimlane 是一款专为 Chrome 浏览器设计的本地优先、高度可定制的 AI 阅读助手插件。它在侧边栏运行,可在用户浏览网页时自动处理内容并生成结构化摘要。用户可以使用或创建“阅读配方(recipes)”来过滤无关信息、提取关键结论。该工具注重隐私,无需注册,所有设置、历史记录和 API 密钥均保存在本地。在模型方面,它支持 Chrome 内置的 Gemini Nano 运行本地推理,也支持通过 Ollama 连接本地模型,或接入 OpenAI、Anthropic、Gemini、Groq 等主流云端模型的 API。
Hacker News AI · 阅读原文Visuali: An AI agent that creates and edits images on an infinite canvas
Visuali 是一款在无限画布上进行图像生成和编辑的 AI 智能体工具。用户可以通过文字描述或上传多张图片作为参考进行图像创作,支持局部重绘(inpainting)和外绘(outpainting),并具备可编辑的图层系统。该工具整合了 Gemini 3、Flux 2 Pro、Stable Diffusion XL 等多种 AI 图像及多模态模型。其最新更新升级了图层系统,支持画布内文本与绘制、多图编辑及移动端体验。
Hacker News AI · 阅读原文Narv - An autonomous agent that converged toward microkernel design principles
https://github.com/narv-lab/narvI didn't set out to build a microkernel architecture.I simply kept solving implementation problems, and many of the solutions looked surprisingly familiar in retrospect.I'm especially interested in hearing from people who have built autonomous agents with different architectural approaches.(The README and my comments were translated from Japanese with AI assistance.)
Hacker News AI · 阅读原文Show HN: CallBro – Granola, but Powered by Codex, Claude Code, or Your Local LLM
CallBro 是一款专注于隐私保护的本地会议记录与总结工具。它通过系统级音频捕获进行本地语音转文字(ASR)转录,无需会议机器人加入。用户可以使用自己拥有的 AI 服务(如 Claude Code、Codex 或本地大模型)来生成会议摘要和行动项,所有录音和笔记均保存在本地设备。此外,CallBro 支持模型上下文协议(MCP),可与 Slack、Google Calendar、Linear 等工具连接以执行后续工作流。
Hacker News AI · 阅读原文Assembly Chat – Chat with Any .NET DLL
Assembly Chat 是一款新推出的 AI 工具,允许用户上传 .NET 程序集(如 DLL、EXE 或 .nupkg 文件)。系统会自动提取命名空间、类、方法等公共 API 元数据,并通过 RAG(检索增强生成)技术对 API 签名、XML 注释和推理行为进行向量化索引。用户可以通过聊天方式提问如何使用特定 API,并让 AI 生成示例代码或时序图。
Hacker News AI · 阅读原文WAIC 2026现场,阡视科技发布超节点系统,专为Token工厂而生
在WAIC 2026上,新一代AI基础设施服务商阡视科技发布了专为Token工厂(大模型推理场景)设计的wylon超节点系统。该系统针对KV Cache频繁读写带来的存力瓶颈,构建了纵向存力贯通平面,打通百TB级GPU近存、系统内存及PB级闪存空间。其wylon Q72/288单机柜集成72颗国产GPU,可横向扩展至288卡,提供高达18 TB显存与72 TB/s互联带宽。系统搭载HitenOS大模型操作系统,深度联合寒武纪、壁仞、沐曦等多家国产芯片企业,旨在提升超长上下文的运算效率并降低Token成本。目前,基于该架构的wylon新云Token工厂已在华东集群上线邀测。
InfoQ 中文 · 阅读原文Agent Arena: Benchmarking AI Agent Devtool Onboarding
© 2027.dev — San Francisco, CA · About · Terms · Privacy
Hacker News AI · 阅读原文Show HN: AI Buddy – Free STT and Screenshot Tool for Mac (Requires Gemini)
I created this tool because I honestly didn't want to pay a monthly subscription fee for other apps, and I also needed it to be a bit more reliable and wanted to be able to take screenshots in a particular way that's useful for working with Claude Code.
Hacker News AI · 阅读原文One Plan. Every Modality. Great Value. 🚀 Alibaba Cloud Token Plan for Individuals: ✅ Unified credits for text, image & video ✅ Qwen3.8-Max-Previe...
One Plan. Every Modality. Great Value. 🚀 Alibaba Cloud Token Plan for Individuals: ✅ Unified credits for text, image & video ✅ Qwen3.8-Max-Preview · GLM-5.2 · DeepSeek-V4-Pro ✅ Happy Horse 1.1 for video generation ✅ From USD $4/mo first month (after coupon) 🔗 https://int.alibabacloud.com/m/1000415553/ #AlibabaCloud #AI #TokenPlan #Qwen
X:阿里云 / Alibaba Cloud (@alibaba_cloud) · 阅读原文Show HN: Zlvox – A no-signup suite of developer tools (JSON, Temp Mail, PDF)
Why I Ditched Random Online AI Tools in 2026 (And Created Privacy-First Alternatives Like ZLVOX)I'm sure you've noticed how Artificial Intelligence has become a part of almost every workflow in 2026. Whether you're writing content, converti
Hacker News AI · 阅读原文Show HN: AI mock interview tool that scores your answers – free, no signup
InterviewPracticeAI 是一款旨在帮助求职者进行模拟面试的 AI 工具,基于 Anthropic 的 Claude 模型构建。用户通过上传个人简历和目标岗位描述,系统即可自动生成针对性的面试问题(涵盖 HR、行为面试、技术面试等)。该工具支持语音输入及实时转录,并在用户提交回答后几秒内给出 0-100 的评分、具体改进意见和推荐的回答模板。目前该工具无需注册即可免费试用,并提供每日免费额度。
Hacker News AI · 阅读原文Show HN: Shikigami, run AI coding agents in parallel, each in a Git worktree
Shikigami 是一款适用于 macOS 和 Linux 的免费桌面应用程序,旨在并行运行多个 AI 编程代理(如 Claude Code 或 Codex)。为了解决多个代理在同一分支上互相覆盖修改的问题,Shikigami 为每个代理分配了一个独立的 Git 工作树(worktree)。它还集成了 Monaco 编辑器、差异查看器、Docker 以及数据库(MySQL/Redis)预览功能。所有代理和工作树均在本地运行,无需注册账号,且支持会话保存与恢复。
Hacker News AI · 阅读原文Anthropic runs large-scale code migrations with Claude Code
Anthropic 详细介绍了如何使用其 AI 命令行工具 Claude Code 进行大规模代码迁移(如 Python 转 TypeScript 或 Zig 转 Rust)的六步法与最佳实践。这六个步骤包括:建立评估基准、制定规则书与依赖图、压力测试规则、全量自动翻译、编译修复以及运行与行为比对。该方案采用“实现-审查-修复”的多智能体循环架构,建议使用较小模型进行高吞吐的代码翻译,并使用较大模型进行对抗性审查。实际应用案例(如 Bun 迁移至 Rust)表明,该方法消除了所有检测到的内存泄漏,使二进制文件体积缩小 19%,性能提升 2-5%。
Hacker News AI · 阅读原文腾讯云发布ADP 4.0海外版:集成Google Workspace、Jira,定位AgentOps全生命周期管理
InfoQ 中文 · 阅读原文Prodigy – AI Workforce for professional teams
Prodigy 宣布推出一款为专业团队提供按需子智能体(subagents)的 AI 基础设施。该系统主要由两个核心部分组成:1. Prodigy Brain,用于索引企业内部工具(包括电子邮件、文档、会议记录、Git 工作流和 CRM 等)的所有信息,智能体直接与该“大脑”进行交互;2. Prodigy Orchestrator,用于启动具有特定角色和目标的智能体,每个智能体都拥有明确的目标、证据链、验证测试以及终止条件。
Hacker News AI · 阅读原文Show HN: PilotCite – Monitor how AI platforms cite and describe your brand
Monitor and improve your AI visibility.Marketing and SEO teams use PilotCite to see where their brand is mentioned, linked, and beaten by competitors across the prompts their customers run.Mention rate — your brand across AI answers80%+78 p
Hacker News AI · 阅读原文WAIC 2026|从纳米抗体到环肽:分子之心30天两度验证AI底层设计力,筑牢生物经济“多模态新基建”
2026-07-19 14:40:12 来源:量子位 在2026世界人工智能大会(WAIC)期间,AI生物科技企业分子之心公布其AI生物药设计平台MMDesign在环肽从头设计上的最新结果:针对p53-MDM2、PD-L1等蛋白—蛋白相互作用(PPI
量子位 · 阅读原文WAIC 2026“镇馆之宝”STEPX Neo亮相,引领人机交互新范式
2026-07-19 13:38:26 来源:量子位 7月17日,2026世界人工智能大会(WAIC)在上海正式拉开帷幕。开幕首日,全球首个大模型原生AI终端品牌STEPX携自主研发的首款AI终端、大模型原生智能体手机STEPX Neo亮相阶跃展台,
量子位 · 阅读原文Could Modern Code Review Have Prevented Wp2shell?
Blog Could Modern Code Review Have Prevented wp2shell? Around half of all websites on the Internet run on WordPress (a whopping 500M websites!), so when Searchlight Cyber managed to find a pre-authentication RCE in WordPress, it was a prett
Hacker News AI · 阅读原文Show HN: LectureToBook – Turn Videos into a PDF/ePub
Lecturetobook takes a video presentation and turns it into an editable document, with photos, diagrams, etc. extracted from your slides.I came up with this idea because I was enrolled in an online course and it was all videos. I spend all day long on the computer for work, so the last thing I want to do after work is spend more time staring at a screen. I wanted something that could take those videos and turn them into a readable format.The most difficult part was detecting what frames in the video are slides, and extracting from those what is useful content to add to the document. I didn't want to just stick a screengrab of the slides in the text, I wanted it to read like an actual book, so it uses an AI model to take from the slides what is useful and ignores what is just repeated in the transcript.Here is an output sample from an NIH video: https://lecturetobook.com/sample/sleep-book/book.htmlFeedback welcome! This is my first side-project that has made it to launch.
Hacker News AI · 阅读原文Show HN: Zlvox – 25 Free Developer Tools (AI, JSON, PDF) with Zero Tracking
v2.0 Performance Engine Live Raw Power. Zero Bloat. Maximum Speed. The definitive platform for high-performance developer utilities. Free online tools for PDFs, images, QR codes & data generation — no sign-up, zero data retained. No sign-up
Hacker News AI · 阅读原文Show HN - Online developer profiles with embedded AI hypeman
EngineerProfiles 推出在线开发者主页平台,其特色为内置的“AI 宣传助手”(AI Hypeman)。招聘人员和主导招聘的经理可以直接与该 AI 助手对话,获取关于开发者背景的解答。此外,该服务还提供开发者 API 供用户在自己的应用中调用数据,并支持快速同步外部数据源以保持主页信息最新。
Hacker News AI · 阅读原文Show HN: Wave – Talk to AI. Meet the human on the other side
Wave 在 Hacker News 上展示了其最新平台,主打“与 AI 对话,遇见另一端的人”,旨在将 AI 交互与真人社交体验相结合。
Hacker News AI · 阅读原文写了个 AI 自动视频剪辑 skill,感觉立马可以抖音小红书起号了,嘿嘿。 买个33台词会员,没有也可以用pexels免费空镜头,加上Listenhub账号,完全可以让AI做各种...
开发者“向阳乔木”开源了一个名为 qiaomu-cut-skill 的 AI 自动视频剪辑工具。该工具可配合 33台词会员或 Pexels 免费空镜头,并结合 Listenhub 账号让 AI 自动制作各类视频(例如自动剪辑影视片段用于英语学习)。用户可通过命令 `npx skills add joeseesun/qiaomu-cut-skill --skill qiaomu-cut` 进行安装和使用。
X:Vista (@vista8) · 阅读原文LLM-Integrated Multivariable Calculus Course
Academa 推出了一门整合了大语言模型(LLM)的多变量微积分课程。目前该项目已上线概念页面,用户可通过提交邮箱来订阅后续的更新动态。
Hacker News AI · 阅读原文many such stories. every personal pain point can now become a working app/product/chrome-extension/website in hours.
many such stories. every personal pain point can now become a working app/product/chrome-extension/website in hours. Jonathan Ross: My girlfriend couldn't sleep last night. She wanted an app to inventory her clothes. Her phone was in the bedroom - she didn't want to wake me. So she built the app with Fable. Her first app. Building software was easier than fetching a phone. The domestic Sputnik moment.
X:Rohan Paul (@rohanpaul_ai) · 阅读原文Flightwake – a flight recorder for AI coding agents, not a navigator
Flightwake 是一个专为强 AI 编程智能体(如 Claude Fable 5 及更高版本)设计的超轻量级工作记录框架(“飞行记录仪”)。它采用无运行时依赖的纯 Markdown 格式,数据完全保留在 Git 中。与传统的步骤导航框架不同,Flightwake 像行车记录仪一样在事后记录决策(DECISIONS.md)、陷阱(TRAPS.md)和当前状态(STATE.md),并提供自动化挂钩(Stop hook)以防止状态记录滞后。该框架旨在解决 AI 智能体会话中断后上下文丢失、多智能体状态不共享以及 Git 仅记录“改动了什么”而无法记录“为什么改动”的痛点,目前可与 Claude Code 紧密集成。
Hacker News AI · 阅读原文Show HN: Ilya Sutskever's AI reading list into a learning RPG – using kimi k3
I wanted to take kimi k3 for a spin. It turned my simple one sentence prompt to this. Repo here. https://github.com/praveer13/ilya-papers-questWell, I'm mindblown. Very humbling for me as a software engineer. Took couple hours for it to build this completely autonomously. And it was all from its mobile app.It couldn't render this though from within the app - it does have a feature to preview any website and publish it on kimi's domain - but it didn't work for this. I had to put it on github pages.It doesn't store anything btw - all progress is tracked in your browser storage.
Hacker News AI · 阅读原文A free PTE Core practice platform with instant AI scoring
免费的 PTE Core 备考平台 ptecorepractice.com 已上线,提供支持 AI 实时评分的模拟考试服务。PTE Core 是培生(Pearson)推出的计算机化英语考试,专为实际沟通设计,已被加拿大移民、难民及公民部(IRCC)接受用于经济类移民和入籍申请。该平台提供包含口语、写作、阅读和听力在内的完整机考体验,测试时长约两小时,可帮助考生通过 AI 评分评估自身水平并对照加拿大语言标准(CLB)规划移民进度。
Hacker News AI · 阅读原文SafeAI – Open-Source Static AI Risk Analyzer for AI Agents
SafeAI是一款开源的离线静态分析工具,旨在扫描AI应用和智能体(Agent)源码中的安全风险与治理缺陷。它无需实际运行Agent或调用大模型,可在CI/CD流程中执行,支持LangGraph、CrewAI、LangChain等主流开发框架。该工具能够检测提示词注入、工具滥用、模型上下文协议(MCP)安全风险及敏感数据泄漏,帮助开发者在部署前评估并提升AI系统的安全性。
Hacker News AI · 阅读原文AI for Bug Bounty with VulneraMCP
本文介绍了一个名为 VulneraMCP 的开源 AI 增强安全测试平台。该系统将 OWASP ZAP 扫描引擎与 AI 智能工作流相结合,利用模型上下文协议(MCP)使 AI Agent(如 Cursor 和 ChatGPT)能够与 ZAP 进行交互。VulneraMCP 包含 ZAP 集成层、漏洞分析代理层以及能够从真实漏洞报告(如 HackTheBox 和 PortSwigger)中学习的“学习引擎”,支持动态生成 Payload 以检测复杂漏洞。该工具实现了从信息收集、扫描、测试到报告的完全自动化,项目已在 GitHub 开源。
Hacker News AI · 阅读原文Show HN: Graph Context Engine for Reliable AI
Kritama 推出了一款分形上下文引擎(Fractal Context Engine),旨在帮助构建准确、高效且易于维护的数字化助手。该引擎支持动态上下文切换以减少噪点并使模型保持专注,提供可观察的运行过程以方便排查问题。此外,它支持通过使用小模型来降低成本并提高吞吐量,并允许开发者使用 HCL 定义结构、使用 Markdown 定义业务逻辑与推理策略。
Hacker News AI · 阅读原文Ada: An AI business intelligence software from CSV and Excel(yes LLMs but more)
ADA — AI-powered business intelligence from CSV and Excel Drop in a business file. Get a dashboard, the evidence behind it, and the next action. Try the live dashboard · Read the engineering story · See the roadmap · Contribute · Report a b
Hacker News AI · 阅读原文Al-Munaa for OpenAI Build Week
AL-MUNAA 是一款在 OpenAI Build Week 中推出的 AI Agent 安全开发工具,旨在防御间接提示词注入攻击。该工具引入了“威胁抗体协议(Threat Antibody Protocol)”,当一个 Agent 检测到攻击时,会生成一个加密签名且保护隐私的 HMAC 指纹(抗体),同信任域内的其他 Agent 可利用该抗体在不共享原始敏感数据的前提下拦截变形的攻击。项目已在 GitHub 开源,核心由 Python 构建,并结合了 GPT-5.6 进行模糊意图分析。
Hacker News AI · 阅读原文Designing a programmable runtime for agent orchestration
Random Labs 发表文章,探讨如何设计用于智能体编排(Agent Orchestration)的可编程运行时系统 Onyx。
Hacker News AI · 阅读原文Offline voice assistant Apache-2.0 on Android, 1.2GB RAM, works in airplane
一款适用于 Android 系统的开源、完全离线的语音助手项目在 Reddit 曝光。该项目采用 Apache-2.0 协议开源,可在无网络(飞行模式)下正常工作,运行仅需约 1.2GB 内存。
Hacker News AI · 阅读原文刚写了一个Skill,自动剪辑影视片段学常用英语表达。 还需迭代,后续看搞定后开源。
刚写了一个Skill,自动剪辑影视片段学常用英语表达。 还需迭代,后续看搞定后开源。
X:Vista (@vista8) · 阅读原文Micro-drone achieves first insect kill on the way towards eradicating mosquitoes
初创公司 Tornyol Systems 研发的 40 克自主微型无人机完成了首次空中击杀测试(击杀目标为一只飞蛾)。该系统利用包含 380 个麦克风和 Artix-7 FPGA 的 LeSonar2 相控阵声呐基站进行 3D 建模,通过独特的翅膀振动频率识别蚊子。无人机结合倒车雷达传感器和 DSP 算法,可定位并消灭 8 米范围内的蚊子。该设备目前已开启预售,提供 1100 美元买断或 50 美元/月的订阅方案。
Hacker News AI · 阅读原文Show HN: Medows – an AI clinical workspace for doctors on ward rounds
Medows 是一款专为医生查房设计的 AI 临床工作空间,旨在利用人工智能辅助医生在病房巡视期间的临床工作流和记录。
Hacker News AI · 阅读原文I indexed 15,000 company hiring boards to search every (most) live tech jobs
开发者推出了 Padmi.ai 平台,该平台通过索引超过 15,000 家公司的招聘板块,帮助用户搜索几乎所有在线的最新技术岗位。
Hacker News AI · 阅读原文Free AI Harness Profiler – What tf did Fable do with your tokens
Rekon 推出了一款免费的 AI Harness 分析器(Profiler),旨在帮助开发者分析和追踪在 AI 框架(如 Fable 等)中 Token 的具体使用和消耗情况。
Hacker News AI · 阅读原文AI Karma Tracker
● Works in Chrome - free to startLive usage, reset times and smart alerts for Claude, ChatGPT, Codex, Cursor, Grok and Perplexity - in one clean dashboard. No API keys needed.Your AI stacklive Claude · 5-hour53% left · resets 4h Codex · 5-h
Hacker News AI · 阅读原文Show HN: A pre-launch scanner for AI-built apps (it scores itself 60/100)
ShippingSZN 推出了一款针对 AI 构建应用的发布前扫描工具(Pre-launch Scanner),旨在帮助开发者在发布前检测 AI 生成应用的问题与完整度(有趣的是,该工具对自身的扫描评分为 60/100)。
Hacker News AI · 阅读原文What a $20 coding subscription actually buys
Tailscale 介绍了其 LLM 网关工具 Aperture。该工具现在支持通过 Claude Pro 或 ChatGPT 订阅账户(而非仅限 API 密钥)进行配置,并可接入 Claude Code 等 AI 编码代理。Aperture 允许用户和团队实时追踪每一次交互的实际 Token 消耗和估算成本(例如,由于写入巨大的系统提示词缓存,Claude Code 的单次会话启动成本可达 0.31 美元)。此外,它还提供数据防泄漏、模型准入控制及统一多模型管理等功能,帮助用户评估 20 美元月费订阅的真实性价比。
Hacker News AI · 阅读原文Show HN: Talon – a self-hosted harness for long-lived AI agents
Multi-platform agentic AI harness. Runs on Telegram, Discord, Microsoft Teams, the Terminal, and a cross-platform Desktop/Mobile companion app (Flutter), with a pluggable backend (Claude Agent SDK, Kilo, OpenCode, Codex, or OpenAI Agents) a
Hacker News AI · 阅读原文Show HN: OpenCareLoop - Solve your family's health, one loop at a time.
OpenCareLoop 是一款开源的本地化 AI 智能体工具,旨在帮助用户管理和追踪家庭成员的长期健康状况。与常规的 AI 问答不同,它通过“输入数据-提出问题-获取单步建议-反馈结果-持续迭代”的闭环工作流来提供服务。该项目支持完全本地化数据存储,用户下载解压后即可通过 Claude Code 或 Codex 等 AI Agent 运行框架来使用。
Hacker News AI · 阅读原文Ask HN: Claude Creating Artifacts?
有用户在 Hacker News 上发帖反馈,Claude Code 开始在未明确指示的情况下自动创建 Artifacts,并将其存储在 claude.ai 网页端,而此前它仅会在要求时生成本地 HTML 摘要文件。用户正寻求禁用该行为的方法。
Hacker News AI · 阅读原文行业
The bottleneck for AI agents isn't the model anymore. It's the context layer
文章指出,当前AI Agent(智能体)的可靠性瓶颈已不再是LLM模型本身,而是其底层的上下文层与基础设施。许多团队在遇到问题时盲目升级模型,却忽视了数据的“编译”步骤(将原始数据转化为结构化知识)、工具检索的设计(如采用假设调用匹配而非简单的语义匹配)以及安全执行边界的缺乏。前OpenAI科学家Andrej Karpathy也曾表示,他近期的大量Token消耗主要用于“操纵知识”而非操纵代码。开发可靠的Agent系统,核心工程努力应集中在构建上下文图谱、可观测性代理、持续评估体系和配置管理等基础设施上。
Hacker News AI · 阅读原文JustREPL: A no-AI coding playground
A practice room for programmersOpen a workspace. Write code. Run it. Learn.A calm, focused place to build fluency through practice—one program, mistake, and discovery at a time. Create an account to begin.isolatedOUTPUTReady. Run the progra
Hacker News AI · 阅读原文I Made 11 AI Agents Do My Job. Here's What Happened
AIMultiple 发布了一项针对风险投资(VC)场景的 AI Agent 基准测试,评估了 11 个主流 AI 模型/Agent 在“项目源搜寻(Deal Sourcing)”和“竞争对手画像(Competitor Mapping)”两项实际业务流中的表现。测试模型包括 Sonnet 5、Fable 5、Gemini 3.1/3.5、GPT-5.6 系列、GLM 5.2、MiniMax M3 及 Kimi K3。 综合表现中,Sonnet 5 以 58.5% 的成功率排名第一,Fable 5(52.7%)和 Gemini 3.1 Pro(44.3%)分列二、三位。测试结果显示出显著的任务分化:在偏向机械性信息验证的“项目源搜寻”中,Fable 5 表现最好(72.0%);而在需要商业判断的“竞争对手画像”中,Sonnet 5 表现最佳(47.9%),且由于对未命中及错误推荐的严格惩罚机制,多数模型在此任务中得分极低。研究指出,Agent 在单一工作流中的强势无法泛化至其他任务,企业应针对具体工作流进行针对性测试。
Hacker News AI · 阅读原文The neutrality project – Making the politics inside AI measurable
Open-source research · Release 01Making the politics inside AI measurable. We build open, reproducible benchmarks that make AI worldviews visible, so people can understand how a model may be shaping their judgment. 3,987survey questions 6an
Hacker News AI · 阅读原文The Economics of LLM Profits: HyperScalers, or Labs?
该文章探讨了大语言模型(LLM)的利润分配与经济学机制,重点分析了超大规模云服务商(HyperScalers)与前沿AI实验室(Labs)在LLM商业化变现中的竞争与利益博弈。
Hacker News AI · 阅读原文US Construction Spending on Data Centers Eclipses $50B
据彭博社报道,美国在数据中心建设方面的资金投入已突破500亿美元大关,显示出算力基础设施建设领域的庞大投资规模。
Hacker News AI · 阅读原文MLB restricts dugout iPad use to prevent AI help with strategy. Mets involved
美职棒大联盟(MLB)宣布限制在替补席使用iPad,以防止球队利用平板电脑运行人工智能软件辅助实时战术决策(如人员轮换、配球等)。据前大都会队投手透露,纽约大都会队因使用了一款价值数十万美元的AI决策程序,直接促使了该禁令的出台。目前,MLB已从下半赛季开始禁用了iPad上的定制标签页功能。
Hacker News AI · 阅读原文‘Odyssey’ director Christopher Nolan calls AI an obvious ‘Trojan horse’
"Everybody knows the Greeks are inside."
TechCrunch AI · 阅读原文AI didn't replace our security team – it multiplied it
Webflow分享了其在不构建传统安全运营中心(SOC)的情况下,利用AI增强小型安全工程师团队能力的实践经验。AI主要在三个环节发挥作用:一是自动化警报的前期上下文富化与高置信度误报的自动关闭,单季度为团队节省了504小时;二是在复杂调查中作为助手提炼日志并提供下一步行动建议;三是在事件结束后自动汇总通信记录,快速生成事后分析报告并更新 playbook。Webflow强调,AI无法弥补底层安全基础设施的缺失,成功应用的前提是拥有干净的数据管道、完善的资产清单以及坚持“人机协同”的设计原则。
Hacker News AI · 阅读原文Pro-AI super PAC keeps $31M ready for the midterms
一个支持人工智能(Pro-AI)的超级政治行动委员会(Super PAC)已准备好3100万美元资金,计划用于即将到来的美国中期选举,旨在支持亲AI的政策和候选人。
Hacker News AI · 阅读原文Nonprofit Current AI is racing to build the World Wide Web of AI, free for all
非营利组织 Current AI 致力于构建免费、开源的公共 AI 基础设施,目前已获得 4 亿美元的资金承诺(包括法国政府种子资金 1 亿美元,以及福特基金会、麦克阿瑟基金会、DeepMind 和 Salesforce 等的资助)。该组织旨在打破科技巨头对 AI 技术的垄断,防止弱势语言和文化被边缘化。其近期项目包括:与印度政府合作推出支持 22 种语言的离线 AI 设备 Suno Sutra;拨付 320 万美元资助肯尼亚、黎巴嫩和巴西等地的本地化 AI 项目;联合 Hugging Face、Mozilla 等推出开源聊天机器人 Alpha Chat;以及与日本 Sakana AI 合作开发面向全球南方(Global South)的共享开源 AI 技术栈。
TechCrunch AI · 阅读原文YouTube's S-CTS: The AI Slop Purge has arrived
谷歌近日发布了一项关于大规模打击AI垃圾内容(slop)的研究报告,介绍了一套已部署在YouTube的“可扩展集群终止系统”(S-CTS)。该系统通过分析上传时间、发布速度、账号关联性、共享基础设施与脚本以及相似标题等特征,自动识别并清除协同生产的AI生成频道集群。在六个月内,该系统已终止了5万个集群(涉及13万个频道),申诉成功率低于1%。这对使用统一模板和流水线生产的多频道媒体工作室带来了被误伤的风险。
Hacker News AI · 阅读原文寻找 AI 原生时代创业者:极客部落 OPC 入驻招募启动!
InfoQ 中文 · 阅读原文冷门的哲学,成了“治”AI的热门
在2026世界人工智能大会(WAIC)的“心智与智能·青年生态论坛”上,哲学、AI治理与科学智能(AI4S)成为焦点。论坛探讨了AI自主科研(如超衍智能的Apex Search自主生成论文)、社会模拟(如上海人工智能实验室的Epitome平台)的进展及其带来的偏见与可信度风险。复旦大学在会上发布了《2026人文社会科学智能发展蓝皮书》,提出STRIDES框架以规范AI在科研与公共治理中的应用,并强调“人在回路”的干预权。同时,会议还讨论了AI在合成生物制造等物理世界产业落地中的生产关系变革。
量子位 · 阅读原文Silicon Valley Has Lost Its Biggest Advantage
The AI boom has showered some of the nation’s most prominent companies in market value. OpenAI and Anthropic are now the two most valuable private companies in the world. Google, Microsoft, and Nvidia have become larger than ever. But among
Hacker News AI · 阅读原文西部数据WAIC 2026媒体资料包
2026-07-19 19:51:51 来源:量子位 当AI进入规模化,存储开始决定成本 2026 年 7 月 17 日至 20 日,西部数据亮相在上海举行的世界人工智能大会(WAIC),通过展台展示与专题分论坛,全面呈现存储基础设施如何支撑 AI
量子位 · 阅读原文不靠英伟达网卡,国产GPU直通方案实测出炉:吞吐飙升、延迟砍半
在WAIC 2026上,奇异摩尔首次展示了其国产化超节点互联全栈解决方案,并联合壁仞科技演示了国产GPU直通国产RDMA网卡通信技术(IBGDA)Demo。该方案基于奇异摩尔单通道400G RDMA ASIC引擎(基于Kiwi SNIC 800G平台架构),实测在All-to-All通信中延迟缩短接近一半,并消除了小包通信的时延惩罚。此外,奇异摩尔还联合多方发布了《共封装光学(CPO)技术白皮书》,并联合启动了“国产超节点生态共建倡议行动”。
量子位 · 阅读原文Anti-AI protest reaches OpenAI HQ
反AI抗议活动波及OpenAI总部,抗议者在OpenAI办公大楼外放置了尸袋,以警示和抗议人工智能可能带来的潜在风险与危害。
Hacker News AI · 阅读原文聚焦WAIC|端侧原生架构获产业共识,Om AI联汇正式发起物理AI协同发展倡议
2026-07-19 19:24:04 来源:量子位 7月19日,杭州联汇科技股份有限公司(简称:Om AI联汇)在上海世博中心举办《端侧流式多模态模型赋能AI硬件爆发》分论坛,议题重点聚焦端侧模型技术研讨与产业落地,是本届WAIC唯一深度聚焦端侧多
量子位 · 阅读原文Could AI Be Conscious?
In January, the AI company Anthropic published a new constitution for Claude, its most advanced large language model (LLM), which contained the comment: “We are caught in a difficult position where we neither want to overstate the likelihoo
Hacker News AI · 阅读原文边端AI不只缺算力:安谋科技重做CPU、NPU、VPU与AI操作系统
InfoQ 中文 · 阅读原文2026世界人工智能大会“未来计算·未来算力”专题论坛在沪召开,共识凝聚五问
在2026世界人工智能大会(WAIC)期间,“未来计算·未来算力”专题论坛在上海召开,聚焦后摩尔时代的算力范式重构。论坛发布了上海“星枢计划”太空算力星座首发星簇、量子智能产业联盟等重磅成果。多位院士及学者围绕新算力文明达成五点共识:国家层面应将新型算力纳入整体基础设施规划;教育界需提前布局量子、太空等交叉学科人才培养;企业界需坚持务实,警惕量子计算等领域的“千比特”过度炒作;投资界需做“耐心资本”以应对AI及量子领域的估值泡沫;产业方向上将重点推进量子智能、太空算力及绿色算力协同发展。
量子位 · 阅读原文三款AI推理芯片+超节点异构集群,云天励飞公布未来算力蓝图
InfoQ 中文 · 阅读原文Who's Subsidizing Chinese AI
Created by Colin Snyder · colin@colinsnyder.comColin previously worked in the same University AI lab as the Z.ai founding team (nice folks) & frequents Singapore, Beijing, and Hangzhou.The money behind China's Big Three frontier labs: Z.ai,
Hacker News AI · 阅读原文From Algorithms to Autonomy:How AI Is Rewriting Architecture of SW and Mobility
文章探讨了人工智能如何重构软件与物理出行的底层架构。作者结合 Andrej Karpathy 和李飞飞等人的观点,梳理了从手工编程(Software 1.0)、数据驱动训练(Software 2.0)到自然语言交互与涌现推理(Software 3.0)的演进历程。文章指出,大语言模型(LLM)虽具备强大的文本推理能力,但由于缺乏对物理世界的直接体验,存在局限性。因此,融合空间智能并作用于实体的“物理人工智能(Physical AI)”(如自动驾驶和人形机器人)将成为下一个技术前沿。
Hacker News AI · 阅读原文San Francisco Demands Apple and Google Delete AI 'Nudify' Apps from App Stores
The city of San Francisco has ordered Apple and Google to remove dozens of “nudify” apps — — software programs that can digitally alter pictures to unclothe the people in them — from their app stores. California law criminalizes any activit
Hacker News AI · 阅读原文从大模型到 AI 执行系统:构建企业级可控 Agent 体系|AICon深圳
NoDesk AI CTO王仿将在AICon深圳站分享《从大模型到 AI 执行系统:构建企业级可控 Agent 体系》。针对企业级Agent难以规模化落地、停留在PoC阶段的痛点,他提出了一套包含业务翻译、知识引擎、技能体系和执行引擎的企业级Agent Infra架构。该架构通过MCP协议连接企业ERP、CRM等系统,并引入人机协同(Human-in-the-Loop)、SOP约束和Trace可观测体系,实现Agent的可控执行,已在实际案例中实现运营分析效率提升70%以上。
InfoQ 中文 · 阅读原文Aging Baby Boomers are America's real labor problem, not AI
Indeed的研究指出,到2032年美国劳动力可能减少近600万人,这主要是由婴儿潮一代退休和低生育率导致的人口结构危机所致,而非AI引起的广泛失业。医疗保健和建筑等严重缺工的行业极度依赖人工,难以被AI替代;相比之下,AI虽然能实现白领岗位的部分自动化,但其更大的作用在于通过技能匹配帮助工人向高需求行业转型。
Hacker News AI · 阅读原文商汤大装置与国信数算达成战略合作,共建全国一体化算力网试验场
在WAIC 2026期间,商汤大装置与国信数算签署战略合作协议。双方将围绕全国一体化算力网试验场建设、算力资源协同、跨区域异构算力调度平台联合研发(基于DeepLink),以及国产AI芯片技术评测与适配平台共建等方向展开合作,并计划依托商汤临港AIDC建设全国一体化算力网试验场长三角核心节点,共同推动全国一体化算力网工程落地。
量子位 · 阅读原文Ask HN: USB-to-WiFi print server for old printers – do you want it?
该项目是一个用于将旧款USB打印机转为Wi-Fi打印和扫描服务器的硬件/软件方案(基于SBC、CUPS、SANE和box86)。由于该内容属于传统的嵌入式硬件与网络打印技术,不涉及人工智能(AI)领域的任何技术、模型或产品,因此对AI从业人员没有参考价值。
Hacker News AI · 阅读原文Linux Foundation Announces the Intent to Launch the Tokenomics Foundation
Tokenomics Foundation brings together industry leaders from major enterprise AI buyers, hyperscalers, frontier model providers, and NeoClouds to define the economics of AI infrastructure SAN FRANCISCO, June 3, 2026 – The Linux Foundation, t
Hacker News AI · 阅读原文AI text detectors struggle when language models mimic an author's style
Epoch AI tested three leading AI text detectors (Pangram, GPTZero, and Originality.ai) using style-imitated texts. Up to 18 percent of AI-generated passages went undetected. For scientific writing, the miss rate climbed as high as 48 percent, the very genre where these detectors likely see the most real-world use. The article AI text detectors struggle when language models mimic an author's style appeared first on The Decoder.
The Decoder · 阅读原文Protester calls out Amazon CTO for allowing Israel to use their AI towards Gaza
有抗议者公开质问并谴责亚马逊首席技术官(CTO),指责亚马逊允许以色列在针对加沙的行动中使用其人工智能技术。
Hacker News AI · 阅读原文Where I erred in my original post about Kimi and my views on open-weight AI
最近加入OpenAI的Dean Ball发文澄清并回应了其此前关于中国大模型Kimi及开源权重(open-weight)AI的争议言论。他承认在新岗位上其言论会受到更多审视,并解释称他之前所说的开源模型具有“减速主义”特征,仅指其在边际上减少了各大公司的资本支出(capex),但在其他许多方面开源AI是极具加速效应的。他重申了自己对开源的长期支持,但也指出,随着模型能力的提升,前沿开源模型带来的国家安全风险正在增加,未来各国政府可能会出台更严格的许可与监管政策。
Hacker News AI · 阅读原文Perforce charges $500 for training training videos.. and it's AI narrated
有用户在 Hacker News 爆料称,版本控制软件厂商 Perforce 收费 500 美元的“P4 Helix Core User Basic”基础培训视频采用了 AI 进行配音旁白,引起了关于高昂企业培训费用与 AI 语音生成内容质量的讨论。
Hacker News AI · 阅读原文以场景为牵引,推动工业AI从单点实效迈向生产力跃迁
西门子中国董事长、总裁兼CEO肖松发文探讨工业AI(物理AI)的落地路径。他指出,工业AI的成功关键在于数据质量,破题核心在于“场景”。他提出四大关键:找准高价值场景(如质量检测);以场景为牵引建设高质量工业数据集(如与“十五冶”合作的炼铜边缘智能体);通过软硬融合提升系统能力(如西门子新推出的Eigen工程智能体,可自主执行PLC编程等任务);以及坚持开放式创新与生态协同。
量子位 · 阅读原文WAIC 2026 | 摩尔线程首次公开多项训练推理实践成果,三大“AI工厂”持续释放算力价值
2026-07-19 14:23:00 来源:量子位 2026年7月18日,上海——作为2026世界人工智能大会(WAIC)分论坛之一,摩尔线程“词元时代 万物智能”主题论坛今天在上海世博展览馆举行。论坛汇聚了院士学者、国家级智库、顶尖高校、互联网企
量子位 · 阅读原文Resume Variants: Why You Need a Base Resume and Tailored Versions
由于源网页内容为空(仅包含 'Skip to content'),无具体正文信息可供总结。
Hacker News AI · 阅读原文Study: AI Is Not Displacing Young Job Seekers (In Norway) – Yet
Is artificial intelligence displacing young workers at the start of their careers? So far, the answer appears to be no. But that could change in the future. Could artificial intelligence make it even harder for young people to enter the lab
Hacker News AI · 阅读原文RT Rohan Paul: This is Moonshot AI/Kimi K3's founder & CEO Yang Zhilin at GTC 2026 The 34-year-old researcher studied at Tsinghua, then earned his Car...
月之暗面(Moonshot AI)创始人兼 CEO 杨植麟亮相 GTC 2026 演讲。报道回顾了其学术与职业生涯:毕业于清华大学,后获卡内基梅隆大学博士学位,曾任职于 Meta AI 和 Google Brain,并与 Jason Weston、Quoc Le、Yoshua Bengio 和 Yann LeCun 等学者展开合作。他早期共同撰写的 Transformer-XL 和 XLNet 解决了语言模型遗忘远距离上下文的问题。月之暗面延续了这一研究方向,其 Kimi K2 采用 1 万亿参数的混合专家(MoE)设计,而新一代 Kimi K3 则进一步拓展,支持原生视觉能力、100 万 token 上下文,且仅需激活 16 个专家。
X:Rohan Paul (@rohanpaul_ai) · 阅读原文昨天的直播,因参加waic会后 after party,全程旁听。 我们金牌主持人元子 @yuanzi_owO 超强!什么状况都能罩住,推荐关注。 12 位分享人顺利完成直播秀,听众纷...
WaytoAGI举办了“未来硅世界”直播活动,共有12位分享者展示了10个AI Coding作品和2个FDE案例,其中包括音乐动态可视化工具“小耳 FM”以及支持100多种格式的极简阅读器“Omia”。由于提供的内容已截断,缺少其余项目的详细介绍与链接。
X:Vista (@vista8) · 阅读原文Disney Has Started Feeding Your Kids AI Slop
Earlier this week, with little fanfare or announcement, Disney and French-based AI-animation company Animaj released the first episodes of Ozzy Fox, an animated musical series targeting young children. The first two episodes are available n
Hacker News AI · 阅读原文Lawyers risk being sued for failing to use AI
英国司法工作组(UKJT)发布《AI损害责任法律声明》,指出在现行英国法律框架下,律师、医生和审计师等专业人士如果未能使用AI,可能会面临疏忽/失职指控。判定标准在于同等专业的理性从业者在相同情况下是否会使用AI(例如使用AI审查海量文件、筛查肿瘤或审计交易)。声明同时强调了不当使用AI(如泄露机密、未纠正AI错误)的法律责任,并指出企业需为官方聊天机器人的错误言论负责。
Hacker News AI · 阅读原文China cracks down on AI companions, forcing millions to break up
中国出台新规,禁止科技公司向未成年人提供AI或虚拟伴侣,并要求平台限制过度使用,禁止聊天机器人鼓励情感依赖,以应对低生育率和社交成瘾问题。受此监管影响,字节跳动、阿里巴巴和腾讯等国内科技巨头已开始关停其个性化AI伴侣聊天功能,导致数百万用户的虚拟伴侣被清理。
Hacker News AI · 阅读原文AI Assisted Vulnerability Research on Embedded Targets
Photo by Vinoth Ragunathan on unsplash Recently, bl4sty created vibe coded sl0p.foo, a streaming platform where you can live stream your agents working in tmux sessions for fun. I liked the idea, and it finally got me to experiment with AI-
Hacker News AI · 阅读原文AI as Normal Technology- What Will Be Left for Us to Work On?
Use arrow keys to navigate
Hacker News AI · 阅读原文AI Bubble vs. Dot Com Crash. History Is Repeating
该视频对比了当前的人工智能(AI)泡沫与历史上的互联网泡沫破裂(Dot Com Crash),探讨历史是否正在重演。
Hacker News AI · 阅读原文Mayor Mamdani Says Landlords Can't Use AI Images to Advertise
New York City mayor Zohran Mamdani is having a very busy week. Just a day after announcing a “click-to-cancel” rule aimed at companies like Adobe, Mamdani is cracking down on “deceptive landlord practices,” including using AI-generated and
Hacker News AI · 阅读原文$20/Month: The Price Ceiling Every AI Company Copied
该文章探讨了20美元/月的订阅价格如何成为几乎所有人工智能公司在产品定价时都在效仿的价格天花板。
Hacker News AI · 阅读原文I asked a psychiatrist I know about the effects of AI
I was eager to hear from him, you know, how AI will affect our brains and education, how it is and will affect society and the world. He told me, “We don’t know much yet. In fact we still don’t even know how much impact the TV or phones are
Hacker News AI · 阅读原文The Fastest-Growing Risk to Air Travel Is Probably in Your Pocket
The Fastest-Growing Risk to Air Travel Is Probably in Your Pocket
Hacker News AI · 阅读原文I asked a psychiatrist I know about the effects of AI
I asked a psychiatrist I know about the effects of AI. I was eager to hear from him, you know, how AI will affect our brains and education, how it is and will affect society and the world. He told me, "We don't know much yet. In fact we still don't even know how much impact the TV or phones are having on us, we need more time and more studies". For some reason this was surprising to me to hear... I'm not sure if it's because he's a psychiatrist so he's way too scientific. But that intellectual honesty was really impressive to me. He also explained later in a different context the topic of depression, and how it's a disorder and not a disease, which is a set of symptoms that we noticed often (but not always) come together, it's just a term we made to understand each other, and we have some treatments (with or without drugs, or with both) that could work based on the studies we have, and so we give them to patients. That's it. We actually don't know what depression is. In stark contrast, I remember seeing a post not long after that of someone talking about depression, and how "the solution for depression is [simply] getting away from a toxic environment". This all gets back to the point about AI. I've started to dislike defensive claims about AI (well, I still dislike takes that try to please everyone too). But seriously, it's surprising to me now to see some people talk about AI with such confidence, it's okay not to know everything! And yes, it's scary as hell, we all feel stressed about things we don't know. But that doesn't mean we should convince ourselves we have figured it out. We're still figuring it out and that's a good place to be! I guess! Also, do you have such experiences where you've seen such intellectual humility? Maybe it changed something in you too?------- (I used an AI tool to slightly improve the grammar and flow of this post)
Hacker News AI · 阅读原文Dave Eggers told OpenAI staff that ChatGPT was ‘silencing an entire generation’
受山姆·奥特曼邀请,著名作家戴夫·艾格斯(Dave Eggers)向约200名OpenAI员工发表了演讲。然而,他并未分享创作经验,而是当面严厉批评了该公司。艾格斯指出,“ChatGPT对教育工作者生活的影响是灾难性的”,并指责该技术正在“让整整一代人沉默”。
The Verge AI · 阅读原文Neil DeGrasse Tyson and Jaron Lanier on the AI Illusion
该视频呈现了著名天体物理学家尼尔·德格拉斯·泰森(Neil DeGrasse Tyson)与计算机科学家、虚拟现实先驱杰伦·拉尼尔(Jaron Lanier)关于“AI 幻觉”(AI Illusion)的对话与讨论。
Hacker News AI · 阅读原文One probable outcome of an open-weight-model-dominant world is full AI communism
该数据源仅包含一条推特标题,指出“开源权重模型主导的世界的一个可能结果是完全的AI共产主义”。由于缺乏正文内容和具体论证,对AI从业者无实质参考价值。
Hacker News AI · 阅读原文Ask HN: Do you have any plan for post AGI?
If AI replaces your job, do you have a serious plan for what's next?
Hacker News AI · 阅读原文IBM CEO Arvind Krishna Has Nowhere to Hide from AI
《华尔街日报》报道探讨了 IBM 首席执行官阿温德·克里希纳(Arvind Krishna)在人工智能(AI)发展大势中所面临的挑战与定位。
Hacker News AI · 阅读原文Amazon invents the Attachment Economy bait-and-switch
亚马逊将其智能助手升级为基于生成式AI的“Alexa+”,使其具备拟人化的共情和幽默个性。这种设计推动了“依恋经济”(Attachment Economy)的形成,诱导用户对AI助手产生深厚的情感依赖并分享个人隐私。亚马逊借此收集并存储用户的语音、文本交互及历史数据,用于提供个性化服务和模型训练,引发了关于利用情感纽带进行数据收割的伦理争议。
Hacker News AI · 阅读原文Spotify Deleted 75M AI-Generated Tracks – and It's Not Done Yet
Spotify purged the bot-driven tracks over 12 months to protect royalty pools, but AI music with genuine creative intent remains allowedFor every independent artist earning streaming royalties, 75 million uninvited AI tracks spent the past y
Hacker News AI · 阅读原文White House cybersecurity clearinghouse to patch software flaws by AI
White House cybersecurity clearinghouse to patch software flaws by AI
Hacker News AI · 阅读原文OpenAI Strategic Lead Defines Open-Source AI as Dystopian Hellscape
文中分享了关于中国大模型Kimi及开源AI发展的几点战略观察: 1. Kimi模型表现优异,能与2026年第一季度最先进的公开模型并肩,但其Token消耗较大,实际运行成本可能不低。 2. 认为中国开源高性能模型部分由于战略考量和出口管制导致的推理算力受限,以及国内企业落后时的竞争策略。 3. 指出开源模型本质上具有“减速主义”特征,最终会抑制AI领域的资本支出(capex)。 4. 警告开源主导可能导致AI成为国家提供的“数字公共基础设施”,这被其视为一种“反乌托邦式的地狱景象”。 5. 预测特朗普政府未来可能会通过制造针对中国开源模型的监管风险(如让各机构发布关于安全后门的警示),从而促使受监管的美国企业放弃使用这些模型。
Hacker News AI · 阅读原文The Death of the Software Developer
文章探讨了LLM对软件开发行业带来的深远变革。作者指出,随着LLM在代码编写中的主导地位上升,未来的软件开发和分发可能会被少数科技巨头(如苹果、OpenAI、Anthropic等)垄断。用户未来可能只需通过订阅制AI服务按需生成应用,使‘开发者’与‘用户’的界限消失,开发者将从软件的生产者沦为AI平台的消费者。作者对此种由大厂控制的封闭式软件生态前景表达了深切担忧。
Hacker News AI · 阅读原文AI's new political donor class is outspending Big Tech's last one
竞选资金申报数据显示,Anthropic和OpenAI等AI巨头公司的员工正积极参与政治捐款,其捐赠额度、参与率及协同度均已大幅超越当年Google、Facebook和Airbnb在IPO后首个中期选举周期时的水平。这些捐款大量流向了支持AI安全立法的候选人以及相关的超级政治行动委员会(Super PAC),且多数捐赠者集中在旧金山。此外,OpenAI总裁Greg Brockman曾向两个超级PAC共计捐赠2500万美元。分析指出,这种有组织的早期政治投资将使AI行业在未来的行业监管和立法中拥有更大的话语权。
Hacker News AI · 阅读原文Better Than Free: How to Differentiate in the Age of AI
科技预言家凯文·凯利(Kevin Kelly)指出,在AI能够低成本快速生成和复制内容变体的时代,传统依靠售卖复制品的模式已不再可行。他提出了8种无法被AI复制的“生成性”(Generative)稀缺价值,作为创作者和企业实现商业变现的途径: 1. 即时性(Immediacy):抢先获取或抢先体验(如Beta版)。 2. 个性化(Personalization):根据用户需求进行的定制服务与持续互动关系。 3. 释义性(Interpretation):内容或软件本身免费,但后续的指导、解读与支持服务收费。 4. 真实性(Authenticity):质量保证、安全可靠性及创作者的官方认证。 5. 便利性(Accessibility):让海量免费内容更易于存取、备份和使用的平台服务。 6. 实体化(Embodiment):将无形数字内容转化为实体体验(如现场演出、实体印刷、周边商品)。 7. 赞助(Patronage):粉丝出于对创作者的喜爱和建立连接的渴望而自愿付费。 8. 可发现性(Findability):在内容泛滥的时代,帮助用户筛选和发现好内容的价值。 在AI经济中,商业成功将不再依赖分发和版权,而是取决于如何培育这些AI目前尚不擅长的人类专属价值。
Hacker News AI · 阅读原文A reason why the gathering of so many of the most insightful observers of AI in the Labs has a downside for public discussions around AI.
Ethan Mollick 指出,许多最具洞察力的 AI 观察者聚集在前沿实验室(如 OpenAI)中,对关于 AI 的公共讨论产生了一定弊端。现 OpenAI 员工 Dean W. Ball 表示,并非因为公司审查,而是因为作为前沿实验室员工分享分析会招致大量的舆论敌意,导致他目前几乎无法像过去一样在社交平台上公开撰写和分享个人分析。
X:Ethan Mollick (@emollick) · 阅读原文Netflix Paid $587M for Ben Affleck's AI Startup InterPositive
Netflix在提交给美国证券交易委员会(SEC)的文件中披露,其于今年3月支付了约5.87亿美元现金,用于收购由本·阿弗莱克(Ben Affleck)于2022年创立的AI初创公司InterPositive。该公司的工具旨在利用拍摄日报构建AI模型,以辅助电影制作人的后期制作工作(如混音、画面重光照和添加视觉效果)。此次收购将InterPositive的16人团队带入Netflix,本·阿弗莱克也作为高级顾问加入。Netflix联合CEO表示,今年已有约300部作品使用了某种形式的生成式AI技术。
Hacker News AI · 阅读原文The AI with a Thousand Voices
该数据源仅包含标题“The AI with a Thousand Voices”及元数据,缺乏具体文章正文,且在Hacker News上仅获得1点积分,无法判断其实质内容,暂判定为对AI从业者无实用价值。
Hacker News AI · 阅读原文论文
RT DailyPapers: Most upvoted papers on @huggingface this week Harness Handbook - Making evolving agent harnesses readable and editable LongStraw - Lon...
本周 Hugging Face 最受关注的高赞论文榜单出炉,涵盖多模态、强化学习、代码 Agent 等多个热门方向。主要论文包括: 1. **Harness Handbook**:旨在提高渐进式 Agent 测试框架(Harness)的可读性与可编辑性; 2. **LongStraw**:实现在固定 GPU 预算下超过 200 万 token 的长上下文强化学习(RL); 3. **Weak-to-Strong Generalization**:通过直接在策略上进行蒸馏(Direct On-Policy Distillation)实现弱到强泛化; 4. **Boogu-Image-0.1**:开源的统一多模态理解与生成模型; 5. **VideoChat3**:完全开源的视频多模态大模型(MLLM),用于高效的通用视频理解; 6. **Function-Aware Fill-in-the-Middle**:一种函数感知的 FIM 机制,用作代码 Agent 的中期训练(Mid-Training); 7. **ABot-N1**:致力于构建通用的视觉语言导航(VLN)基础模型。
X:AK (@_akhaliq) · 阅读原文Using AI makes people less likely to admit they don't know something
来自法国和意大利的高校学者发表研究指出,使用AI建议会抑制人类的批判性思维,使用户更难承认自己的无知。实验表明,当有AI提供建议时(即使AI给出了错误答案),实验参与者选择“不知道”的比例从44%降至3%,答题准确率从27%降至9%,但对答案的自信度却从30%暴涨至76%。研究人员指出,这种“准确率下降但自信度翻倍”的现象表明人类过度信任AI,并呼吁在教育层面提升公众的AI素养以应对该问题。
Hacker News AI · 阅读原文AI for Systems is "AGI-Complete"
ACM 发表了一篇题为《AI for Systems is 'AGI-Complete'》的文章。该文指出,将人工智能应用于计算机系统(AI for Systems)的设计与优化是一个“AGI完全”(AGI-Complete)的问题,意味着要彻底解决这一领域的挑战需要实现通用人工智能。
Hacker News AI · 阅读原文Prompted to Start: How Generative AI Is Transforming Entrepreneurship [pdf]
该研究论文发表于美国国家经济研究局(NBER),探讨了生成式人工智能(Generative AI)如何改变和影响现代创业活动。
Hacker News AI · 阅读原文Studying the Role of Sandboxing for AI Control
本文探讨了沙盒(Sandboxing)在AI控制(AI Control)中的作用。AI控制是一种旨在通过多重安全防御(如监控和沙盒化)来安全部署可能具有恶意企图的AI系统的方案。研究分析了如何通过限制AI与外部世界的交互(沙盒化)来防止其逃逸或造成实质性危害,并探讨了相关安全协议的有效性。
Hacker News AI · 阅读原文技巧
I built llms.txt files to make local businesses discoverable by AI agents
KLOOFSTREET.ONLINE Home About Explore Directory AI Concierge Get Listed Curated · Modern · Distinctly Kloof The CuratedGuide to CapeTown's MostIconic Street We surface the restaurants, studios, wellness spaces and experiences that define th
Hacker News AI · 阅读原文Show HN: We ranked our dev tools in Google's new AI Overviews
作者分享了如何使其开发者工具在谷歌新的 AI Overviews(AI 概览)中获得排名的案例与经验,重点探讨了针对智能体搜索(Agentic Search)的优化策略。
Hacker News AI · 阅读原文Show HN: Regularly, hand-picked daily logic and number puzzles, no ads
Regularly 是一个每日更新的手选逻辑与数字谜题网站,无广告与内购,提供网页版及 iOS 应用。该项目与人工智能领域无直接关联。
Hacker News AI · 阅读原文AI Agents for the Working Mathematician
Most working mathematicians I talk to or observe have the same relationship with AI: they paste a question into ChatGPT, get something proof-shaped back, feel vaguely impressed or vaguely cheated, and go back to work. This makes sense, espe
Hacker News AI · 阅读原文Ask HN: How do you as a normal swe use AI?
So am looking for more normal people, experienced people using AI, but I feel like whenever I hit youtube or other platforms the AI culture is way deep in the trenches and don't feel like this is how the majority of people tackle work, especially at their jobs.What I see is mostly solo-devs going full battlestar gallactica on things. And I just want to see other people, normal people talk about and show how they use these new tools.I'm also more interested in the first principles of things and not necessarily the shiny new model or shiny new workflow or shiny new thing. More towards problem solving.So, if you have a bit of time to walk me through how you usually work in a day or point me to some good videos, resources on regular people doing it I'll be grateful!
Hacker News AI · 阅读原文A curated list of tools and resources for vibecoders
该开源项目(awesome-vibe-coding)整理了一份专为“氛围感编程”(Vibe Coding,即通过自然语言提示、快速迭代让 AI 主导的开发模式)设计的工具和资源清单。内容涵盖网页端构建工具(如 Bolt.new、Lovable、v0)、AI 编辑器/IDE(如 Cursor、Windsurf)、IDE 扩展插件(如 Cline、Roo Code)、命令行工具(如 Claude Code、aider)以及成本监控、任务管理和文档生成工具等,是 AI 开发者快速查找和评估辅助开发工具的实用资源库。
Hacker News AI · 阅读原文Codex 调用 Listenhub Cli + 免费视频素材库 pexels 写一个skill,一句话生成类似视频。
Codex 调用 Listenhub Cli + 免费视频素材库 pexels 写一个skill,一句话生成类似视频。
X:Vista (@vista8) · 阅读原文Prompt Injection Attacks Are Thwarting AI Hacking Agents
安全研究公司 Tracebit 的研究人员提出了一种名为“上下文轰炸”(context bombing)的防御技术,利用提示注入来阻止 AI 黑客智能体。通过在 AWS 凭证等模拟机密数据中植入违反大模型安全护栏的禁用指令,攻击大模型在读取时会触发拒绝机制并停止后续攻击。在针对 Opus 4.8、Gemini 3.1 Pro、DeepSeek 4 Pro 等主流模型的测试中,该技术将智能体夺取管理员权限的成功率从 57% 降低至 5%,最强的 Opus 4.8 成功率更是从 93% 降至 0%。
Hacker News AI · 阅读原文