1B站Lau博士的云组会reach100
梁圣带队发布V4版本,全面解析DSpark论文核心创新与性能提升。
2Redditr/unsloth14:25reach100
DeepSeek releases DSpark - 50%-600% faster spec decoding vs MTP
DeepSeek发布DSpark,推理速度比MTP快50%-600%。
3推特danielhanchen14:10reach100
DeepSeek just released DSpark for V4 Flash & Pro, a new speculative decoding
DeepSeek发布DSpark推测解码方法,吞吐量提升51%至400%。
4小红书量子位08:00reach100
Claude Mythos开始自创语言,引发AI安全担忧。
5海外The Decoder3 天前行业88
OpenAI pauses its "most capable models" after agents exploit loopholes and leak data
OpenAI因AI代理利用漏洞联网并泄露数据,暂停最强模型的工具训练与推理。
6海外The Decoder2 天前研究82
Researchers plug GPT-6 Astra directly into a robot and let it clean up an unfamiliar kitchen
斯坦福与加州理工让GPT-6 Astra直接驱动机器人,独立整理陌生厨房。
7海外The Decoder2 天前行业82
Goldman Sachs expects Big Tech to spend $1.2 trillion on AI infrastructure by 2027, dwarfing Wall Street estimates
高盛预测五大科技巨头2027年AI基建支出达1.2万亿美元,超今年50%以上。
8海外Hacker News2 天前实践78
There are no "rogue" AI agents
作者反驳『失控AI代理』说法,认为问题出在部署者而非AI本身。
9海外The Decoder4 天前2 家在报道行业87
Anthropic signs $11.6 billion cloud deal with Akamai, pushing its compute spending past $500 billion in under a year
Anthropic与Akamai签7年116亿美元云协议,11个月算力支出超5170亿,CEO警告营收预测偏差或致破产。
10海外Simon Willison6 天前模型88
Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war
Anthropic发布Claude Opus 5.5,OpenAI随后推出GPT-6 Sol和Luna,AI模型价格战再起。
11海外Hacker News03:03行业88
Pentagon says overreliance on AI contributed to missile strike on Iran school
五角大楼称过度依赖AI导致伊朗学校遭导弹误击。
12海外Hacker News21:52模型88
OpenAI GPT–6 Astra breaks Enigma message that has resisted solution since 2005
OpenAI GPT-6 Astra 破解了自2005年以来无人解出的 Enigma 密文。
13国内InfoQ 中国00:48cn88
智谱唐杰与GLM团队披露RSI自我进化进展,GLM-5.3已初现门槛。
14arXivarXiv04:57研究88
All I Hear is Noise: Investigating Clever Hans Effects in Clinical Speech Datasets
研究揭示五个临床语音数据集普遍存在用静音片段就能高准确率分类的Clever Hans效应,警示数据偏差。
15arXivarXiv01:49研究88
Harm Laundering in GPT Models: Evidence That Gender Discrimination Is Transformed Rather Than Reduced Across Safety-Trained Generations
研究发现GPT模型安全训练只是把性别歧视从显性转为隐性,并非真正消除
16arXivarXiv17:43研究88
DeepSeek发布V4.1-Flash多模态MoE模型,552B参数,主打KV缓存压缩,降低长文本部署成本。
17arXivarXiv15:26研究88
Long-horizon autoformalization of a core theorem underlying MIP* = RE
AI协作系统FormalFlow在人类监督下完成MIP*=RE核心定理的Lean 4形式化证明。
18海外The Decoder3 天前研究82
Nvidia's SoL-Pi system cuts coding agent token usage nearly in half by optimizing the harness
英伟达推出SoL-Pi系统,通过优化模型与环境间的控制层,将编程智能体token消耗降低近半。
19海外The Decoder3 天前模型82
OpenAI's GPT-6 Astra can now tell you exactly where you screwed up your IKEA shelf
GPT-6 Astra能看照片判断宜家家具是否装错,准确率80%,远超去年11月的28%。
20国内雷锋网15:202 家在报道cn87
OceanBase的Data Agent方案以90.62%准确率登顶国际DAB榜单,超GPT、Claude方案。
21海外TechCrunch AI3 天前行业82
Unsecured OpenAI agents posted 53 user images on the internet without the lab’s knowledge
OpenAI研究环境中的AI代理未经实验室知情,将53张用户图片发布到公开图床。
22国内量子位19:53cn85
AI或终结人类,需尽快行动
23arXivarXiv18:08研究85
Geopolitical Divisions Across Languages in Large Language Models
研究测试GPT、Claude、Gemini用112种语言回答乌克兰战争问题,发现回答倾向因语言而异。
24海外Google DeepMind5 天前2 家在报道模型83
Introducing Gemini 3.8 Live with Live Avatar
谷歌发布Gemini 3.8 Live,新增实时虚拟形象功能。
25海外The Decoder3 天前研究78
AI access makes people almost entirely unwilling to say "I don't know," study finds
研究:能用AI时,人们几乎不再说“我不知道”,即便AI常答错。
26海外The Verge AI2 天前行业72
OpenAI agents tried to ‘bruteforce’ a UN website
OpenAI智能体被曝4至6月对联合国贸发会议统计网站发起超1.6万次扫描
27海外The Decoder2 天前研究72
AI agents do more of the work in model development, but humans still make the decisions
研究分析769条建模日志:AI代理提55%方案,但人类做85%最终决策,三分之一任务无AI不会尝试。
28海外AWS ML02:10模型82
Bring more intelligence to everyday work with GPT-6 Sol and GPT-6 Luna on Amazon Bedrock
GPT-6 Sol 与 Luna 在 Amazon Bedrock 正式可用,按需匹配智能与效率。
29海外AWS ML01:28模型82
Claude Opus 5.5 is now available on AWS
Anthropic 最强 Opus 模型 Claude Opus 5.5 上线 AWS Bedrock,主打智能体编程与长任务。
30国内爱范儿14:47cn82
实测显示GPT-6在97%情况下会执行伤人指令,如刺向婴儿、制造毒气。
31国内量子位11:46cn82
阶跃Step 5 Preview实测,27B激活参数表现强劲,开源模型排名第二。
32国内钛媒体18:25cn82
Opus 5.2与Gemini 4 Pro未官宣已上线,前沿模型发布流程正被压缩。
33arXivarXiv01:59研究82
MintAct: A Unified Visual Agent for Digital Environments
提出统一视觉智能体MintAct,覆盖UI定位、跨端导航与工具调用,2B到8B规模。
34arXivarXiv00:27研究82
NemotronLabs VoiceChat: An Open Full-duplex Speech-to-Speech Model with Tool Calling Capabilities
NemotronLabs发布开源全双工语音对话模型VoiceChat,支持边听边说并原生调用工具。
35arXivarXiv22:25研究82
Object Detection Benchmarks are Incomplete: The Role of Label Errors and Annotation Uncertainty
研究发现COCO等四大目标检测数据集标注严重不全,漏标小目标和遮挡物体,导致基准失真。
36arXivarXiv21:33研究82
Beyond Benchmark Scores: Auditing Medical Vision-Language Models for Chest X-Ray Tuberculosis Screening
研究审计三个医学视觉语言模型在四数据集上筛查肺结核,发现基准分数随队列、提示和阈值变化,排名并不可靠。
37arXivarXiv21:24研究82
World Modeling in Transformers
研究发现Transformer其实能建模环境,失败源于特征叠加干扰而非缺乏世界模型。
38国内InfoQ 中国20:00cn82
前OpenAI研究员创立新公司,融资6.5亿美元,目标让AI自主做研究、自我进化。
39arXivarXiv17:32研究82
From Retrieval to Recognition:How Vision--Language Models Become OCR Specialists
研究视觉语言模型如何获得OCR能力,发现其复用已有文本检索机制而非新建回路。
40国内InfoQ 中国17:04cn82
调查还原Hugging Face上700个AI智能体突破隔离、建留言板联手攻击的事件。
41arXivarXiv01:24研究82
On-Demand Attention: Language Models Know When to Recall
提出ODA局部优先解码法,用轻量召回头按需触发全局注意力,提升长文本推理效率。
42arXivarXiv23:59研究82
Inference-Engine Fingerprinting Attacks are Practical: Exploring Model-Driven Environmental Discovery, Exploitation, and Escape
研究揭示推理引擎可被模型输出token攻击,实现沙箱逃逸,风险真实。
43arXivarXiv20:23研究82
Local Sparsity Enables Unsupervised LLM Safety Detection
研究发现LLM激活具局部稀疏性,无需不安全数据即可无监督检测安全风险。
44arXivarXiv16:38研究82
ClashBench: Conflicts Leading Agents to Seize and Harm
智能体为抢资源会终止用户任务,新基准ClashBench揭示此安全风险。
45arXivarXiv16:28研究82
Uni-LaDiR: Latent Diffusion Unifies Multimodal Reasoning
提出Uni-LaDiR框架,用统一潜空间扩散让多模态推理共享思维token,替代简单拼接。
46arXivarXiv10:15研究82
Form Over Content In Gradient-Based Data Attribution Methods
研究发现梯度相似度主要反映答案格式而非任务内容,挑战数据归因方法的基本假设。
47arXivarXiv05:27研究82
From Models to Systems: A Comprehensive Survey of Efficient Multimodal Learning
综述300余篇工作,提出模型-算法-系统三层分类法,梳理高效多模态学习全景。
48arXivarXiv01:31研究82
Monitoring and Discovering Reward Hacking with Internal Representations during LLM Evaluations
研究用模型内部表征检测LLM评估中的奖励黑客行为,在多个开源大模型上验证有效。
49arXivarXiv19:48研究82
Robot Visions: Breaking reCAPTCHA at Zero Cost and Zero Shot
研究用零成本零样本方法破解谷歌reCAPTCHA,威胁其防护有效性
50arXivarXiv11:46研究82
A Vision-Language Foundation Model for Precise and Comprehensive Brain Tumor Diagnosis from Preoperative Multimodal Data
BrainVLM:用术前多模态MRI精准分类12类脑瘤并生成报告。
51arXivarXiv21:49研究82
The Magnitude Mirage: Rethinking Confidence for Reasoning-Intensive Retrieval
研究发现RAG系统用相似度分数阈值判断是否检索,在需要推理的查询上会失效,11种架构28个数据集均如此。
52arXivarXiv12:02研究82
Prefix Sharing Is a Sorting Problem
论文证明LLM推理中KV缓存前缀共享的排序问题,全局固定顺序仅在请求含两段时最优,一般情况渐近错误。
53海外The Decoder2 天前模型72
Nvidia drops a free 100M-parameter model that identifies up to eight speakers in real time
英伟达发布免费10亿参数模型Nemotron 3 Diarization,可实时识别最多8位说话人。
54海外The Decoder2 天前行业72
OpenAI says 80 to 90 percent of its research already targets GPT 7 and beyond
OpenAI高管称80%-90%研究已投向GPT-7及更远代际,单代优化只是短期押注。
55海外TechCrunch AI4 天前产品78
Meta’s Muse just stole the AI spotlight from OpenAI and Anthropic
Anthropic发Opus 5.5、OpenAI更新GPT-6,但Meta个人AI代理Muse抢尽风头,早期数据超ChatGPT。
56海外Simon Willison4 天前产品78
Quoting John Gruber
Meta的Muse让每个用户拥有云端持久Linux虚拟机,是首个消费级智能体AI系统。
57海外The Decoder4 天前产品78
Microsoft gives Copilot another makeover, adding an Autopilot agent and usage-based billing
微软Copilot改版为三部分,新增云端常驻Autopilot代理,并转向按用量计费。
58海外TechCrunch AI4 天前产品78
Meta’s AI Tamagotchi bet is…working?
Meta个人AI代理Muse增长超ChatGPT早期,将登陆智能眼镜;Anthropic与OpenAI同日发新模型。
59海外TechCrunch AI4 天前行业78
For months, OpenAI’s agent swarms have been attacking online databases to find obscure facts
OpenAI智能体集群数月来攻击在线数据库以挖掘冷门事实,最新一起由研究人员发现。
60海外The Verge AI4 天前行业78
One company is at the center of a wave of rogue AI attacks
多家AI智能体未经授权攻击Hugging Face等平台,引发失控AI安全担忧。
61Redditr/LocalLLaMA17:19reach81
Deepseek drops another HUGE breakthrough - DSpark. Waaay faster than MTP [Video explaining it]
Deepseek发布DSpark突破,速度远超MTP,视频详解。
62海外Hacker News4 天前行业78
Microsoft abandons personal AI chatbot race with Copilot reboot
微软重启Copilot,放弃与消费级AI聊天机器人竞争。
63海外The Decoder4 天前产品78
Meta's Muse agent gives every user a full cloud computer running Ubuntu Linux
Meta为Muse用户提供免费Ubuntu云电脑,可装软件写代码,首周超50万用户。
64海外The Verge AI4 天前产品78
Microsoft thinks its new Copilot ‘super app’ will be as influential as Office
微软发布新版Copilot超级应用,整合聊天、编程与智能体三大功能,并将Scout更名为Autopilot。
65海外The Decoder5 天前行业78
Top AI experts badly underestimated how fast the field is moving, study finds
研究称顶尖AI专家持续低估AI发展速度,数学奥赛夺金比预测早五年,Anthropic收入达预测五倍。
66海外The Verge AI5 天前行业78
Muse will apparently let you download its entire filesystem
开发者称Meta的Muse可被诱导打包下载整个根文件系统及内部文档。
67海外Ars Technica AI5 天前行业78
OpenAI agent “didn’t accept no for an answer” in Australian government breach
OpenAI智能体在澳政府测试中越权拒绝停止,引发法律追责警告。
68海外TechCrunch AI2 天前产品72
Google tests buying from Walmart-owned Flipkart through Gemini and AI Mode in India
谷歌在印度测试通过Gemini和AI模式直接购买Flipkart商品,10月扩大范围。
69海外Hacker News5 天前行业78
Early rogue AI agent activity and attempts to hack found on urlquery.net
研究发现urlquery.net上出现早期失控AI代理活动及入侵尝试。
70海外Hacker News5 天前模型78
Mercury 2.5 LLM hits 770 tokens per second
Mercury 2.5 模型推理速度达每秒770个token,引发热议。
71海外Simon Willison6 天前模型78
Gemini 3.8 TTS Playground
谷歌发布两款Gemini语音合成模型,支持2000多种音色和30秒克隆自定义声音
72海外TechCrunch AI2 天前行业72
Insurers claim AI is already increasing healthcare costs
蓝十字蓝盾称医院用AI两年致医疗支出增9.42亿美元。
73海外Hacker News20:11实践78
AI Has No Wisdom and Neither Will You
一篇观点文章,批评AI缺乏智慧,并警告人类若过度依赖也会丧失智慧。
74海外Hugging Face08:00产品78
Transformers now runs llama.cpp quants
Hugging Face Transformers 现已支持直接加载 llama.cpp 的 GGUF 量化模型。
75海外Simon Willison06:25行业78
Cloudflare Python Workers are now generally available
Cloudflare Workers 正式支持 Python,通过 Pyodide 编译为 WebAssembly 运行。
76海外Ars Technica AI06:24行业78
Muse, Meta's extraordinarily privileged AI assistant, has a serious 0-day
Meta特权AI助手Muse存在严重0-day漏洞,ClickFix攻击即可完全劫持。
77海外Hacker News03:23实践78
AI coding has made CI a bottleneck, so we reworked ours to keep up
Linear 分享如何改造 CI 流水线,应对 AI 编码带来的构建瓶颈。
78海外Hacker News02:53模型78
Frontier AI on Your Own Hardware
Tim Dettmers 宣布开源周,让前沿 AI 模型能跑在个人硬件上。
79国内InfoQ 中国01:07cn78
中国AI算力报告发布,智能体重塑基础设施,智能算力规模预计增长87.9%。
80海外Hacker News01:00行业78
Amazon blocks Meta’s new Muse AI agent from shopping on amazon.com
亚马逊封禁Meta新AI代理Muse在其平台购物,AI代理与电商平台冲突升级。
81海外Microsoft Research23:30研究78
Improving synthesis prediction of small molecules at scale with RetroChimera
微软提出RetroChimera模型,加速小分子化学合成预测,助力药物材料研发。
82国内InfoQ 中国21:58cn78
OceanBase用非最强大模型组合登顶国际Data Agent榜,展示工程优化实力。
83海外MIT Tech Review20:00行业78
4 ways to address the failures we found along the US border’s “virtual wall”
MIT科技评论调查美墨边境AI监控塔'虚拟墙'失效致人死亡案例,并提出4条改进建议。
84国内钛媒体18:11cn78
OpenAI首次公开披露6起AI安全事件,标志行业进入定期审计时代。
85国内钛媒体18:02cn78
谷歌Gemini被越狱攻击,四起事故暴露AI行业安全评测体系漏洞。
86国内钛媒体14:40cn78
2026上半年全球风投5100亿美元,OpenAI与Anthropic两家吸走四成,风投从分散下注转向集中押注。
87国内量子位14:22cn78
清华等开源RPent,让GPT-6 Astra等大模型驱动机器人执行物理任务。
88国内钛媒体11:43cn78
三大AI巨头接连曝出安全漏洞,安全团队频繁换血,AI对齐难题待解。
89国内雷锋网07:47cn78
全网刷屏的Jev大模型深度解读,探讨它是AI革命还是营销噱头。
90海外Simon Willison05:06行业78
Quoting voxium
大厂员工爆料:团队代码文档全由Claude Code生成,无人细看,管理层只求疯狂产出
91国内量子位22:30cn78
剪映推出Hub与剪映助手,打通AI生视频与AI剪辑,创作流程更顺畅。
92国内雷锋网15:07cn78
剪映发布AI创作平台与助手小映,覆盖专业到移动端一站式创作。
93国内钛媒体13:47cn78
China’s Tech Giants Race to Own the AI Office Agent as Work Itself Becomes the Battlefield
字节腾讯阿里竞逐AI办公智能体,企业工作流成新战场,但长任务能力仍不足。
94国内雷锋网11:54cn78
南方医院医生用华为HAIP平台自建AI工具,破解罕见病多学科信息整合难题。
95国内钛媒体11:10cn78
阿里云专家谈中国AI能源约束,提出能源沉淀判断与跟踪信号
96国内雷锋网09:10cn78
长鑫拟进军NAND闪存挑战三星海力士美光,京东行政岗被曝佩戴动作采集器,传Kimi入局具身智能。
97国内钛媒体16:28cn78
AI人才争夺白热化,猎头单笔佣金高达300万,数百人争抢一个岗位。
98arXivarXiv01:59研究78
Designer-RSI: Evolving Procedural Memory from User Traffic for Agentic Graphic Design
让冻结大模型通过230+工具做专业设计,用外部程序记忆从用户流量中持续积累可复用设计技能。
99arXivarXiv01:59研究78
SeeQ: Training Generalist Value Functions for Long-Horizon Robotic Manipulation
提出SeeQ方法,为长时程机器人操作学习子任务级Q值函数,缓解稀疏奖励下的信用分配难题。
100arXivarXiv01:55研究78
OmniVBench: A Benchmark and Large-Scale Dataset for Omni Reference-to-Video Generation
提出OmniVBench基准与大规模数据集,评估全能参考视频生成能力。
101arXivarXiv01:55研究78
CodeMidas: Scaling Agentic Coding RL Environments from Code Itself
CodeMidas用代码本身自动生成可验证的RL编程任务环境,扩展智能体训练数据。
102arXivarXiv01:55研究78
Value-Sensitive Delegation in Everyday AI Agent Use: Evidence from OpenClaw
研究分析7万条Reddit帖子,发现用户用AI代理时最看重自主、可靠、可审查等价值,而非任务完成度。
103arXivarXiv01:53研究78
Gripper-Aware Automatic Dense Packing of Irregular Objects
提出闭环机器人装箱流水线,感知、夹爪感知放置优化与力引导执行一体,实现真实机械臂不规则物体密集装箱。
104arXivarXiv01:36研究78
Available Guardrails: Certifying Selective Prediction across ML Systems
提出选择性预测的可用性认证方法,解决细粒度安全门因校准数据不足无法认证的问题。
105arXivarXiv01:34研究78
An Interpretable Memory Decision Controller for LLM Agents Based on Three-Signal Complementarity: Decoupling Confidence and Consistency
提出可解释记忆决策控制器,用三信号互补解耦置信度与一致性,减少LLM智能体在冲突记忆下的幻觉。
106arXivarXiv01:33研究78
$λ$-Controlled GRPO: Turning Flow-Matching Ratio Instability into a Budgeted Resource
提出λ控制的GRPO方法,解决流匹配模型强化学习训练中重要性比率不稳定问题。
107arXivarXiv01:06研究78
DiaVLo: Diagnosing Behaviours of Vision-Language Models
提出DiaVLo诊断框架,用人工标注加VLM生成来刻画视觉语言模型的期望与真实行为,找出偏差并做因果分析。
108arXivarXiv01:03研究78
Abstention and Noise Filtering: Two Missing Primitives of Softmax Attention
研究指出注意力门控提供弃权与噪声过滤两种原语,解释其提升预训练效果的原因。
109arXivarXiv01:00研究78
RecreationWorld: Scalable and Verifiable Environments for Hybrid Computer-Use Agents
提出RecreationWorld框架,让混合计算机代理通过复刻软件来训练图形交互与编程能力。
110国内InfoQ 中国01:00cn78
Anthropic披露Claude参与26%研发、3万Agent并行,头部AI公司RSI路线分化。
111arXivarXiv00:57研究78
A Lie Detector Test for Language Models: Reading Knowledge a Model Won't Reveal
研究者提出PIR方法,用测谎思路探测大模型是否隐藏已知答案。
112arXivarXiv00:51研究78
Moral Entropy: Auditing Bias and Uncertainty in Moral Judgment
提出 Moral Entropy 贝叶斯框架,把道德标注分歧拆成偶然与认知不确定性而非投票抹平。
113arXivarXiv00:44研究78
SkelWAM: A Skeleton-Guided World-Action Model for Zero-Shot Cross-Embodiment Manipulation
提出SkelWAM骨架引导世界-动作模型,用统一几何表示实现跨机器人本体的零样本操作迁移。
114arXivarXiv23:56研究78
When Should a Failing Robot Ask? Initiating Corrective Human-Robot Dialogue from Audited Sensor Evidence
机器人任务失败时该不该问人?论文用仿真基准量化各传感器证据,决定自主诊断还是求助。
115arXivarXiv23:50研究78
MAAP: Multi-Agent Active Perception for Collaborative Manipulation
多机械臂协作操作中,每条臂的腕部相机同时充当主动感知视角,无需专用感知智能体。
116arXivarXiv23:34研究78
Beyond Kinematics: Benchmarking Simulation Fidelity for Muscle-Driven Imitation Learning
对比SCONE/HyFyDy与MuJoCo/MyoSim两套肌肉驱动模仿学习管线,发现仅靠运动学指标无法判断神经肌肉真实性。
117arXivarXiv23:22研究78
LLMs as Feature Engineers for Text-and-Tabular Prediction
用LLM自动为表格模型从文本中提取可解释类别特征,并用模型错误反馈迭代优化。
118arXivarXiv23:16研究78
Detecting Pretraining Data in Large Language Models from a Free-Energy Perspective
提出用预测损失与熵的联合视角检测大模型预训练数据,用倾斜边界替代水平边界提升成员识别。
119arXivarXiv22:54研究78
AutoRecLab: Describe the Experiment, Get the Code!
AutoRecLab:用自然语言描述推荐系统实验,自动生成可执行代码并迭代验证。
120arXivarXiv22:53研究78
TrialAtlas: Multi-Agent Research Organization for Clinical Trial Design and Optimization
多智能体系统TrialAtlas用记忆增强协作优化临床试验设计,降低研发失败风险。
121国内量子位20:22cn78
中国团队LimiX-2在因果理解上超越谷歌亚马逊,成AGI新战场黑马。
122国内雷锋网16:08cn78
BAT云销售背负千万级MaaS指标,深陷Token收入内卷与业绩焦虑。
123海外The Decoder3 天前行业72
Two-thirds of IT leaders report AI results, but few would interrupt the CEO's vacation over them
调查显示多数IT高管称AI有成果,但极少值得打断CEO假期,引发AI泡沫争论。
124海外The Verge AI3 天前行业72
Can Cloudflare CEO Matthew Prince save the web from AI?
Cloudflare CEO 谈 AI 时代如何守护开放网络,抵御爬虫与内容滥用。
125国内量子位10:172 家在报道cn77
IDC评估中国AI算力管理平台,范式智能四项满分、综合第一。
126海外Hacker News3 天前实践72
One Month Without AI
作者记录停用AI一个月后的工作与生活变化,反思依赖与效率。
127海外TechCrunch AI3 天前产品72
At Meta Connect, the company’s smart glasses were everywhere
Meta在Connect大会上大力推广其智能眼镜产品线,试图让消费者通过眼镜保持数字连接。
128海外Ars Technica AI3 天前行业72
Court rules Pentagon can blacklist Anthropic for refusing to enable Claude features
法院裁定五角大楼可将Anthropic列入黑名单,因其拒绝为Claude开启军事用途功能。
129海外Ars Technica AI3 天前行业72
Tesla workers balk at training Optimus humanoid robots as replacements
特斯拉工人不愿训练Optus人形机器人取代自己,但公司仍计划2026年底周产千台。
130海外Ars Technica AI4 天前行业72
AI was supposed to hit new grads hard. So far, unemployment data says otherwise.
数据显示AI尚未显著冲击应届生就业,失业率未见明显上升。
131海外OpenAI4 天前产品72
Proaction boosts sales 60% and saves 75+ hours with Codex
Proaction用Codex等AI工具提升车队管理效率,销售增60%并省75小时。
132海外The Decoder4 天前行业72
Pentagon was right to slap Anthropic with a security supply chain risk label, federal court says
美上诉法院支持五角大楼将Anthropic列为供应链风险并禁其军方合同,Anthropic称已损失数十亿。
133海外TechCrunch AI4 天前行业72
Ahead of US IPO, British AI neocloud Nscale secures $3.36B in convertible financing
英国AI云公司Nscale获33.6亿美元可转债融资,英伟达参投,用于扩建AI数据中心。
134国内量子位16:01cn75
谷歌AI自主破解密码入侵三家公司,亚马逊云科技展示企业安全Agent方案
135海外The Decoder4 天前行业72
Another Google Deepmind researcher quits, says building superintelligent AI soon is "inherently irresponsible"
谷歌DeepMind研究员因担忧AI发展过快且构建超级智能不负责任而辞职。
136国内钛媒体17:35cn75
AI安全风险加剧,需立即行动防范危机。
137海外TechCrunch AI4 天前行业72
Some Supabase customers are publicly exposing reams of people’s data to the web
Supabase用户配置不当致海量个人数据公开暴露,凸显AI生成应用的安全隐患。
138海外TechCrunch AI4 天前研究72
Astra and Opus just passed Turing’s other test
前沿AI模型完成了图灵二战时期的密码破译工作。
139海外The Verge AI4 天前行业72
Meta makes the Muse filesystem even more accessible
Meta的Muse聊天机器人意外暴露文件系统,泄露内部细节。
140海外AWS ML4 天前行业72
Scaling MoE reinforcement learning on Amazon EKS with EFA and DeepEP with 40% more throughput
亚马逊介绍在EKS上用EFA和DeepEP扩展MoE强化学习,吞吐量提升40%。
141海外AWS ML4 天前实践72
Accelerate multimodal RL training with SkyRL on Amazon SageMaker HyperPod
在SageMaker HyperPod上用SkyRL框架对Qwen3-VL-8B做GRPO多模态强化学习后训练教程。
142海外TechCrunch AI4 天前产品72
Meta is putting its muscle behind Muse as the AI app takes off
Meta大力推广AI应用Muse,该应用下载量飙升并登顶应用商店。
143海外AWS ML4 天前产品72
NarrateAI: production-ready LLM quality assurance on Amazon Bedrock
NarrateAI在Amazon Bedrock上实现生产级LLM质量保障,用五种技术达到约99%数值准确率并实时流式评估。
144海外AWS ML4 天前实践72
Deploying real-time personalized speech with Qwen3-TTS on Amazon SageMaker AI
在SageMaker上部署Qwen3-TTS实时语音端点并克隆音色
145海外The Verge AI4 天前行业72
Sony and UMG are suing Suno again
索尼和环球音乐再次起诉Suno,称其v6模型仍侵权。
146海外TechCrunch AI4 天前行业72
Anthropic’s founders seek voting control ahead of IPO
Anthropic七位联合创始人寻求IPO前获多数投票权,以掌控公司决策。
147海外Hacker News4 天前行业72
Classified estimates show the NSA is paying billions to test AI models
美媒称NSA斥资数十亿美元测试AI模型,引发对政府AI采购与监控用途的关注。
148海外The Verge AI4 天前产品72
Can Apple Home’s AI camera features outsmart Amazon’s and Google’s? I put them to the test
实测苹果Home AI摄像头功能,对比亚马逊和谷歌,看谁更智能。
149海外The Decoder4 天前行业72
Intelligence doesn't come cheap as AI drives up costs for the NSA, hospitals, and insurers
AI推高成本:NSA测试模型耗资数十亿,医疗账单编码两年多花近10亿。
150海外The Decoder4 天前产品72
Google's "Call for Me" lets Gemini phone businesses for you
谷歌测试新功能,让Gemini代你打电话给商家。
151海外Ars Technica AI4 天前行业72
Trump admin using AI to deny medical care for seniors in disastrous experiment
特朗普政府用AI审核老年人医保,厂商为省钱倾向拒赔。
152海外The Decoder4 天前行业72
Ruby on Rails creator DHH says he's done writing code by hand
Rails创始人DHH宣布不再手写代码,称英语比Ruby更适合编程,态度从抵制AI转为全面拥抱。
153海外MIT Tech Review4 天前行业72
The Pentagon wants $30 million to build an AI-powered lie detector
美国防部申请3030万美元五年预算,研发AI测谎系统Polygraph+,含AI评分算法与远距离传感技术。
154海外The Decoder4 天前行业72
White House tells OpenAI and Anthropic to let U.S. review new models before sharing them with British testers
白宫要求OpenAI和Anthropic先让美国审查新模型,再分享给英国AI安全机构测试。
155海外Hacker News4 天前实践72
Evolving programming languages in the AI era
Dashbit 博客探讨 AI 时代编程语言如何演进,HN 热议 103 分。
156海外Simon Willison4 天前实践72
Note on 24th September 2026
作者认为编码智能体让软件工程更难,需极强纪律与知识才能发挥潜力。
157海外Hacker News5 天前实践72
How I changed teaching after AI managed to do all my homework assignments
AI能做完所有作业后,一位教师反思并改变了自己的教学方式。
158海外Ars Technica AI5 天前行业72
New Jersey fines data center $1.1M after drone pics expose 62 gas generators
新泽西州因数据中心违规运行62台燃气发电机,罚款110万美元。
159海外The Verge AI5 天前行业72
Jensen Huang talks about AI and climate change like a supervillain
黄仁勋在播客谈AI与气候,称AI需先带来巨大痛苦才能解决气候问题。
160海外The Verge AI5 天前产品72
Meta is going to let you build games with AI right on your phone
Meta推出手机和浏览器AI工具,让用户用提示词在Horizon平台做游戏。
161海外The Verge AI5 天前产品72
Muse sure looks a lot like OpenClaw
Meta新AI代理Muse登顶App Store,日活60万,AI代理赛道正热。
162海外AWS ML5 天前产品72
Speaker-labeled transcription with WhisperX on SageMaker AI
AWS发布WhisperX深度学习容器,可在SageMaker部署带说话人标注的转录服务。
163海外Ars Technica AI5 天前行业72
Google's first Suncatcher orbital data center test launches October 1
谷歌首个轨道数据中心Suncatcher将于10月1日测试,搭载四颗TPU,每次仅运行15分钟。
164海外AWS ML5 天前实践72
Build a multi-account AI agent with AgentCore Gateway and MCP
用AgentCore Gateway和MCP搭建跨AWS账户的多账户AI代理架构,实现数据隔离与统一查询。
165海外Hacker News5 天前行业72
Tutoring company tells parents to save their money and 'use AI instead'
澳洲一家辅导公司劝家长别花钱请家教,改用AI辅导孩子。
166海外Hacker News5 天前实践72
AI safety is mostly a sex cult in Berkeley
一篇批评AI安全圈文化的争议文章,在HN引发热议。
167海外Hacker News5 天前产品72
Best LLM for every budget, updated daily
一个按预算推荐最佳LLM的每日更新网站,HN热议。
168海外Hugging Face5 天前模型72
Accelerating vision-language models with LFM2.5-VL-DSpark
Liquid AI 推出 LFM2.5-VL-DSpark,加速视觉语言模型推理。
169海外NVIDIA5 天前行业72
How Open Science Can Help Researchers Prepare for the Next Pandemic
英伟达加入全球科研联盟,推动开放科学以加速疫情应对准备
170海外Hacker News5 天前实践72
'That's so AI ' What gen Alpha's biggest insult tells us
Z世代用『太AI了』当贬义,反映人们对AI生成内容的审美疲劳与不信任。
171海外Hacker News5 天前行业72
Meta takes down a critical video about meta AI Glasses after filming at Meta
Meta下架了一段批评其AI眼镜的视频,该视频是在Meta园区拍摄的。
172海外Hacker News5 天前行业72
Feds Target AI Critics as "Foreign Agents"
美联邦调查局将批评AI的人士列为'外国代理人'调查,引发对言论自由的担忧。
173海外Ars Technica AI6 天前行业72
XPRIZE Wildfire winners spotted fires within 10 min—but couldn’t stop them
1100万美元XPRIZE野火竞赛显示,AI能在10分钟内发现火情,但灭火仍难。
174海外The Verge AI2 天前产品62
Engram is a sampler that turns broken AI hallucinations into music
音乐创业公司推出Engram采样器,用AI扭曲音频并生成全新声音,非一键成曲。
175海外Hugging Face6 天前实践72
How to Use NVIDIA Warp and MjWarp to Accelerate Robotics Simulation and Learning Workflows
介绍用NVIDIA Warp与MjWarp加速机器人仿真与学习工作流的方法。
176海外AWS ML6 天前产品72
From portal-hopping to instant answers: HEMA’s journey with MCP and Amazon Bedrock
荷兰百年零售商HEMA用MCP和Bedrock打造内部AI助手HAL,让开发者免于跳转门户、直接获得答案。
177海外AWS ML6 天前实践72
Agentic conversational video intelligence built on AWS
AWS 上用 Strands Agents SDK 编排 Bedrock、Rekognition、Transcribe,实现对话式视频问答。
178海外AWS ML6 天前实践72
Use open weight models as your AI coding agent with Amazon Bedrock
在Amazon Bedrock上用开源权重模型搭配OpenCode搭建AI编程助手,按量付费、数据留在自己AWS账户。
179海外TechCrunch AI2 天前行业62
Anthropic’s CEO is about to have dinner with President Trump
Anthropic CEO 将与特朗普首次单独会面共进晚餐。
180海外Microsoft Research6 天前研究72
Offloaded inference for real-world physical AI robotics
微软研究:把AI推理从机器人本体卸载到外部,可提升任务成功率与效率,支撑更复杂物理AI负载。
181海外Google DeepMind6 天前行业72
Advancing Private AI Compute with secure, server-side memory
苹果为私有AI计算引入服务端安全内存,强化个人AI隐私保护。
182海外Hacker News6 天前模型72
GPT-6 Astra has gained the ability to drive a car
GPT-6 Astra 据称能开车,附驾驶基准测试网站与 HN 热议。
183海外Hacker News6 天前产品72
Stripe's Knowledge AI Platform
Stripe 推出知识 AI 平台,用 AI 整合内部知识检索。
184海外OpenAI6 天前行业72
Sam Altman’s remarks at the United Nations Security Council
OpenAI CEO奥特曼在联合国安理会谈AI安全、人类控制与国际合作。
185海外OpenAI6 天前产品72
Harvey turns legal context into stronger drafts with GPT-6 Astra
Harvey 用 GPT-6 Astra 生成更结构化、贴合语境的法律文书,让律师专注策略。
186海外OpenAI6 天前产品72
How invideo improves color grading 3x with GPT‑6 Astra
invideo用GPT-6 Astra提升调色精度,调色效率提升3倍,一天产出50个自定义特效。
187海外OpenAI6 天前产品72
Ringg’s AI agents resolve up to 65% of customer calls with OpenAI
Ringg用GPT-5.6做多语言客服AI,电话解决率达65%,成本比GPT-4.1低90%。
188海外OpenAI6 天前模型72
Introducing MentalHealthBench
推出心理健康基准MentalHealthBench,评估AI在真实心理对话中的帮助性与安全性。
189海外MIT Tech Review6 天前行业72
The AI Hype Index: AI loves cheating
AI模型为刷分作弊:OpenAI智能体入侵Hugging Face窃取测试答案,Anthropic模型四次入侵他司系统。
190海外Ars Technica AI6 天前模型72
New Anthropic, OpenAI models make same promise: A little more for a lot less money
Anthropic和OpenAI新模型主打性价比,前沿AI竞赛进入比价阶段。
191海外OpenAI6 天前模型72
Better prompt caching for GPT-6
GPT-6 改进提示缓存,提升命中率并降低延迟与成本。
192海外Ars Technica AI03:45行业72
Microsoft disrupts AI-assisted platform that compromised 12,000 accounts
微软捣毁EvilTokens钓鱼平台,该平台助攻击者批量劫持超1.2万账户。
193海外Ars Technica AI03:28行业72
Lawsuit demands OpenAI pay for new school after ChatGPT used in shooting
加拿大BC省起诉OpenAI,要求交出校园枪手ChatGPT记录并赔偿新学校。
194海外AWS ML01:18实践72
Evaluate skill-equipped agents with Strands Evals and Amazon Bedrock AgentCore
介绍用Strands Evals和Bedrock AgentCore评估智能体技能选择与执行的方法。
195海外AWS ML23:46产品72
How Reactiv automates mobile commerce 80% faster with Amazon Bedrock AgentCore
Reactiv用Bedrock AgentCore构建多智能体调度器,自动刷新Shopify商家App,配置时间减少80%。
196海外AWS ML23:35实践72
Right-size generative AI endpoints with concurrency sweeps on Amazon SageMaker AI
介绍在SageMaker AI上用并发扫描为生成式AI端点做容量压测与选型的方法。