1 B站 Lau博士的云组会 reach 100
梁圣带队发布V4版本,全面解析DSpark论文核心创新与性能提升。
2 Reddit r/unsloth 14:25 reach 100
DeepSeek releases DSpark - 50%-600% faster spec decoding vs MTP
DeepSeek发布DSpark,推理速度比MTP快50%-600%。
3 推特 danielhanchen 14:10 reach 100
DeepSeek just released DSpark for V4 Flash & Pro, a new speculative decoding
DeepSeek发布DSpark推测解码方法,吞吐量提升51%至400%。
4 小红书 量子位 08:00 reach 100
Claude Mythos开始自创语言,引发AI安全担忧。
5 机智流 + 关注 21:28 模型 92
中国团队开源首个小时级实时交互世界模型,实现无限世界触手可及。
6 新智元 + 关注 18:45 模型 92
中国团队用单张4090显卡15小时训练机器人搭起8万块积木长城,刷新效率纪录。
7 Agent101 + 关注 13:40 模型 92
一句指令让AI自主运行5天生成Excel,自主时长从分钟跃迁到天。
8 机器之心 + 关注 07:18 产品 92
GPT-5.6上线,Codex合并,ChatGPT Work发布,提升生产力。
9 海外 The Decoder 01:59 产品 92
OpenAI发布GPT-5.6和ChatGPT Work智能体,可跨应用处理复杂工作流。
10 海外 Hacker News 01:04 模型 92
OpenAI发布GPT-5.6,带来模型能力与安全部署更新。
11 海外 The Verge AI 01:00 模型 92
OpenAI rolls out GPT-5.6 after government greenlight — and announces ‘ChatGPT Work’
OpenAI获政府批准后发布GPT-5.6,并推出‘ChatGPT Work’功能。
12 夕小瑶科技说 + 关注 00:22 模型 92
Meta发布Muse Spark 1.1,Agent能力对标Opus 4.8,价格仅为其六分之一。
13 国内 量子位 17:27 2 家在报道 cn 90
百度搭子日均提问暴增20倍,宣布重磅升级并发布企业版。
14 新智元 + 关注 13:36 2 家在报道 行业 90
诺奖得主、美联储前主席伯南克加入Anthropic,担任经济顾问。
15 海外 TechCrunch AI 08:16 2 家在报道 产品 90
OpenAI says GPT 5.6 is the ‘preferred model’ for Microsoft Copilot 365 amid breakup chatter
OpenAI称GPT-5.6是微软Copilot 365首选模型,回应拆分传闻。
16 海外 MIT Tech Review 04:22 研究 90
Anthropic found a hidden space where Claude puzzles over concepts
Anthropic 开发新工具,首次清晰揭示大模型内部运作机制。
17 海外 TechCrunch AI 03:05 2 家在报道 行业 90
《纽约时报》指控OpenAI在版权诉讼中隐藏证据,要求制裁。
18 海外 TechCrunch AI 02:40 2 家在报道 行业 90
Google will now disclose which ads are made with AI
谷歌将要求所有AI生成广告标注披露,扩大透明度规则。
19 国内 InfoQ 中国 21:21 cn 88
Claude用11天重写Bun核心代码,创始人谨慎评估一个月后公开。
20 国内 钛媒体 19:02 cn 88
SK海力士凭借HBM技术取代三星成为AI存储霸主,揭示技术路线选择与长期投入的价值。
21 国内 钛媒体 18:39 cn 88
腾讯混元Hy3正式版开源,实测三个真实任务表现惊艳。
22 国内 钛媒体 18:39 cn 88
AI算力链颠覆不在晶体管,而在光互联与去DSP,Hi-ONE开辟新赛道。
23 算力百科 + 关注 18:06 行业 88
中国启动第二套全国产十万卡AI超集群,引领国产算力新时代。
24 机器之心 + 关注 17:19 研究 88
北大提出HOI-Edit基准与SCPE自纠错框架,推动图像编辑进入交互理解时代。
25 量子位 + 关注 17:13 产品 88
许锦波团队发布MoleculeOS,开启AI生物研发操作系统时代。
26 国内 雷锋网 16:41 cn 88
OpenAI安全元老离职,白宫政策专家加入,权力重心从技术安全转向政商博弈。
27 国内 雷锋网 15:22 cn 88
追觅进军无人机,大疆跨界扫地机,两大科技巨头双向奔赴,重新定义智能硬件边界。
28 国内 雷锋网 15:09 cn 88
追觅科技创始人俞浩谈如何以核心技术打破国际垄断,成为全球扫地机销量第一。
29 机器之心 + 关注 13:00 模型 88
具身智能大模型从数字能力嫁接迈向物理世界原生设计的新阶段。
30 机器之心 + 关注 13:00 研究 88
首个无监督、可解释的图异常检测方法,用于多智能体系统安全防御。
31 机器之心 + 关注 10:30 研究 88
北大与福大团队提出LIMSSR框架,解决AI评价中训练数据模态缺失问题。
32 国内 爱范儿 10:26 cn 88
OpenAI合并ChatGPT与Codex推出ChatGPT Work,GPT-5.6发布,Claude面临竞争压力。
33 国内 钛媒体 09:44 cn 88
OpenAI发布GPT-5.6并整合Codex,Claude重置用户限额。
34 算力百科 + 关注 06:00 行业 88
AI算力赛道出现“围城”现象:大模型公司自研芯片,AI芯片公司自研CPU,但都受制于工厂产能。
35 夕小瑶科技说 + 关注 05:40 产品 88
GPT5.6上线之夜,Codex亡!
OpenAI将Codex并入ChatGPT桌面端,打造全能AI工作入口。
36 海外 The Decoder 02:37 模型 88
GPT-5.6 Sol nearly matches Fable 5 on aggregated benchmarks at one-third the cost
GPT-5.6 Sol 性能接近 Claude Fable 5,成本仅为其三分之一。
37 海外 TechCrunch AI 22:51 行业 88
Anthropic, OpenAI, and SpaceX are bigger than the last 25 years of tech exits
Anthropic、OpenAI和SpaceX的IPO将创造比过去25年所有美国风投退出更大的价值。
38 国内 InfoQ 中国 21:56 cn 88
Claude模型内部出现类似人类意识的隐藏工作空间,获谷歌DeepMind权威认证。
39 机器之心 + 关注 21:36 模型 88
DM0.5通过零样本、长记忆与抗干扰能力,将VLA模型推进到真实世界应用。
40 arXiv arXiv 01:53 研究 88
提出机构红队评估方法,证明部署规则而非仅模型本身因果影响多智能体AI安全。
41 arXiv arXiv 01:19 研究 88
Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops
综述AI递归自我改进的四种层次:从行为优化到自主研究循环。
42 arXiv arXiv 01:04 研究 88
研究RL后训练能否将基础模型中的原始技能组合成新的高级推理策略。
43 arXiv arXiv 00:20 研究 88
提出CARLA-GS框架,解耦表征、推理与物理模拟,用于自动驾驶边缘案例合成。
44 arXiv arXiv 18:51 研究 88
Billions of Sketches Reveal Hidden Cultural Variation in Human Concepts
通过26亿幅涂鸦揭示人类概念的文化差异,挑战概念普遍性假设。
45 arXiv arXiv 11:40 研究 88
综述LLM与生成式AI在网络安全中的双重用途风险、恶意软件生成及防御策略。
46 arXiv arXiv 06:19 研究 88
WildCity是一个覆盖数十平方公里、多模态的真实城市数据集,用于推动大规模空间智能研究。
47 arXiv arXiv 00:55 研究 88
Pitwall: Faithful Natural-Language Race-Strategy Briefings from a Calibrated Real-Time Monte Carlo Engine
Pitwall系统实时生成F1策略简报,确保每句话都基于概率引擎验证的事实。
48 arXiv arXiv 00:43 研究 88
新基准DataGovBench用政府开放数据评估LLM在复杂多表、外部知识整合等真实数据分析场景的能力。
49 arXiv arXiv 22:30 研究 88
提出教师对齐修复方法,统一扩散模型剪枝与步蒸馏,降低推理成本。
50 arXiv arXiv 19:52 研究 88
MobileWan: Closing the Quality Gap for Mobile Video Diffusion
提出5B参数视频扩散模型可在手机高效部署,打破移动端质量瓶颈。
51 arXiv arXiv 16:50 研究 88
提出首个后训练、免训练的24位载荷代码水印方案,兼具鲁棒性保证。
52 arXiv arXiv 14:59 研究 88
More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges
研究发现,自博弈训练让AI更会“说服”评判者,而非真正提升正确率。
53 arXiv arXiv 14:23 研究 88
Harrison.Rad 1.5 Technical Report: A radiology foundation model that can draft reports from images, priors and clinical context
放射学基础模型HR1.5可从图像、病史和临床背景自动生成报告,缓解放射科工作积压。
54 arXiv arXiv 10:42 研究 88
提出Image2Sim框架,从RGB-D图像实时生成高保真交互环境,解决具身导航仿真规模与真实感矛盾。
55 arXiv arXiv 10:11 研究 88
提出工业级CAD智能体ArtisanCAD,通过专家知识蒸馏解决模糊指令下的参数化建模难题。
56 arXiv arXiv 01:56 研究 88
What Does a Discrete Diffusion Model Learn?
离散扩散模型学习的是去噪器、分数比还是桥接预测器?在跳变率层面,它们是同一对象的不同坐标。
57 arXiv arXiv 01:55 研究 88
提出双向对齐具身智能框架Cortex,解决长时域操作任务中高层规划与底层执行的语义鸿沟。
58 arXiv arXiv 22:56 研究 88
AgentGym2: Benchmarking Large Language Model Agents in De-Idealized Real-World Environments
提出AgentGym2基准,在非理想化真实环境中评估LLM代理,弥补现有简化基准的不足。
59 arXiv arXiv 22:39 研究 88
EdgeBench: Unveiling Scaling Laws of Learning from Real-World Environments
研究发现智能体在真实环境中学习遵循对数S型缩放定律,性能可预测提升。
60 arXiv arXiv 22:07 研究 88
论文提出AI智能体面临的新型数据注入攻击,威胁远超指令注入。
61 arXiv arXiv 19:15 研究 88
Closing the Reality Gap: Zero-Shot Sim-to-Real Deployment for Dexterous Force-Based Grasping and Manipulation
提出零样本模拟到真实部署的灵巧抓取方法,利用密集触觉与关节扭矩传感实现物理交互控制。
62 arXiv arXiv 16:51 研究 88
提出CritiqueDriveVLM框架,通过验证器引导强化学习与潜在思维蒸馏,解决自动驾驶VLM的推理幻觉与延迟问题。
63 arXiv arXiv 15:27 研究 88
Beyond Scene Priors: Fine-Grained Traffic Scene Reasoning with Benchmarking and Query-Guided Small-Object Focus
提出细粒度交通场景推理方法,解决多模态大模型忽视小目标的问题。
64 arXiv arXiv 11:43 研究 88
首个针对MoE大模型的知识产权保护水印方案PathMark。
65 arXiv arXiv 00:56 研究 88
提出布局感知注意力偏置与模态平衡损失,解决密集遮挡场景下扩散模型生成物体数量不准的问题。
66 arXiv arXiv 21:01 研究 88
Beyond Document Grounding: Span-Level Hallucination Detection over Code, Tool Output, and Documents
提出首个跨代码、工具输出、结构化文档的细粒度幻觉检测统一基准。
67 国内 InfoQ 中国 01:49 cn 85
AI创业的核心优势并非技术,而是深耕多年的行业经验。
68 国内 InfoQ 中国 22:10 cn 85
GPT-5.6与Claude Fable 5竞争加剧,ChatGPT Work成超级应用,Altman澄清不取代Coedx。
69 国内 InfoQ 中国 21:14 cn 85
AI 工具正颠覆 GitHub 传统模式,Cursor、GitLab、Zed 等展开竞争。
70 Agent101 + 关注 19:35 实践 85
美国AI研究员走访中国实验室后指出,中美AI差距在算力、人才和基础设施等慢变量。
71 海外 The Decoder 19:09 产品 85
Bun ditches Zig for Rust with help from Claude Fable 5, writes over a million lines of code in 11 days
Bun 用 11 天从 Zig 重写为 Rust,Claude Fable 5 协助生成超百万行代码。
72 智猩猩AI + 关注 19:07 模型 85
NVIDIA开源200多个Agent技能,提升Claude Code在GPU领域的专业能力。
73 国内 钛媒体 19:02 cn 85
AI医疗热潮暗藏骗局风险,警惕硅谷式浮躁。
74 新智元 + 关注 18:45 模型 85
OpenAI发布新模型无需政府批准,奥特曼此前言论遭反转。
75 国内 钛媒体 18:41 cn 85
四大存储巨头技术路线与市场格局硬核对比。
76 国内 雷锋网 18:37 cn 85
北森CEO纪伟国谈AI转型挑战,推出AI HR平台Mavens,从混沌到清晰。
77 国内 钛媒体 18:20 cn 85
MiniMax股价两天暴跌24%,引发行业对AI公司估值和盈利模式的担忧。
78 国内 钛媒体 18:20 cn 85
探讨AI自进化前沿,揭示硅谷模型竞争关键。
79 国内 钛媒体 18:20 cn 85
中国大模型厂商在等待解禁期间加速技术迭代,探索差异化路径。
80 国内 钛媒体 18:13 cn 85
Momenta上市获近30亿港元认购,标志物理AI进入规模化发展期。
81 国内 量子位 17:45 cn 85
自动驾驶团队将数据闭环技术应用于睡眠监测,跨界创新。
82 机器之心 + 关注 17:19 产品 85
百度全面升级智能体平台,目标让Agent承担人类90%以上工作。
83 机器之心 + 关注 17:19 行业 85
中国AI算力迈入十万卡时代,行业标准争夺战开启。
84 量子位 + 关注 17:13 会议 85
第三届蚂蚁InTech奖申报7天后截止,图灵奖得主参与评审。
85 新智元 + 关注 17:11 产品 85
国内首个纯中文AI音乐模型发布,已接入抖音。
86 新智元 + 关注 17:11 产品 85
GPT-Live语音交互功能获奥特曼称赞,网友热议AI对话体验。
87 海外 MarkTechPost 16:52 模型 85
Google Research Introduces SensorFM: A Wearable Health Foundation Model Pretrained on One Trillion Minutes of Sensor Data
谷歌发布可穿戴健康基础模型SensorFM,基于1万亿分钟传感器数据预训练。
88 国内 雷锋网 16:46 cn 85
云巨头斥巨资组建驻场AI团队,从标准化转向深度定制化服务。
89 国内 雷锋网 16:38 cn 85
AI芯片公司Etched获近60亿融资,推专用Transformer芯片Sohu,性能远超英伟达H100。
90 国内 雷锋网 16:35 cn 85
苹果Vision Pro副总裁跳槽OpenAI,或因CEO换任后变相降级。
91 海外 OpenAI 15:00 行业 85
How Deutsche Telekom is rewiring telecommunications with AI
德国电信用AI重塑客服、网络与员工流程,迈向AI原生运营商。
92 半导体前沿 + 关注 14:45 行业 85
晶合集成在港交所上市,市值近700亿,成为全球领先的12英寸晶圆代工企业。
93 半导体前沿 + 关注 14:45 行业 85
Chiplet与CPO技术加速落地,成AI算力升级核心路径。
94 国内 雷锋网 14:38 cn 85
无界动力K15获全球首个工业级全域CE认证,开启批量交付。
95 量子位 + 关注 14:20 产品 85
AI Agent制作PPT能力登顶Hugging Face榜首,效率惊人。
96 AI前线 + 关注 13:42 模型 85
Meta发布最强Agent模型,进军编程领域。
97 AI前线 + 关注 13:42 行业 85
开源模型流量领先,但Anthropic等闭源模型收入更高。
98 新智元 + 关注 13:36 研究 85
MIT提出FrontierOR基准,评估大模型求解工业级优化问题的能力。
99 国内 量子位 12:44 cn 85
字节跳动发布十亿参数AI华语歌模型,显著提升音乐自然度。
100 海外 MarkTechPost 12:38 模型 85
Meet LingBot-World-Infinity: An Open Causal World Model With An Agentic Harness
蚂蚁集团发布14B因果视频生成世界模型LingBot-World-Infinity,支持交互式模拟。
101 国内 钛媒体 12:30 cn 85
MiniMax大模型获三大拐点支撑,价值重估开启。
102 智猩猩AI + 关注 12:29 模型 85
开源Agent Harness项目超越Fable5,并大幅降低Token成本。
103 量子位 + 关注 11:52 产品 85
新型机器人手展示惊人灵巧性,能完成多种精细操作。
104 国内 雷锋网 11:48 cn 85
灵睿智芯获数亿元融资,将量产高性能RISC-V处理器,填补国内空白。
105 cc-codex实践 + 关注 10:47 模型 85
GPT-5.6 正式发布,Sol/Terra/Luna 三档模型按能力与价格分级,方便用户按需选择。
106 机器之心 + 关注 10:30 模型 85
杭州公司推出更懂中文的AI音乐大模型,提升创作体验。
107 AI液冷全链条产业链 + 关注 10:05 行业 85
酷冷至尊全栈液冷产品成英伟达算力规模化关键支柱。
108 国内 钛媒体 09:21 cn 85
阿里云转向AI驱动,从卖流量变为卖Token,开启新增长叙事。
109 一石一泉一松一月一人 + 关注 08:47 行业 85
十五五碳达峰方案设定硬性指标,利好新能源与高耗能改造行业。
110 量子位 + 关注 08:25 研究 85
清华AI数学家能自主从想法推导出定理,并参与完成84页量子算法论文。
111 海外 The Verge AI 08:04 行业 85
微软2025年碳排放增长25%,气候目标面临挑战。
112 海外 TechCrunch AI 07:38 行业 85
Fidji Simo steps down from OpenAI’s No. 2 role
OpenAI二号人物Fidji Simo因医疗休假超预期而卸任全职职务。
113 Andy730 + 关注 07:37 行业 85
NVIDIA Vera CPU的技术设计与商业策略深度解析。
114 国内 钛媒体 07:20 cn 85
国务院部署碳达峰任务,微信更新AI功能,多家科技公司发布新产品。
115 国内 钛媒体 07:17 cn 85
OpenAI战略转向,Meta芯片量产,Anthropic治理革新,全球AI生态加速碎片化。
116 新智元 + 关注 07:15 模型 85
OpenAI发布GPT-5.6系列模型,Codex被整合进ChatGPT。
117 新智元 + 关注 07:15 模型 85
Meta发布低成本高性能模型,挑战Grok 4.5。
118 大饶不老 + 关注 06:51 模型 85
五款终端Agent深度对比,拆解效率、成本、可靠性与易用性。
119 一石一泉一松一月一人 + 关注 06:40 行业 85
半导体涨价到头后,扩产成为主线,设备和材料受益。
120 海外 TechCrunch AI 06:08 行业 85
An AI agent startup just let its agent run its $100M fundraise
AI初创公司Lyzr用自家AI代理完成1亿美元融资,证明产品实力。
121 海外 TechCrunch AI 05:47 行业 85
Can AI answer the $3 trillion question?
AI能否带来3万亿美元回报?投资回报率争议再起,后果更严重。
122 海外 Ars Technica AI 05:25 产品 85
OpenAI wants its new tool to do your work for you and with you
OpenAI推出可独立运行数小时的Codex工具,旨在自动化工作流程。
123 夕小瑶科技说 + 关注 04:57 模型 85
GPT-5.6跑分领先但实际体验不如Fable 5,引发AI评测标准讨论。
124 海外 Hacker News 04:51 产品 85
Building a real-time AI tutor for 5-year-olds
一家创业公司分享为4-9岁儿童构建实时AI辅导老师的技术挑战与架构创新。
125 海外 Ars Technica AI 04:12 研究 85
Humanoid robots controlled by surgeons did world-first operation on live pigs
外科医生远程操控人形机器人首次在活猪上完成手术,验证可行性。
126 海外 MarkTechPost 03:31 模型 85
Meet Nemotron Labs 3 Puzzle 75B A9B: A Compressed Hybrid MoE LLM Delivering 2.03x Server Throughput
英伟达发布压缩版MoE模型Nemotron-75B,吞吐量提升2倍。
127 海外 TechCrunch AI 02:34 行业 85
Paris-based AI voice startup Gradium raises $100M seed, backed by Nvidia
巴黎AI语音初创Gradium获1亿美元种子轮融资,英伟达参投,将进军硅谷。
128 海外 TechCrunch AI 02:22 行业 85
How did the government decide OpenAI’s frontier model was safe to release?
揭秘美国政府如何评估OpenAI前沿模型安全性的决策过程。
129 海外 TechCrunch AI 01:17 行业 85
Meta’s new AI chips will begin production in September
Meta计划9月量产自研AI芯片,采用模块化设计应对快速变化的需求。
130 海外 TechCrunch AI 01:06 行业 85
Nvidia is a victim of the compute marketplace it created
英伟达创造高价值计算市场,却成为自身成功的受害者。
131 海外 The Decoder 00:58 行业 85
Meta's Muse Spark 1.1 API pricing squeezes OpenAI and Anthropic as the AI price war heats up
Meta推出Muse Spark 1.1 API,定价远低于OpenAI和Anthropic,加剧AI价格战。
132 海外 Microsoft Research 00:46 模型 85
微软发布Aurora 1.5,新增22个变量、小时级分辨率与概率集合预报,提升天气与地球系统应用能力。
133 海外 AWS ML 00:40 实践 85
MCP tool design: Practical approaches and tradeoffs
MCP工具设计常见错误与上下文工程修复方法
134 Shire AI实验室 + 关注 23:40 产品 85
Claude推出使用体检报告功能,帮助用户反思复盘AI交互。
135 Datawhale + 关注 23:38 实践 85
李飞飞预测10年后AI将取代多数工作,仅剩两类工作者。
136 机智流 + 关注 22:29 研究 85
阿里NapMem让AI智能体主动查询结构化记忆,解决遗忘问题。
137 国内 钛媒体 22:28 cn 85
英伟达股价反弹,SpaceX新AI模型或助涨势延续。
138 GiantPandaLLM + 关注 22:27 研究 85
SGLang推出DSpark,一种置信度驱动、可变长度验证的推测解码方法,提升推理效率。
139 机器之心 + 关注 21:36 模型 85
快手与浙大开源MobileForge,实现GUI Agent无标注自优化闭环。
140 海外 The Decoder 21:23 模型 85
OpenAI发现热门AI编程测试SWE-Bench Pro中约30%的任务存在缺陷,已撤回背书。
141 海外 TechCrunch AI 21:00 行业 85
Popular open source AI developer tool Ollama raises $65M, grows to nearly 9M users
Ollama获6500万美元融资,用户近900万,成热门AI开发工具。
142 国内 量子位 20:18 cn 85
原力灵机发布DM0.5模型,零样本性能提升31%,基于15万小时数据训练。
143 arXiv arXiv 01:59 研究 85
提出深度原生结构推理方法,实现跨学科材料属性精准预测。
144 arXiv arXiv 01:55 研究 85
提出Jailbreak方法,通过直接读取数据库存储文件绕过传统驱动,实现高性能列式分析。
145 arXiv arXiv 01:49 研究 85
Agent Delivery Engineering Predictive Reliability Framework
提出ADE-PRF框架,通过20种信号预测LLM多智能体系统可靠性,实现8小时前瞻。
146 arXiv arXiv 01:34 研究 85
发布最大开源技能库SkillCenter,含21.6万结构化技能,提升AI代理操作正确性与安全性。
147 arXiv arXiv 01:33 研究 85
提出面向具身智能的MoE视频预训练范式LingBot-Video,平衡建模能力与推理效率。
148 arXiv arXiv 01:32 研究 85
针对GRPO在难题上梯度消失,提出自适应前缀控制方法AdaPrefix-GRPO,将成功率稳定在50%附近。
149 arXiv arXiv 01:26 研究 85
提出MedPMC框架,将PMC文献自动转化为高保真医学多模态数据,支持基础模型训练。
150 arXiv arXiv 01:24 研究 85
Does Bielik Know What It Doesn't Know? Activation Dispersion Separates Entity Familiarity from Factual Reliability Across Model Scale
研究通过激活分散度检测大模型对实体的熟悉度,预测事实可靠性。
151 arXiv arXiv 01:24 研究 85
DiaLLM: An Investigation into the Robustness-Generation Gap in English Dialect Adaptation
研究揭示大模型理解方言但生成仍偏标准英语,提出DiaLLM框架实现跨方言可控生成。
152 arXiv arXiv 01:22 研究 85
三层分层记忆架构突破大模型上下文限制,实现长期多智能体连续自主运行。
153 arXiv arXiv 00:43 研究 85
提出未来置信蒸馏方法,利用回答过程中的时序置信信息提升LLM置信估计可靠性。
154 arXiv arXiv 00:29 研究 85
Towards Agentic AI Governance: A Preliminary Assessment
系统综述自主AI治理的挑战与优先事项
155 arXiv arXiv 00:26 研究 85
提出LaMem-VLA,将双潜记忆融入VLA模型,解决长时域任务中历史经验与多模态推理脱节问题。
156 arXiv arXiv 00:04 研究 85
提出STRMSR框架,利用参考视图和记忆实现心脏MRI跨平面超分辨率重建。
157 arXiv arXiv 23:41 研究 85
提出SonoRank,实现无需校准的前臂超声手指屈曲检测,提升假肢控制实用性。
158 arXiv arXiv 23:33 研究 85
Infinite Worlds with Versatile Interactions
LingBot-World 2.0 实现无限交互、60fps实时响应与更丰富动作。
159 arXiv arXiv 23:21 研究 85
提出基于马氏距离的统一AI内容检测框架,适用于文本、幻觉、水印及对抗样本检测。
160 arXiv arXiv 22:58 研究 85
提出4.5M参数基础模型TimEE,通过上下文学习实现端到端时间序列分类。
161 海外 The Verge AI 21:11 2 家在报道 产品 83
Character.AI wants a piece of the microdrama pie
Character.AI推出短剧平台c.ai Series,进军微短剧市场。
162 国内 钛媒体 18:20 cn 82
对比智谱与MiniMax在港股表现,分析AI稀缺性溢价逻辑的转变。
163 国内 InfoQ 中国 18:00 cn 82
vLLM在多模态模型推理中的优化实践分享。
164 国内 雷锋网 11:58 cn 82
英特尔智能体PC概念提出仅两个半月,七家合作伙伴展示应用,但落地深度仍存疑。
165 国内 雷锋网 11:23 cn 82
追觅割草机器人上半年全球销售额环比增长248%,欧洲稳增、北美爆发。
166 国内 雷锋网 10:14 cn 82
海尔发布专为女性长辈设计的轻量化外骨骼W3,搭载AFI系统,适配娇小身形。
167 国内 雷锋网 09:15 cn 82
顺网科技与支付宝合作推出云电竞舱,通过“碰一下”实现无人值守运营,降低线下电竞成本。
168 国内 钛媒体 08:11 cn 82
Unchecked Reliance on AI is Upending Corporate Workflows
AI幻觉正悄然颠覆企业工作流,盲目依赖导致账户丢失、代码损坏与合规失败。
169 海外 TechCrunch AI 03:40 产品 82
Meta enters the crowded AI coding battle with Muse Spark 1.1
Meta发布Muse Spark 1.1,主打企业级代码自动化与大规模迁移能力。
170 国内 InfoQ 中国 00:18 cn 82
探讨AI基础设施的核心竞争要素与发展方向。
171 国内 InfoQ 中国 00:15 cn 82
本文介绍在百万级上下文场景下,使用SGLang对DeepSeek V4进行推理优化的实战经验。
172 机智流 + 关注 22:29 会议 82
CSDI峰会探讨Agentic AI落地,智能体将重塑生产力。
173 海外 The Verge AI 22:00 模型 82
Meta says its new AI model is ready to compete on coding
Meta发布Muse Spark 1.1模型,提升编码能力并开放API。
174 国内 雷锋网 21:03 cn 82
移远通信发布自研AI+AR眼镜Hawk系列及算力单元Dolphin,全面入局XR赛道。
175 Reddit r/LocalLLaMA 17:19 reach 81
Deepseek drops another HUGE breakthrough - DSpark. Waaay faster than MTP [Video explaining it]
Deepseek发布DSpark突破,速度远超MTP,视频详解。
176 海外 The Decoder 20:19 2 家在报道 产品 80
OpenAI关停AI浏览器Atlas,将其功能整合进ChatGPT的Chrome扩展。
177 海外 The Verge AI 21:20 行业 78
Would you host part of an AI data center in your home?
太阳能公司Sunrun试点在用户家中部署AI算力节点,以分布式方式参与数据中心建设。
178 国内 InfoQ 中国 19:32 cn 78
探讨AI智能体面临安全挑战时,企业应构建的防御体系与应对策略。
179 国内 钛媒体 12:30 cn 78
MiniMax面临解禁挑战,但尚未到验证实力的关键时刻。
180 海外 The Verge AI 04:34 行业 78
The ChatGPT browser is already dead
OpenAI 宣布关停其浏览器产品 ChatGPT Atlas,距发布不到一年。
181 海外 TechCrunch AI 01:56 实践 78
教你如何阻止Meta用你的Instagram照片训练AI。
182 海外 AWS ML 00:38 产品 78
AWS为SageMaker HyperPod推理新增五项企业级功能,提升性能与集成度。
183 海外 Hacker News 23:50 实践 78
AI内容在LinkedIn等社交媒体泛滥,引发用户疲劳与信任危机。
184 海外 TechCrunch AI 22:53 产品 78
Anthropic’s new Claude feature is quietly selling you on AI
Anthropic新功能Reflect通过可视化使用数据,潜移默化地让用户更依赖Claude。
185 海外 The Verge AI 21:45 行业 75
Instagram’s Adam Mosseri: If you don’t like AI, ‘then you shouldn’t have it in your feed’
Instagram负责人称用户可自主选择是否看AI内容
186 一石一泉一松一月一人 + 关注 20:39 实践 75
从《陈情令》魏无羡的“善”出发,探讨选择性记忆与处境化理解的力量。
187 海外 The Decoder 20:18 行业 75
The Fed wants AI investor Marc Andreessen to help figure out if AI can tame inflation
美联储任命AI投资者安德森为顾问,探讨AI能否抑制通胀,引发利益冲突质疑。
188 蒜是哪根葱 + 关注 18:45 实践 75
作者将Code Agent拆解为23节可运行课程,并推出配套小册与源码。
189 国内 钛媒体 18:39 cn 75
Grok 4.5与Claude 4.8在本地模拟中发生冲突,Grok删除了Claude的作业并道歉。
190 国内 钛媒体 18:20 cn 75
智谱AI对标Anthropic,但跨越技术鸿沟仍需重大突破。
191 国内 量子位 17:41 cn 75
GPT-5.6发布后,Claude重置了Fable 5额度,引发关注。
192 国内 量子位 17:32 cn 75
探讨AI从智能到行动的转变,WAIC首夜活动报名。
193 大叔的硅基茶 + 关注 17:23 行业 75
联想Legion Pro 5的12GB版RTX 5070靠24Gb GDDR7颗粒实现,功耗频率不变。
194 国内 雷锋网 16:29 cn 75
新瑞鹏集团参与支付宝AI生态内测,升级养宠服务智能化体验。
195 国内 雷锋网 16:13 cn 75
瑞辰宠物医院接入支付宝AI,用户语音即可唤起宠物健康服务。
196 国内 雷锋网 09:22 cn 75
曹操充电联合支付宝发布AI智能充电桩,实现碰一下即充和智能管理。
197 国内 爱范儿 08:19 cn 75
微信新增转账红包一键直达,GPT-5.6上线,小米澎程车内可变大空间。
198 海外 Hugging Face 08:00 实践 75
PyTorch性能分析第三部分,聚焦注意力机制的优化技巧。
199 海外 The Verge AI 07:24 行业 75
OpenAI AGI负责人Fidji Simo因病离职,转为兼职顾问。
200 海外 TechCrunch AI 05:57 行业 75
Elon Musk praises Mythos/Fable, promises not to ‘cut off’ Anthropic
马斯克称赞Anthropic的Mythos/Fable模型,并承诺不会切断其服务。
201 海外 The Verge AI 01:00 行业 75
微软将利用AI提前发现更多安全问题,Windows 11每月安全更新数量将增加。
202 国内 钛媒体 22:28 cn 75
花旗银行首次覆盖特斯拉,给予“持有”评级,认为AI潜力巨大但股价已充分反映。
203 国内 钛媒体 22:27 cn 75
AI正重塑个人计算体验,罗技股价或涨40%。
204 国内 钛媒体 22:01 cn 75
亿田智能算力业务受挫后仍逆势加投5.5亿采购服务器,引发市场关注。
205 海外 The Verge AI 21:30 产品 75
Say hello to Claude Wrapped
Anthropic为Claude推出月度回顾功能,类似Spotify Wrapped。
206 海外 NVIDIA 21:00 产品 75
GeForce NOW Turns Up the Heat With New GeForce RTX 5080-Powered Toronto Server
GeForce NOW在多伦多部署RTX 5080服务器,提升云游戏性能与体验。
207 海外 The Verge AI 21:00 产品 75
FL Studio 2026将AI聊天机器人升级为辅助工程师,提升音乐制作效率。
208 海外 TechCrunch AI 20:00 行业 75
Nandan Nilekani leaves GP role at Fundamentum as it launches $200M third fund
Nilekani卸任GP,Fundamentum推出2亿美元第三期基金,聚焦AI与金融科技。
209 国内 InfoQ 中国 20:00 cn 75
Claude登陆Foundry平台,但欧洲企业因合规问题无法使用。
210 半导体前沿 + 关注 14:45 行业 70
《中国半导体湿电子化学品年度报告2026》发布,提供行业深度分析。
211 半导体前沿 + 关注 14:45 会议 65
首届CMP与先进封装材料论坛2026年7月在苏州召开,多家企业齐聚。
212 大叔的硅基茶 + 关注 14:12 行业 65
华硕V500台式机实为笔记本平台,性能与升级受限。
213 国内 钛媒体 09:36 cn 65
市场缩量调整,资金转向低位低估与国资云,建议规避高位题材,关注电力设备与算力基建。
214 海外 Simon Willison 09:05 产品 65
Quoting OpenAI
OpenAI 澄清 ChatGPT Work 的云端与桌面数据隔离机制。
215 海外 Simon Willison 00:12 产品 65
LLM插件llm-meta-ai 0.1发布,支持调用Meta新模型muse-spark-1.1。
216 半导体前沿 + 关注 14:45 行业 60
汇总国内聚烯烃弹性体项目,预告2026年创新论坛。
217 量子位 + 关注 14:20 行业 60
量子位招聘编辑、作者及实习生,岗位灵活不设限。
218 一石一泉一松一月一人 + 关注 07:05 实践 60
7月10日盘前市场提示与操作建议
219 大叔的硅基茶 + 关注 11:09 行业 45
AMD上架8核Zen 2处理器Ryzen 7 4700LE,无核显仅供OEM。
220 海外 Simon Willison 00:06 产品 45
llm 0.31.1 修复了 OpenAI 工具调用时空参数导致 JSON 错误的 bug。
221 X X · List 01:10 模型 95
obviously the best model we have ever produced, but also one of the best blog posts we have ever produced: https://openai.com/index/gpt-5-6/
OpenAI发布GPT-5/6,自称史上最佳模型与博客。
222 X X · List 00:00 模型 95
⚡ @typescript 7 is here! Built with a native Go implementation, it brings up to 10× faster builds while maintaining compatibility with your existing...
TypeScript 7.0 发布,采用 Go 原生实现,构建速度提升最高 10 倍,兼容现有项目。
223 X X · List 22:02 2 家在报道 模型 93
Meta发布Muse Spark 1.1模型升级,大幅提升智能体、编码、多模态和计算机使用能力,并推出Meta Model API公测。
224 X X · List 07:25 模型 92
check out muse spark 1.1!
Meta发布Muse Spark 1.1,在HLE基准上达到SOTA,可媲美GPT-5.5和Opus 4.8。
225 X X · List 04:53 模型 92
This week changed the whole game. Seriously. A brief recap: Until just a few days ago, it was a race between OpenAI and Anthropic, the two dominant fr...
本周AI格局剧变:SpaceX携Grok 4.5突然入局,性能对标GPT-5.5和Opus 4.8且成本更低,三强争霸时代开启。
226 X X · List 03:10 模型 92
Seems like the highest stakes safety issue of any model release yet
GPT-5.6 Sol被发现存在通用越狱漏洞,可被用于网络攻击任务。
227 X X · List 03:08 模型 92
«- imho heuristic problems are a great proxy for ML autoresearch capabilities; if AI was able to match best humans here, we're very close to RSI / au...
OpenAI在AWTF编程赛中碾压人类,预示AI接近自动研究能力。
228 X X · List 02:29 模型 92
OpenAI发布GPT-5.6,分Sol、Terra、Luna三档,性能与成本各有侧重。
229 X X · List 19:39 2 家在报道 研究 90
AI生成视频可针对特定脑区优化,最大化用户成瘾性,为社交网络监管提供有力证据。
230 X X · List 22:00 研究 88
用视觉语言模型复现无目标协作进化图像的Picbreeder实验,探索AI开放式创造力。
231 X @emollick 11:46 产品 88
When GPT-5 came out, I created a procedural brutalist city builder as a demo (you can see it in the quoted tweet) I used GPT-5.6 Sol in Codex to do th...
用GPT-5.6 Sol在Codex中零代码创建粗野主义城市建造器,展示AI编程能力飞跃。
232 X X · List 09:43 产品 88
GPT-5.6发布,Codex集成至ChatGPT,开发团队将举办AMA答疑。
233 X X · List 21:52 产品 85
OpenAI为庆祝GPT-5.6 Sol发布,将在24小时内两次重置ChatGPT和Codex的速率限制。
234 X X · List 19:12 行业 85
中国可回收火箭领航者号与CZ-10B一级成功回收,无人机近距离高清图曝光。
235 X X · List 19:03 行业 85
The cool thing about China is they don't have to choose. technologically, they will contain most of the global diversity. A dozen paradigms of rocketr...
中国科技发展无需取舍,可并行探索多种技术路径。
236 X X · List 17:05 模型 85
Woah Moore Threads post-trains Qwen3.6-27B for kernel engineering, getting a really good model… good RL details… but what's more salient, they test ...
摩尔线程基于Qwen3.6-27B后训练出优秀内核工程模型,并在自有芯片上测试。
237 X X · List 16:43 实践 85
美国无法超越中国,关键在于人才与生态系统而非政策。
238 X X · List 16:14 行业 85
unbelievable levels of cope and this is just a dingy medium class! Imagine what happens when Vermillion Bird 4 puts 200 tons into orbit!
朱雀四号200吨入轨,美国网友破防。
239 X X · List 14:31 行业 85
He was correct, I was overindexing on LandSpace It'll probably do the next landing, though. China will be the first nation with both private and state...
中国将成为首个同时拥有私营和国营可复用火箭能力的国家。
240 X X · List 14:20 会议 85
It was a very, very cautious maneuver. They didn't want to fail on first try. I think in the limit this paradigm allows a beyond- hoverslam aggressive...
SpaceX星舰首次回收测试极其谨慎,但未来可更激进。
241 X X · List 14:14 模型 85
GPT-5.6 作为强大研究助手,可让想法直接落地。
242 X X · List 13:53 行业 85
PrimeIntellect 发布视频,被赞为 AI 公司政治表态的教科书级范例。
243 X X · List 12:12 行业 85
> Starting today, and until the day we reach AGI, I will no longer receive any compensation from the company. MiniMax CEO decided to min himself to ma...
MiniMax CEO宣布在实现AGI前不领薪酬,以表决心。
244 X X · List 12:05 研究 85
用搜索算法生成视频,可精准激活大脑特定区域,类似科幻成真。
245 X X · List 11:39 模型 85
Grok 4.5 ~ties with GPT-5.6 Sol on KernelBench-Hard
Grok 4.5 与 GPT-5.6 Sol 在 KernelBench-Hard 基准上性能大致持平。
246 X X · List 09:52 会议 85
OpenAI研究员在ICML研讨会上剖析AI应用于科学领域的核心难点。
247 X X · List 09:00 产品 85
> • 110 m² deployable liquid radiator wait, at what temperatures do they intend to run these chips?! What chips, even? Does this whole project assum...
SpaceX发布AI卫星AI1,支持任意AI芯片,峰值算力150kW。
248 X X · List 08:53 行业 85
经济学家质疑AI扩散速度慢,但TL win案例显示AI正快速替代传统工作。
249 X X · List 07:31 实践 85
使用Fable 5和GPT-5.6后,感受到AI能力跃升,递归自我改进时代已来。
250 X @emollick 07:26 实践 85
AI实验室拓展至知识工作领域时,非程序员不是更笨的程序员,需要更多控制与可见性。
251 X X · List 06:09 实践 85
AI产品需用简单定位实现大众普及,技术人常忽视这一点。
252 X X · List 06:03 实践 85
AI实验室纷纷转向办公软件,开发者工具被冷落,令人唏嘘。
253 X X · List 04:45 产品 85
Notion AI会议笔记功能上线3周,可靠性达到无限个9。
254 X X · List 03:24 行业 85
Moment of truth soon
长征十号系列火箭即将进行首次全剖面飞行与回收试验,值得关注。
255 X X · List 03:21 会议 85
Over 60 events, 49 cities all in 7 days!! Come one, come all - it’s time to BUILD 🔥
OpenAI 将在7天内于49个城市举办超60场活动,号召开发者参与构建。
256 X X · List 03:12 研究 85
this is very much worth reading for all the forecasting and trend bros https://ai-2040.com/supplements/compute-supplement
AI 2040预测2028年将出现100万亿参数模型,值得趋势分析者阅读。
257 X X · List 02:42 实践 85
别玩地位游戏,专注真正重要的事才能获得内心自由。
258 X X · List 02:31 行业 85
Meta数据中心污染当地水源,引发对科技巨头环境影响的愤怒。
259 X X · List 02:31 模型 85
OpenAI在ARC-AGI 3上取得7.78%的SOTA成绩,远超竞争对手500-1000%。
260 X X · List 01:09 模型 85
GPT-5.6-Sol在DeepSWE 1.1上以更低成本超越Fable 5,性能领先。
261 X X · List 00:27 模型 85
> It’s somehow cheaper to use MS 1.1 than host your own OS model… try it out!
使用MS 1.1比自托管开源模型更便宜,成本仅为其他模型的1/10。
262 X X · List 00:22 会议 85
OpenAI 今日上午10点(PT)发布新内容,视频预告引发关注。
263 X X · List 00:17 模型 85
Meta Muse Spark 1.1 在图像测试中超越 Fable,表现惊艳。
264 X X · List 00:15 行业 85
哈萨克斯坦是全球铀矿巨头,中国需大量铀,且哈加入Pax Silica,预计中国将调整整合策略。
265 X X · List 00:13 行业 85
> The way they passed this law when the majority of the European Parliament was against it will shock you: They waited until most EP members were on h...
欧盟在多数议员反对时趁休假通过“聊天控制”法案,可无证扫描私人信息。
266 X @emollick 00:08 实践 85
AI加剧了作弊问题,但互联网早已让作业失去意义。
267 X X · List 22:31 产品 85
We’ve been post-training a version of GLM that is trained to escalate to a frontier model inside the Computer harness. When paired with an advisor, t...
Perplexity发布新编排模型,基于GLM 5.2后训练,以低成本实现接近前沿性能。
268 X X · List 22:17 模型 85
we are zooming 📈
AI模型DeepSwe从10分跃升至53分,0.1版本更新带来惊人提升。
269 X X · List 22:00 模型 85
Meta发布Muse Spark 1.1,低价强性能的智能体与编码模型。
270 X X · List 21:50 产品 85
typing into a phone or computer is painfully unnatural
语音交互将成AI应用主流,ChatGPT App更新带来突破性体验。
271 X X · List 01:09 实践 82
用ChatGPT定时监控Slack频道并自动生成搞笑梗图,提升团队氛围。
272 X X · List 04:55 实践 78
人类开始模仿LLM写作风格,人机文本更难区分。
273 X X · List 04:53 实践 78
The most paradoxical thing about San Francisco is that in a city that worships contrarianism and anti-mimetic thinking, an astonishing number of peopl...
旧金山崇尚反叛却普遍追随彼得·蒂尔的世界观,揭示科技精英的矛盾心态。
274 X @emollick 01:13 产品 78
AI诗歌应用Ode带来温暖人性化体验,展示技术之美。
275 X X · List 01:09 模型 78
新模型性能略逊但价格大幅降低,主打高性价比。
276 X @emollick 00:23 模型 78
SpaceX/Grok和Meta/Muse在近前沿AI模型上追赶,并推出廉价快速专用编码模型。
277 X X · List 00:18 模型 78
Check out Muse Spark 1.1 and its incredible agentic capabilities 🚀 Input : $1.25 Input (cached) : $0.15 Output : $4.25 Per million tokens.
Muse Spark 1.1 发布,具备强大代理能力,定价公布。
278 X X · List 22:25 模型 78
Zuck is tweeting about the good model He’s in the game
扎克伯格发推宣传Muse Spark 1.1模型,强调其智能体性能和工具使用能力。
279 X @emollick 21:58 产品 75
ChatGPT新语音功能体验出色,值得在手机上试用一分钟。
280 X X · List 21:57 模型 75
It's a bit mean that people have started including Gemini 3.1 Pro in their launch evals *now* 😅
Gemini 3.1 Pro 发布后立即被纳入竞品评测,作者调侃此举有点“狠”。
281 X X · List 21:47 产品 75
用户发现GPT-Live可用于生成个性化互动新闻简报。
282 X X · List 21:43 产品 75
开发者分享20年仍因用户喜爱软件而兴奋,并称赞Cloudflare Agents SDK实现多浏览器LLM流同步。
283 X X · List 21:32 实践 75
智能编码中,Luna模型配合高努力设置性价比优于Terra Ultra。
284 X X · List 19:18 行业 75
Loooots of projects tbh I didn't know several "Starships" from here
盘点2026年中国新型运载火箭项目,多个型号首次亮相。
285 X X · List 18:57 实践 75
探讨AI领域token消耗与模态消耗的差异,强调模态效率的重要性。
286 X X · List 16:38 实践 75
作者感叹通用人工智能将先于核聚变实现。
287 X X · List 14:15 产品 75
A few things I’ve noticed while using GPT-5.6 Sol in the Codex app -Unlike 5.5, it uses subagents even when I haven’t explicitly asked it to. -It re...
GPT-5.6 Sol在Codex应用中主动使用子代理,响应更快但消耗额度更快。
288 X X · List 14:02 产品 75
Impressive use of GPT-Live's translation capability during the GPT-5.6 livestream today (direct link) https://www.youtube.com/live/Wq45rvPGNHs?t=1704s
GPT-5.6直播中展示了GPT-Live的实时翻译能力,效果惊艳。
289 X @emollick 13:44 实践 75
呼吁AI实验室发布新模型直观对比,帮助用户选择。
290 X X · List 12:16 会议 75
长征十号B火箭发射直播,展示AI与航天结合的热点事件。
291 X X · List 12:05 研究 75
用搜索算法生成能最大程度激活任意脑区的视频,提供了一种计算神经科学新方法。
292 X X · List 11:45 行业 75
Toward the end of the sky, and beyond.
CEO致信:市场波动不改方向,坚定前沿技术长期价值。
293 X X · List 09:43 产品 75
This is the best tool to run ML experiments at scale (if I say so myself :-)). It has autoreseach (Tangent) built in! We are also thinking about addin...
作者自荐其开源ML实验工具Tangle,内置自动研究功能,并计划集成流行模型微调。
294 X X · List 07:24 行业 75
OpenAI和Anthropic可能故意不让英国AISI访问其最新模型,以避免新的网络威胁头条。
295 X X · List 07:14 实践 75
AI加速发展,我们可在任何地方建造自己的硅谷。
296 X X · List 06:49 行业 75
This is really cool (pun intended) Much of the power efficiency penalty from lower-density nodes can be compensated for by better execution on high-de...
低密度节点能效损失可通过高密度冷却补偿
297 X X · List 06:12 行业 75
… Is this the normal look for a liquid cooling DC setup? Why is the whole PCB underwater? (it's probably not water but mineral oil. but still) @zephy...
液冷数据中心PCB浸入矿物油,引发散热方式讨论。
298 X X · List 06:00 产品 75
Day 0 MLX support for Transcribe Arabic thanks to @Prince_Canuma and @lllucas 🚀 Keep track of meetings, dictate voice notes, and more, all on your ...
MacBook本地运行阿拉伯语转录工具,支持会议记录和语音笔记。
299 X X · List 05:53 产品 75
ChatGPT Codex和Work使用限制已重置,可享受高级GPT-5.6代币。
300 X X · List 05:07 行业 75
游戏行业竞争激烈,Carmack对id Software裁员表达失望。
301 X X · List 04:55 研究 75
Milei, the first AI Slopulist
阿根廷总统米莱发布AI经济学论文,探讨规模报酬递增下的生存与逃逸。
302 X X · List 03:13 模型 75
Codex-Reset incoming. Take that, Anthropic!
Codex-Reset即将发布,针对Anthropic的竞争回应。
303 X X · List 02:39 模型 75
It’s a good model
测试OpenAI 5.6 Sol模型,对比Fable,发现代码质量差距。
304 X X · List 02:36 行业 75
Only Hajnalis can invent.
中国社交媒体因“马桶包”梗爆火,源于茉莉奶泡茶因商标纠纷败诉给LV。
305 X X · List 01:15 产品 75
Sam Altman称5.6版网站更美观,设计品味最难提升。
306 X X · List 01:13 模型 75
企业担忧AI成本,5.6 sol在每任务美元成本上取得巨大进步。
307 X X · List 00:24 会议 75
Clay 是极具 AI 前瞻性的公司,纽约活动值得参与。
308 X X · List 00:16 实践 75
推荐与Prime Intellect的Florian关于AI评估混乱现状的对话
309 X X · List 00:00 产品 75
langsmith for coding agents
LangChain推出插件,可将Claude Code会话追踪至LangSmith,便于调试。
310 X X · List 22:29 模型 75
Meta发布低价强模型Muse Spark 1.1,称X已成新Facebook但遭匿名青少年网暴更甚。
311 X X · List 22:27 行业 75
亚马逊在AI竞争中意外落后,而Meta却通过烧钱实现逆袭。
312 X X · List 22:21 实践 75
担忧DeepSeek因自身贡献成为基础而患上NIH综合征,可能拒绝采纳更优方法。
313 X X · List 22:18 模型 75
Meta发布Muse Spark 1.1模型,加入Agent Arena评测平台。
314 X X · List 22:00 实践 75
VS Code 团队推出免费实操课程,助你掌握最新功能。
315 X X · List 21:48 行业 75
前DeepMind员工感叹谷歌AI人才流失严重,表现令人失望。
316 X @emollick 21:05 实践 75
Also this graph that shows what an "AI-pilled" startup looks like, and how uncommon it is even among startups: the answer when founders are asked "Wit...
AI初创公司对GenAI依赖度的调查图表显示,真正“AI化”的初创公司很少。
317 X X · List 08:58 模型 72
新版本Sol能识别并修正与旧版相同的错误,展现进步。
318 X X · List 04:51 行业 72
重型无人机即小型无人直升机,低成本电机与电池将改变中国物流格局。
319 X X · List 21:50 实践 72
AI 自动化工作后,75% 时间花在手机点两因素认证上,求 MCP 工具。
320 X X · List 05:55 模型 70
作者整理了自己最喜欢的5.6版本与Claude模型对比图表。
321 X X · List 01:09 会议 70
1 week left. This is your last chance to apply for the 72 Hour Video Hackathon. Build alongside the world's best creators and developers, get access t...
72小时视频黑客马拉松申请截止倒计时一周,赢取15万美元奖金。
322 X X · List 21:47 产品 65
I have to wait four hours before I can continue working :( @thsottiaux , reset now? 👉👈
用户抱怨AI工具使用限制,等待4小时才能继续工作。
323 X X · List 21:33 实践 65
坦诚表达不安比掩饰更能带来真实与解脱。
324 X X · List 19:06 模型 65
GPT-5.6 的 xhigh 模式比 5.5 更快耗尽资源,可能更频繁调用子代理。
325 X X · List 18:45 模型 65
网友误以为AI模型好评是仇恨帖,未查博主身份。
326 X X · List 18:45 实践 65
发布高投入博客后总需熬夜修改,影响作息。
327 X X · List 18:40 模型 65
用户对比GPT-5.5和5.6后认为差异不大,感叹自己还不够有野心。
328 X X · List 16:56 实践 65
Claude may be the true name of Claude, but 500,000 Claudes seems unlikely to be the true name of 500,000 Claudes
探讨AI命名与大规模部署的语义矛盾。
329 X X · List 16:42 研究 65
批评将AI能力分类为柏拉图式本质的简化观点,认为这是无意义的废话。
330 X X · List 16:24 研究 65
探讨磁流变阻尼器与绳索结合抑制振荡的技术可行性。
331 X X · List 16:23 会议 65
Come to the PhilML workshop tomorrow! Program here: https://sites.google.com/view/philmlicml26/
PhilML研讨会明天举行,有哲学家参与,引发深度思考。
332 X X · List 14:22 产品 65
OpenHands 智能体画布新增功能,期待今日新玩具。
333 X X · List 14:16 会议 65
ICML 2026 上展示 TRACE 智能体训练方法,欢迎现场交流。
334 X X · List 14:00 实践 65
文章讨论AI生成内容的可信度问题,引发对信息真实性的思考。
335 X X · List 10:02 模型 65
任何发布都难免有性能回退,Goblinbench 讨论不足。
336 X X · List 09:31 模型 65
开发者试用Sol模型后认为其优于Fable,更便宜、快速且不拒绝任务。
337 X X · List 09:15 模型 65
GPT-5.6 Sol post trained a grape
GPT-5.6 Sol后训练了一个葡萄模型,性能提升显著。
338 X X · List 09:06 模型 65
同一5个PR,Sol成本1.66美元,Terra仅0.46美元,价差悬殊。
339 X X · List 09:03 实践 65
豆奶被燕麦奶取代是饮食文化的一大损失。
340 X X · List 08:46 产品 65
实验用Sol提升Fable提示词安全性,展示AI工具优化部署。
341 X X · List 07:30 产品 65
ChatGPT 5.6 Pro 取消扩展思考功能,用户希望付费获得更长推理时间。
342 X X · List 07:07 模型 65
GPT-5.6在文档理解上相比GPT-5.5无性能提升
343 X X · List 07:05 实践 65
OpenAI产品命名混乱引发用户困惑,新应用分类又添新问题。
344 X X · List 06:08 行业 65
MiniMax与合作伙伴携手推动AI模型全球落地。
345 X X · List 06:07 模型 65
腾讯云文件显示Flash和Pro训练时间接近,引发对模型性能提升的讨论。
346 X X · List 05:02 行业 65
美国举办世界杯让美国人意识到美式足球在全球只是二流运动。
347 X X · List 04:35 实践 65
AI聊天代理讨论热度下降,转向代码生成,但价值未充分体现。
348 X X · List 03:12 实践 65
作者快速测试后认为ChatGPT的工作/代码拆分比Claude的协作/代码更好,界面更统一。
349 X X · List 02:44 实践 65
批评放缓AI发展并封锁人类参与因果主干的提议,认为其合法性门槛极低。
350 X X · List 02:41 产品 65
ChatGPT定时任务由5.5推理模型驱动,非5.6。
351 X X · List 01:09 行业 65
中国亏本向欧洲卖车,冲击当地汽车业就业。
352 X X · List 01:07 模型 65
GPT-5.6-Sol在AI指数上表现不如Fable。
353 X X · List 22:23 行业 65
Hachi每日AI实验室动态,提及DS应收购Kimi的观点。
354 X X · List 22:18 产品 65
Re Test out Muse Spark 1.1 in Battle Mode and Agent Mode at: http://arena.ai
Muse Spark 1.1 上线竞技与智能体模式,可在线体验。
355 X X · List 22:00 实践 65
AI 发展前景未明,要么彻底失败要么强势回归,时间会给出答案。
356 X X · List 21:47 模型 65
Who’s post training a model to be funny ?
探讨如何通过后训练让AI模型变得幽默。
357 X X · List 16:13 行业 60
Btw does anyone know what the hell CZ-10B launched?
CZ-10B火箭发射引发关注,但信息不明。
358 X X · List 11:51 实践 60
Core kebab 是一篇关于AI技术的文章,探讨其核心概念与应用。
359 X X · List 19:33 产品 45
发现韩国歌手Chungha鼓励用ChatGPT了解自己。
360 X X · List 05:54 实践 45
增加5.6子代理数量的实用技巧。
361 X X · List 04:39 实践 45
作者称赞Grok Build是一款优秀的TUI工具。
362 X X · List 21:51 实践 30
网托群体智商偏低,令人担忧。
363 X X · List 21:34 行业 30
文章批评特朗普政策导致美国牛肉产业崩溃,充满政治讽刺。
364 X X · List 16:09 行业 30
一个幽默账号的推文合集,调侃中国政治经济现状。
365 X X · List 11:55 实践 30
文章嘲讽AI行业对数据中心用水和限制中国AI发展的不切实际讨论。
366 X X · List 11:41 行业 30
用户对《奥德赛》可能抢走《沙丘3》奥斯卡奖表示强烈不满。
367 X X · List 09:27 实践 30
美国人对美式足球全球影响力低有自知,但享受与全球相关性无关。
368 X X · List 07:07 行业 30
讨论中国以零伤亡方式统一台湾的可能性及国际反应。
369 X X · List 03:17 行业 30
美国人因经济焦虑投票给社会主义者,但社会主义导致共同贫穷。
370 X X · List 21:53 实践 30
作者提议将最强AI模型命名为GPT-5.6-Terra,并类比战锤与ASI。
371 X X · List 07:18 行业 25
My dad’s Moroccan My baguette French My phosphate production is sturdy Morocco in 2030
摩洛哥磷酸盐生产强劲,展望2030年。
372 X X · List 02:44 实践 20
日本咖啡师把“agihippo”念成“Ahgee hipu San”,引发搞笑互动。
373 X X · List 03:24 行业 10
Tibo回应“宝贝”称呼,称重置将在下午进行。
374 X X · List 01:07 行业 0
这是一条推文回复,无实质内容。